Commit Graph
11 Commits
Author SHA1 Message Date
Claude 8515315e0b Micro : suppression de la bascule automatique + gain auto renforcé et mémorisé
- L'app ne change plus jamais de micro toute seule : choix manuel dans la
  liste uniquement, simple alerte si aucun son n'est capté
- Gain automatique : seuil d'amplification élargi (signal < 12000), montée
  plus rapide (x1.3/250 ms), plafond x80, et gain mémorisé entre réunions
  pour être efficace dès la première seconde

https://claude.ai/code/session_01YHMp3EKzr4s6o8w1ygxuUe
2026-06-13 01:58:33 +00:00
Claude 8f1ebe5545 La recherche auto de micro ne s'active plus qu'au démarrage
Un silence en cours de réunion (normal) déclenchait des bascules de micro
intempestives qui cassaient la capture. Désormais : recherche uniquement
tant qu'aucun son n'a jamais été capté ; dès qu'un micro a fait ses preuves,
on n'y touche plus (sauf changement manuel).

https://claude.ai/code/session_01YHMp3EKzr4s6o8w1ygxuUe
2026-06-12 18:41:59 +00:00
Claude 13be3030be Gain automatique du micro avant la détection de parole
Les micros faibles (casques) passaient sous le seuil du VAD : la plupart
des phrases n'étaient jamais découpées en segments. Un GainNode adaptatif
(jusqu'à x40, ajusté toutes les 250 ms, repli en cas de saturation) amène
le signal à un niveau exploitable avant le rééchantillonnage et le VAD.

https://claude.ai/code/session_01YHMp3EKzr4s6o8w1ygxuUe
2026-06-12 18:38:36 +00:00
Claude db73e8db02 Diarisation des locuteurs et pause/reprise (intégration des travaux de main)
- diarizer.py (ECAPA-TDNN + clustering incrémental) repris tel quel de main
- Hooks dans le pipeline : colonne speaker, identification par segment dans
  un thread, locuteur dans l'interface (étiquettes colorées) et les exports
- Pause/reprise : bouton ⏸, le client coupe l'envoi, le serveur clôt le
  segment en cours
- Case « Locuteurs » pour désactiver la diarisation par réunion
- DIARIZATION=on par défaut dans les compose, PyTorch CPU dans l'image

https://claude.ai/code/session_01YHMp3EKzr4s6o8w1ygxuUe
2026-06-12 17:50:51 +00:00
Claude 9b083579e1 Recherche automatique d'un micro fonctionnel pendant l'enregistrement
Si le micro actif reste muet 5 s, l'app bascule à chaud sur les autres
micros un par un jusqu'à en trouver un qui capte du son, puis le mémorise.
Le sélecteur permet aussi de changer de micro en cours d'enregistrement.

https://claude.ai/code/session_01YHMp3EKzr4s6o8w1ygxuUe
2026-06-12 13:22:42 +00:00
Claude f92e6dd51f Adaptation aux micros instables (Bluetooth) sans changer la config du poste
- Sélecteur de micro intégré à l'interface (persisté, deviceId exact)
- Amplification serveur des segments trop faibles (mode mains-libres BT)
- Alerte visible si aucun son n'est capté pendant 5 s
- Niveau crête de chaque segment dans les logs
- Cache-Control: no-cache sur les fichiers statiques (fini le vieux JS en cache)

https://claude.ai/code/session_01YHMp3EKzr4s6o8w1ygxuUe
2026-06-12 13:12:31 +00:00
Claude b802a3c95f Authentification : login/mot de passe (admin/admin par défaut)
- Page de connexion, session 7 jours par cookie HMAC signé (secret persisté)
- Protection de l'API (401) et du WebSocket (code 4401), / redirige vers /login
- Bouton de déconnexion, redirection automatique à l'expiration de session
- Identifiants configurables via LIVEFLOW_USER / LIVEFLOW_PASSWORD

https://claude.ai/code/session_01YHMp3EKzr4s6o8w1ygxuUe
2026-06-12 12:43:39 +00:00
Claude b32119d5c0 Diagnostic : vumètre micro dans l'interface et logs serveur des segments/transcriptions
https://claude.ai/code/session_01YHMp3EKzr4s6o8w1ygxuUe
2026-06-12 11:10:47 +00:00
Claude 480a380dde Micro : nouvel essai avec contrainte minimale si getUserMedia échoue
https://claude.ai/code/session_01YHMp3EKzr4s6o8w1ygxuUe
2026-06-12 11:03:31 +00:00
Claude 71ee13f845 Frontend : message d'erreur micro détaillé selon la cause (NotReadableError, etc.)
https://claude.ai/code/session_01YHMp3EKzr4s6o8w1ygxuUe
2026-06-12 09:00:15 +00:00
Claude a8517c3597 Implémentation complète de LiveFlow (proposition 2, moteur Qwen3-ASR)
- docker-compose : Caddy (HTTPS local) + app FastAPI + Qwen3-ASR via vLLM (GPU)
- Backend : WebSocket audio, segmentation VAD (WebRTC), appel ASR compatible
  OpenAI, stockage SQLite, exports TXT/MD/SRT/JSON
- Frontend : capture micro (AudioWorklet, rééchantillonnage 16 kHz),
  transcription live, historique des réunions, copie et téléchargement
- README : démarrage, prérequis GPU, changement de moteur ASR

https://claude.ai/code/session_01YHMp3EKzr4s6o8w1ygxuUe
2026-06-11 16:28:17 +00:00