mirror of
https://github.com/R0m1k3/Socialflow.git
synced 2026-10-11 17:26:45 +02:00
Service ffmpeg-api réécrit (ffmpeg-service/app/) : - Appels FFmpeg asynchrones : le service ne se fige plus pendant un rendu - Vidéo récupérée par téléchargement (GET /files/…) au lieu de base64 en JSON - Vraies erreurs HTTP ; échec explicite si la voix demandée est impossible - 30 voix Gemini + ton de lecture (dynamique, chaleureux, promo, calme), clé en en-tête, modèle configurable avec repli - Edge TTS 7 (minutage des mots restauré), secours en voix françaises - Voix traitée : filtre, compression, niveau constant ; musique bouclée et baissée automatiquement sous la voix ; mix final à -14 LUFS - Sous-titres calés mot à mot (Whisper pour Gemini et la voix d'origine, à la place de ffsubsync), style Montserrat, placés hors des boutons Reels - Vidéo : plus de retouche luminosité forcée, scaling lanczos, HDR iPhone converti, BT.709, AAC 48 kHz 192k ; la vidéo s'allonge si la voix dépasse - Grand logo de fin affiché après la voix ; FFmpeg 7.0.2 épinglé, polices et modèle Whisper intégrés à l'image ; tests pytest et ruff Application : - Sélecteur de voix partagé (4 pages) : moteur, 30 voix, ton, écoute - Reel images : minutage réel des mots, interrupteur voix respecté - sync-info ne génère plus de voix à chaque frappe (estimation locale) - Stabilisation désactivée par défaut, route /reels/preview inutilisée retirée - Log « [ReelQueue] Worker démarré » pour vérifier la version déployée Co-Authored-By: Claude Opus 5.5 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_018Ze4bs7tpF1KGWUk6ZZSZ4
40 lines
1.5 KiB
Docker
40 lines
1.5 KiB
Docker
FROM python:3.11-slim
|
|
|
|
# Polices des sous-titres (Montserrat) et des emojis, installées au build
|
|
# plutôt que téléchargées à chaque démarrage.
|
|
RUN apt-get update && apt-get install -y --no-install-recommends \
|
|
wget xz-utils ca-certificates fontconfig \
|
|
fonts-montserrat fonts-dejavu-core fonts-noto-color-emoji \
|
|
&& rm -rf /var/lib/apt/lists/*
|
|
|
|
# FFmpeg statique (vidstab, zimg pour le tone-mapping HDR, libass).
|
|
# Version épinglée : une mise à jour ne change plus le rendu à notre insu.
|
|
ARG FFMPEG_VERSION=7.0.2
|
|
RUN wget -q https://johnvansickle.com/ffmpeg/releases/ffmpeg-${FFMPEG_VERSION}-amd64-static.tar.xz \
|
|
|| wget -q https://johnvansickle.com/ffmpeg/old-releases/ffmpeg-${FFMPEG_VERSION}-amd64-static.tar.xz \
|
|
&& tar xf ffmpeg-${FFMPEG_VERSION}-amd64-static.tar.xz \
|
|
&& mv ffmpeg-*-amd64-static/ffmpeg ffmpeg-*-amd64-static/ffprobe /usr/local/bin/ \
|
|
&& rm -rf ffmpeg-* \
|
|
&& fc-cache -f
|
|
|
|
WORKDIR /app
|
|
|
|
COPY requirements.txt .
|
|
RUN pip install --no-cache-dir -r requirements.txt
|
|
|
|
# Modèle Whisper (calage des sous-titres) téléchargé au build : aucun accès
|
|
# réseau nécessaire au premier rendu.
|
|
ARG WHISPER_MODEL=base
|
|
ENV WHISPER_MODEL=${WHISPER_MODEL} \
|
|
HF_HOME=/opt/hf-cache \
|
|
HOME=/tmp \
|
|
XDG_CACHE_HOME=/tmp/.cache
|
|
RUN python -c "from faster_whisper import WhisperModel; WhisperModel('${WHISPER_MODEL}', device='cpu', compute_type='int8')"
|
|
|
|
COPY main.py .
|
|
COPY app ./app
|
|
|
|
EXPOSE 8000
|
|
|
|
CMD ["uvicorn", "main:app", "--host", "0.0.0.0", "--port", "8000"]
|