Le cap dur à 16s coupait la réf en plein mot ; l'auto-ASR transcrivait le bout tronqué (ex. 'présenter') et OmniVoice le recrachait en tête de chaque génération. - prepare_wav : couper sur une frontière de silence (librosa.effects.split), jamais à cap brut → clip finit en silence, mots entiers. - enroll : tronquer ref_text à la dernière phrase complète (. ! ?). Validé sur le consentement réel de richard : 24.4s→15.7s, ref_text finit '…des oiseaux.' (plus de mot parasite). NB : voix enrôlées avec l'ancien cap = à ré-enrôler. Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com> |
||
|---|---|---|
| .. | ||
| __init__.py | ||
| admin_ingest.py | ||
| autosync.py | ||
| bridge.py | ||
| enroll.py | ||
| orchestrator.py | ||
| transcribe.py | ||
| transfer.py | ||
| worker.py | ||