Le cap dur à 16s coupait la réf en plein mot ; l'auto-ASR transcrivait le bout tronqué (ex. 'présenter') et OmniVoice le recrachait en tête de chaque génération. - prepare_wav : couper sur une frontière de silence (librosa.effects.split), jamais à cap brut → clip finit en silence, mots entiers. - enroll : tronquer ref_text à la dernière phrase complète (. ! ?). Validé sur le consentement réel de richard : 24.4s→15.7s, ref_text finit '…des oiseaux.' (plus de mot parasite). NB : voix enrôlées avec l'ancien cap = à ré-enrôler. Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com> |
||
|---|---|---|
| .. | ||
| adb | ||
| api | ||
| provider | ||
| store | ||
| voice | ||
| web | ||
| __init__.py | ||
| __main__.py | ||
| fleet.py | ||