Des nouvelles ont été ajoutées en tête de listes.
Remontez pour les voir.
Inscription à la newsletter
Un bug dans Qwen3-TTS m'a appris que la voix est biométrique
DEV -
21/07
Le modèle de clonage vocal formé pour mon projet est de 50 mégaoctets. N'importe qui avec ces 50 mégaoctets peut...
Le modèle de clonage vocal formé pour mon projet est de 50 mégaoctets. N'importe qui possédant ces 50 mégaoctets peut être moi de manière convaincante lors d'un appel téléphonique.
Je n'ai pas construit le projet pour prouver ce point. Je l'ai construit parce que chaque outil de clonage vocal d'IA que j'ai essayé effaçait mon accent nigérian. ElevenLabs, XTTS, F5-TTS — Données de formation en anglais occidental, sortie générique avec accent africain. Le pipeline qui a finalement fonctionné enchaîne Qwen3-TTS (le modèle de clonage vocal 1,7B d'Alibaba, sorti en janvier 2026) avec un clip de référence de ma propre voix. Fonctionne sur le GPU Kaggle gratuit. Article complet sur github.com/dannwaneri/naija-voice.
L’obstacle technique était petit et spécifique. Qwe... [Courte citation de 8% de l'article original]
Loading...
🍪
Le modèle économique de notre site repose sur l'affichage de publicités personnalisées basées sur l'utilisation de cookies publicitaires. En continuant votre visite sur notre site, vous consentez à l'utilisation de ces cookies.
Politique de confidentialité