Vient de tester Index TTS2, le plafond de la clonage vocal open source a été encore élevé.
La plus grande différence avec les autres TTS est le « contrôle émotionnel ». Ce n’est pas une lecture mécanique, vous pouvez lui demander de parler avec une tonalité de « tristesse, colère, excitation extrême », et même contrôler la vitesse et les pauses. Mécanisme Zero-Shot, en insérant 10 secondes d’audio, il clone directement.
Mais le déploiement de la version originale sur Github est extrêmement contre-intuitif. Bloqué par la version CUDA, les dépendances Python, l’environnement de compilation C++. Sur un ordinateur normal, exécuter le code natif peut provoquer des erreurs pendant une journée.
Pour l’usage personnel de l’équipe, j’ai tout encapsulé dans un environnement complet. Créé un package d’intégration en un clic pour Windows / Mac.
· Décompresser (attention à ne pas mettre de caractères chinois dans le chemin) · Double-cliquer sur le fichier 一键启动.bat · Utiliser directement via WebUI sur le navigateur Fonctionne hors ligne localement, sans dépenser un seul centime en Token. Si besoin, envoyez un message privé ! Adresse du projet open source :
Voir l'original
Cette page peut inclure du contenu de tiers fourni à des fins d'information uniquement. Gate ne garantit ni l'exactitude ni la validité de ces contenus, n’endosse pas les opinions exprimées, et ne fournit aucun conseil financier ou professionnel à travers ces informations. Voir la section Avertissement pour plus de détails.
Vient de tester Index TTS2, le plafond de la clonage vocal open source a été encore élevé.
La plus grande différence avec les autres TTS est le « contrôle émotionnel ». Ce n’est pas une lecture mécanique, vous pouvez lui demander de parler avec une tonalité de « tristesse, colère, excitation extrême », et même contrôler la vitesse et les pauses. Mécanisme Zero-Shot, en insérant 10 secondes d’audio, il clone directement.
Mais le déploiement de la version originale sur Github est extrêmement contre-intuitif. Bloqué par la version CUDA, les dépendances Python, l’environnement de compilation C++. Sur un ordinateur normal, exécuter le code natif peut provoquer des erreurs pendant une journée.
Pour l’usage personnel de l’équipe, j’ai tout encapsulé dans un environnement complet. Créé un package d’intégration en un clic pour Windows / Mac.
· Décompresser (attention à ne pas mettre de caractères chinois dans le chemin)
· Double-cliquer sur le fichier 一键启动.bat
· Utiliser directement via WebUI sur le navigateur
Fonctionne hors ligne localement, sans dépenser un seul centime en Token. Si besoin, envoyez un message privé !
Adresse du projet open source :