Résumé
Ce générateur de voix robot vous permet de taper une ligne et de la prévisualiser sous forme de transcript marquée avec balises de pause sur cinq présets : Vocoder Bot, Monotone Synth, Glitch Stutter, 8-bit Quantize et Deep Drone. Chaque préset porte des chiffres fixes de pitch shift et formant shift que vous entreriez dans un moteur TTS ou une chaîne vocoder, tandis que le curseur d'intensité ne change que la densité des pauses et, sur Glitch Stutter, la fréquence des répétitions de syllabes. Conçu pour les développeurs audio de jeux qui bloquent le dialogue NPC et les producteurs d'audiobooks qui vérifient une lecture robotisée avant un rendu complet, sans fichier audio, sans appel API externe, juste le script balisé.
Générateur de voix robot : prévisualisez 5 styles robot
Tapez une ligne, choisissez un préset, et obtenez une transcript marquée avec les chiffres de pitch, formant et pacing derrière, aucun rendu audio requis pour vérifier la lecture.
Ce que chaque préset change réellement
Signature acoustique fixe par préset
Chaque préset porte son propre décalage de pitch et décalage de formant. Vocoder Bot s'exécute à +2 demi-tons avec formant coupé de 30%, Deep Drone s'exécute à -8 demi-tons avec formant augmenté de 10%. Ce sont les chiffres de démarrage que vous entreriez dans un plugin vocoder ou dans une balise de pitch du moteur TTS.
L'intensité ajuste uniquement la densité des pauses
Le curseur change la fréquence d'arrivée d'une balise de pause, de tous les 2 mots à 100% à l'intervalle de base du préset à 0%, et sur Glitch Stutter il augmente aussi la fréquence de répétition d'une syllabe. Il ne touche jamais aux chiffres de pitch ou de formant, donc l'identité acoustique reste prévisible.
Le résultat est un script, pas un rendu
Vous obtenez une transcript marquée comme [pause 120ms], le même format de marqueur que vous convertiriez en balise SSML break ou que vous liriez lors d'une session vocale. Aucun audio n'est généré et rien au-delà d'un compteur de traçage anonyme ne quitte votre navigateur.
Questions de la session
La balise [pause Xms] correspond-elle à la syntaxe SSML <break> que mon moteur TTS attend ?
Pourquoi Glitch Stutter ignore-t-il les mots courts comme « the » ou « and » ?
Puis-je exécuter 300 lignes NPC à travers ceci en une seule fois ?
Le déplacement du curseur d'intensité change-t-il le décalage de pitch ou de formant ?
D'où vient la ligne de base de 150 wpm pour le pacing estimé ?
Y a-t-il réellement un audio généré ici ?
Quel préset se rapproche le plus d'une annonce PA par rapport à une unité industrielle lourde ?
L'outil stocke-t-il ou envoie-t-il mon texte de script quelque part ?
Construisez plus qu'une ligne ponctuelle ?
Les outils de clonage vocal d'AnyVoice couvrent les lots de dialogues NPC complets, la narration d'audiobooks multi-chapitres, et la livraison contrôlée par émotion au-delà de ces cinq présets robotisés.