Resumen
Este generador de voz robótica te permite escribir una línea y visualizarla como transcripción etiquetada con pausas en cinco presets: Vocoder Bot, Monotone Synth, Glitch Stutter, 8-bit Quantize y Deep Drone. Cada preset incluye valores fijos de pitch shift y formant shift que introducirías en un motor TTS o cadena de vocalización, mientras que el deslizador de intensidad solo modifica la densidad de pausas y, en Glitch Stutter, la frecuencia de repetición de sílabas. Diseñado para desarrolladores de audio de videojuegos que estructuran diálogos NPC y productores de audiolibros que validan una lectura robótica antes del render completo, sin archivo de audio, sin llamadas API externas, solo la transcripción etiquetada.
Generador de voz robótica: 5 presets de entrega mecánica
Escribe una línea, elige un preset y obtén una transcripción etiquetada con los números de pitch, formante y cadencia detrás, sin renderizar audio para verificar la lectura.
Qué cambia en cada preset
Firma acústica fija por preset
Cada preset posee su propio pitch shift y formant shift. Vocoder Bot ejecuta +2 semitonos con corte de formante 30%, Deep Drone ejecuta -8 semitonos con formante potenciada 10%. Estos son los números iniciales que introducirías en un plugin vocalizador o en la etiqueta de pitch de un motor TTS.
La intensidad escala solo la densidad de pausas
El deslizador cambia con qué frecuencia aparece una etiqueta de pausa, desde cada 2 palabras a 100% hasta el intervalo base del preset a 0%, y en Glitch Stutter también incrementa la frecuencia de repetición de sílabas. Nunca toca los números de pitch o formante, así la identidad acústica permanece predecible.
La salida es un script, no un render
Obtienes una transcripción etiquetada como [pause 120ms], el mismo formato de marcador que convertirías en una etiqueta SSML break o leerías durante una sesión de voz. Sin audio generado y sin nada excepto un contador anónimo de ejecuciones que abandona tu navegador.
Preguntas de la sesión
¿Coincide la etiqueta [pause Xms] con la sintaxis SSML <break> que espera mi motor TTS?
¿Por qué Glitch Stutter omite palabras cortas como 'the' o 'and'?
¿Puedo ejecutar 300 líneas de NPC a través de esto de una sola vez?
¿Cambiar el deslizador de intensidad modifica el pitch o el shift de formante?
¿De dónde viene la línea base de 150 ppm para la cadencia estimada?
¿Se genera realmente algo de audio aquí?
¿Qué preset suena más cercano a un anuncio de PA versus una unidad industrial pesada?
¿Almacena o envía la herramienta el texto de mi script a algún lugar?
¿Construyendo más que una línea ocasional?
Las herramientas de clonación de voz de AnyVoice cubren lotes completos de diálogos NPC, narración de audiolibros de múltiples capítulos y entrega controlada por emoción más allá de estos cinco presets robóticos.