Summary
Generator suara robot ini memungkinkan Anda mengetik baris dan melihat pratinjau transkripsi bertanda jeda di lima preset: Vocoder Bot, Monotone Synth, Glitch Stutter, 8-bit Quantize, dan Deep Drone. Setiap preset membawa pergeseran pitch dan formant tetap yang akan Anda masukkan ke mesin TTS atau rantai vocoder, sementara slider intensitas hanya mengubah kepadatan jeda dan, pada Glitch Stutter, frekuensi pengulangan suku kata. Dibangun untuk developer audio game yang membuat naskah dialog NPC dan produser audiobook yang memeriksa karakter mekanis sebelum render lengkap, tanpa file audio, tanpa panggilan API eksternal, hanya naskah bertanda.
Generator Suara Robot: Pratinjau 5 Gaya Pengucapan Mekanis
Ketik baris, pilih preset, dan dapatkan transkripsi bertanda jeda dengan angka pitch, formant, dan pacing di belakangnya, tidak perlu render audio untuk memeriksa bacaan.
Apa yang sebenarnya berubah di setiap preset
Tanda tangan akustik tetap per preset
Setiap preset membawa pergeseran pitch dan formantnya sendiri. Vocoder Bot berjalan +2 semitone dengan potongan formant 30%, Deep Drone berjalan -8 semitone dengan formant naik 10%. Ini adalah angka awal yang akan Anda ketik ke plugin vocoder atau tag pitch mesin TTS.
Intensitas menskalakan kepadatan jeda saja
Slider mengubah seberapa sering tag jeda mendarat, dari setiap 2 kata pada 100% turun ke interval baseline preset pada 0%, dan pada Glitch Stutter juga menaikkan seberapa sering suku kata berulang. Tidak pernah menyentuh angka pitch atau formant, jadi identitas akustik tetap dapat diprediksi.
Output adalah naskah, bukan render
Anda mendapatkan transkripsi bertanda seperti [jeda 120ms], format penanda yang sama dengan yang akan Anda ubah menjadi tag break SSML atau baca selama sesi suara. Tidak ada audio yang dihasilkan dan tidak ada yang meninggalkan browser Anda kecuali penghitung run anonim.
Pertanyaan dari sesi
Apakah tag [jeda Xms] cocok dengan sintaks SSML <break> yang diharapkan mesin TTS saya?
Mengapa Glitch Stutter melewati kata-kata pendek seperti 'the' atau 'and'?
Bisakah saya menjalankan 300 baris NPC melalui ini sekaligus?
Apakah menggerakkan slider intensitas mengubah pergeseran pitch atau formant?
Dari mana dasar 150 wpm untuk pacing yang diperkirakan berasal?
Apakah audio sebenarnya dihasilkan di sini?
Preset mana yang berbunyi paling dekat dengan pengumuman PA versus unit industri berat?
Apakah alat menyimpan atau mengirim teks naskah saya ke mana pun?
Membangun lebih dari sekadar satu baris?
Alat kloning suara AnyVoice mencakup batch dialog NPC penuh, narasi audiobook multi-bab, dan pengiriman yang dikendalikan emosi di luar lima preset mekanis ini.