Samenvatting
Deze robotstem generator laat je een tekstlijn intypen en bekijken als een pauze-getagde transcript over vijf voorinstellingen: Vocoder Bot, Monotone Synth, Glitch Stutter, 8-bit Quantize en Deep Drone. Elke voorinstelling heeft vaste pitch- en formant-verschuivingen die je zou invoeren in een TTS-engine of vocoder-ketting. De intensiteitsschuif wijzigt alleen de pauze-dichtheid en, bij Glitch Stutter, de stutter-frequentie. Gebouwd voor game audio developers die NPC-dialogen blokkeren en audiobook-producers die een robotische karakterlezen controleren voordat ze voluit renderen - geen audiobestand, geen externe API-aanroep, alleen de getagde script.
Robotstem Generator: 5 Stijlen Robotische Uitspraak
Type een tekstlijn, kies een voorinstelling, en krijg een pauze-getagde transcript met de pitch-, formant- en tempo-waarden eraan - geen audio-rendering vereist om het te controleren.
Wat elke voorinstelling werkelijk verandert
Vaste akoestische karakteristiek per voorinstelling
Elke voorinstelling heeft zijn eigen pitch-verschuiving en formant-verschuiving. Vocoder Bot draait +2 halftonen met formant 30% verlaagd, Deep Drone draait -8 halftonen met formant 10% verhoogd. Dit zijn de startgetallen die je in een vocoder-plugin of TTS-engine's pitch-tag zou invoeren.
Intensiteit regelt alleen pauze-dichtheid
De schuif verandert hoe vaak een pauze-tag landde, van elke 2 woorden bij 100% tot de standaardinterval van de voorinstelling bij 0%, en bij Glitch Stutter verhoogt het ook hoe vaak een lettergreep wordt herhaald. Het raakt nooit de pitch- of formant-nummers aan, dus de akoestische identiteit blijft voorspelbaar.
Uitvoer is een script, geen render
Je krijgt een getagde transcript zoals [pause 120ms], dezelfde markeringsnotatie die je in een SSML break-tag zou omzetten of voorleest in een spraaksessie. Geen audio wordt gegenereerd en niets behalve een anonieme run-teller verlaat je browser.
Vragen van de sessie
Komt de [pause Xms]-tag overeen met de SSML <break>-syntaxis die mijn TTS-engine verwacht?
Waarom slaat Glitch Stutter korte woorden over zoals 'the' of 'and'?
Kan ik 300 NPC-regels tegelijk door dit heen lopen?
Verandert het verplaatsen van de intensiteitsschuif de pitch- of formant-verschuiving?
Waar komt de 150 wpm-baseline voor geschat tempo vandaan?
Wordt hier werkelijk audio gegenereerd?
Welke voorinstelling klinkt het dichtst bij een PA-aankondiging versus een zware industriële unit?
Slaat de tool mijn scripttekst op of verzendt het ergens heen?
Bouw je meer dan een eenmalige regel?
De voice cloning tools van AnyVoice dekken volledige NPC-dialoogbatches, audioboeken met meerdere hoofdstukken en op emoties gecontroleerde levering buiten deze vijf robotische voorinstellingen.