Summary
Ten generator głosu robota pozwala wpisać tekst i przejrzeć go jako transkrypt oznaczony pausami w pięciu presetach: Vocoder Bot, Synteza Monotonowa, Glitch ze Zakankami, 8-bit Kwantyzacja i Głębokie Drony. Każdy preset ma stałe wartości przesunięcia pitch i formant, które wpisałbyś do silnika TTS lub łańcucha vocoder, podczas gdy suwak intensywności zmienia tylko gęstość pauz oraz na Glitch ze Zakankami częstotliwość zakamków. Stworzone dla deweloperów audio gier opracowujących dialogi NPC i producentów audiobooków sprawdzających robotyczny czyt znaku przed pełnym renderowaniem — bez pliku audio, bez zewnętrznego API, tylko gotowy transkrypt.
Generator Głosu Robota: Sprawdź 5 Stylów Robotycznego Czytania
Wpisz tekst, wybierz preset i uzyskaj transkrypt oznaczony pausami z liczbami pitch, formant i tempa za nim, bez potrzeby generowania audio.
Co faktycznie zmienia każdy preset
Stała sygnatura akustyczna dla każdego presetu
Każdy preset ma własne przesunięcie pitch i formant. Vocoder Bot pracuje z +2 semitonami i cięciem formant 30%, Głębokie Drony używa -8 semitonów ze wzmocnionym o 10% formantem. To liczby początkowe, które wpisałbyś do pluginu vocoder lub tagu pitch silnika TTS. Te stałe wartości pozostają niezmieniąte niezależnie od suwaka intensywności.
Intensywność skaluje tylko gęstość pauz
Suwak zmienia jak często tag pauzy się pojawia, od co 2 wyrazy przy 100% do bazowego interwału presetu przy 0%, a na Glitch ze Zakankami także podnosi jak często powtarza się sylaba. Nigdy nie zmienia liczb pitch lub formant, więc tożsamość akustyczna pozostaje przewidywalna.
Wynik to skrypt, nie render
Otrzymujesz oznaczony transkrypt taki jak [pause 120ms], ten sam format znacznika jaki konwertujesz na tag SSML break lub czytasz podczas sesji głosowej. Żaden audio nie jest generowany i nic poza anonimowym licznikiem uruchomień nie opuszcza przeglądarki. Transkrypt obliczany jest całkowicie po stronie klienta w przeglądarce.
Pytania z sesji
Czy tag [pause Xms] odpowiada składni SSML <break>, którą oczekuje mój silnik TTS?
Dlaczego Glitch ze Zakankami pomija krótkie wyrazy jak 'the' czy 'and'?
Czy mogę wrzucić 300 linii NPC na raz?
Czy przesuwanie suwaka intensywności zmienia przesunięcie pitch lub formant?
Skąd pochodzi bazowa linia 150 słów na minutę do szacunkowego tempa?
Czy tutaj generuje się jakiś dźwięk?
Który preset czyta najbliżej ogłoszenia PA kontra ciężka jednostka przemysłowa?
Czy narzędzie gdzieś przechowuje lub wysyła mój tekst skryptu?
Budujesz więcej niż jedną linię?
Narzędzia klonowania głosu AnyVoice obejmują partie dialogów NPC, narrację wielorozdziałowych audiobooków i dostarczanie kontrolowane emocjami poza tymi pięcioma robotycznymi presetami.