Summary

Ten darmowy formatter hiszpański text to speech zamienia zwykły skrypt w wersję otagowaną pauzami i emfazą, gotową do narracji lub silnika głosowego takiego jak AnyVoice. Wybierz akcent regionalny: kastylijski, meksykański, neutralny latynoamerykański lub rioplatański, ustaw styl pauzy i odsłuchaj wynik wbudowanym hiszpańskim głosem przeglądarki: bez uploadu, bez konta, bez zapytań do serwera. Formatter szacuje czas trwania nagrania na podstawie bazowych 150 słów na minutę skalowanych suwakiem tempa, i taguje długie pauzy, krótkie pauzy oraz podkreślone słowa, dzięki czemu skrypt trafia prosto do pipeline'u produkcyjnego zgodnego z SSML.

Formatuj skrypty hiszpański text to speech z tagami akcentu regionalnego

Wklej skrypt, wybierz akcent kastylijski, meksykański, neutralny latynoamerykański lub rioplatański, i otrzymaj tagi pauz oraz emfazy plus darmowy podgląd w przeglądarce, zanim sięgniesz po płatny silnik głosowy.

Formatter skryptu hiszpański TTS i podgląd głosu

Wklej swój hiszpański skrypt, wybierz akcent regionalny i styl pauzy, a następnie odsłuchaj podgląd wbudowanym głosem przeglądarki. Otagowany skrypt poniżej jest gotowy do wklejenia w AnyVoice lub dowolnym silniku zgodnym z SSML.

Jak to działa

Jak działa formatter hiszpański text to speech

Fonetyka świadoma akcentu

Wybierz kastylijski hiszpański, meksykański, neutralny latynoamerykański lub rioplatański. Każdy mapuje się na tag BCP-47 (es-ES, es-MX, es-419, es-AR), więc podgląd w przeglądarce dobiera pasujący głos systemowy, jeśli jest zainstalowany.

Tagi pauz z interpunkcji

Przecinki, dwukropki i średniki dostają krótki tag pauzy; interpunkcja kończąca zdanie dostaje dłuższy. Czasy trwania zmieniają się wraz ze stylem pauzy: konwersacyjnym, dramatycznym lub szybkim dialogiem.

Szacowany czas trwania

Liczba słów podzielona przez 150 słów na minutę, skalowana suwakiem tempa, daje szacunek długości nagrania, zanim poświęcisz czas studia na nagrywanie. Aktualizuje się przy każdym naciśnięciu klawisza, więc możesz przycinać skrypt, aż zmieści się w 30-sekundowym spocie reklamowym lub 90-sekundowym wyjaśnieniu bez zgadywania.

Przewodnik po akcentach

Wybór właściwego akcentu regionalnego

Kastylijski (es-ES)

Rozróżnienie c/z i s. Domyślny dla korporacyjnego IVR i treści kierowanych do Hiszpanii.

Neutralny latynoamerykański (es-419)

Seseo, złagodzony rytm. Najbezpieczniejszy domyślny wybór dla audiobooków na cały region i modułów e-learningowych.

Rioplatański (es-AR)

Voseo i sheismo, dźwięk y/ll przesuwa się w stronę sh. Użyj go, gdy brief wprost wymaga argentyńskiego lub urugwajskiego narratora, albo gdy regionalna tożsamość NPC w grze jest częścią briefu postaci.

Od skryptu do podglądu w trzech krokach

  1. 1

    Wklej i otaguj

    Wrzuć swój hiszpański skrypt do pola. Interpunkcja automatycznie zamienia się w tagi pauzy; otocz słowo gwiazdkami lub wpisz je WIELKIMI LITERAMI, aby oznaczyć emfazę.

  2. 2

    Ustaw akcent i tempo

    Wybierz akcent regionalny i styl pauzy, a następnie dostosuj suwak tempa. Liczba słów i szacowany czas trwania aktualizują się przy każdej zmianie.

  3. 3

    Odsłuchaj lub eksportuj

    Odtwórz podgląd w przeglądarce, aby sprawdzić tempo, a potem skopiuj otagowany skrypt do AnyVoice lub wybranego silnika zgodnego z SSML. Uwaga z sesji: podgląd w przeglądarce korzysta z dowolnego głosu systemowego zainstalowanego u odwiedzającego, więc traktuj go jako sprawdzenie tempa, a nie referencję finalnego miksu.

Najczęstsze pytania

Czy to narzędzie generuje prawdziwe audio głosu AI?
Nie. Przycisk podglądu korzysta z wbudowanego w przeglądarkę API speechSynthesis oraz z dowolnego zainstalowanego hiszpańskiego głosu systemowego, a nie z klonowanego głosu. Po klonowany, kontrolowany emocjonalnie hiszpański głos, przepuść otagowany skrypt przez AnyVoice.
Dlaczego moja przeglądarka nie ma opcji głosu hiszpańskiego?
Dostępność głosów zależy od systemu operacyjnego, nie od tego narzędzia. Windows i macOS domyślnie mają przynajmniej jeden głos es-ES lub es-MX; niektóre wersje Chrome OS i Androida dodają go dopiero po zainstalowaniu hiszpańskiego pakietu językowego.
Czy mogę wkleić tagi pauzy i emfazy do ElevenLabs lub Amazon Polly?
Składnia tagów odzwierciedla elementy break time i emphasis ze standardu SSML, które akceptują Polly, Azure oraz zaawansowany pipeline AnyVoice. Niektóre silniki oczekują tagów opakowanych w pełną kopertę speak, więc sprawdź dokumentację swojego silnika przed produkcyjnym nagraniem.
Jak liczony jest szacowany czas trwania?
Liczba słów podzielona przez 150 słów na minutę, powszechny benchmark tempa dla neutralnej narracji lektorskiej, skalowana suwakiem tempa. To szacunek, a nie czas renderowania co do klatki.
Czy jest limit znaków?
Nie ma twardego limitu, ale speechSynthesis w przeglądarce zwykle zaczyna się krztusić powyżej około 30 000 znaków w jednej wypowiedzi, a niektóre silniki obcinają też długie pojedyncze SSML. Podziel długie rozdziały na sceny zarówno do podglądu, jak i do produkcji: liczba słów i szacowany czas odświeżają się natychmiast, więc łatwo dopasujesz rozmiar każdej sceny.
Czy to narzędzie zapisuje lub wysyła mój skrypt gdziekolwiek?
Nie. Wszystko działa w karcie Twojej przeglądarki. Nic nie jest przesyłane, logowane ani wysyłane na serwer, poza anonimowym sygnałem uruchomienia narzędzia, który nie niesie żadnej treści tekstu.
Którego akcentu użyć do IVR, a którego do narracji audiobooka?
IVR i korporacyjne infolinie w Hiszpanii domyślnie używają kastylijskiego; audiobooki i e-learning na cały region latynoamerykański stawiają na neutralny (es-419); lokalizacja gier osadzonych w Argentynie lub Urugwaju wymaga rioplatańskiego. Gdy projekt trafia od razu do całej Ameryki Łacińskiej, es-419 pozostaje najbezpieczniejszym jednym wyborem.

Gotowy na klonowany hiszpański głos zamiast podglądu w przeglądarce?

AnyVoice klonuje hiszpański głos z 30-sekundowej próbki i daje Ci 8 suwaków emocji w czasie rzeczywistym, więcej kontroli niż oferuje systemowy głos TTS.