요약

이 무료 스페인어 텍스트 음성 변환 도구는 평범한 스크립트를 AnyVoice 같은 음성 엔진에 바로 쓸 수 있는 휴지·강조 태그 버전으로 바꿔줍니다. 카스티야, 멕시코, 중립적 라틴아메리카, 리오플라텐세 중 지역 억양을 고르고 휴지 스타일을 설정한 뒤, 브라우저에 내장된 스페인어 음성으로 결과를 미리 들어보세요: 업로드도, 계정 가입도, 서버 왕복도 필요 없습니다. 이 포맷터는 분당 150단어 기준값에 속도 슬라이더를 곱해 예상 낭독 시간을 계산하고, 긴 휴지·짧은 휴지·강조 단어에 태그를 붙여 SSML을 인식하는 제작 파이프라인에 스크립트를 곧바로 넣을 수 있게 합니다.

스페인어 텍스트 음성 변환 스크립트를 지역 억양 태그로 포맷팅

스크립트를 붙여넣고 카스티야, 멕시코, 중립적 라틴아메리카, 리오플라텐세 스페인어 중에서 선택하면 휴지와 강조 태그가 붙은 스크립트와 무료 브라우저 미리듣기를 받을 수 있습니다. 유료 음성 엔진을 쓰기 전에 먼저 확인해보세요.

스페인어 TTS 스크립트 포맷터 & 음성 미리듣기

스페인어 스크립트를 붙여넣고 지역 억양과 휴지 스타일을 선택한 뒤, 브라우저 내장 음성으로 미리 들어보세요. 아래 태그된 스크립트는 AnyVoice나 SSML을 지원하는 엔진에 바로 붙여넣을 수 있습니다.

작동 방식

스페인어 TTS 포맷터의 작동 방식

억양별 발음 매핑

카스티야(스페인), 멕시코, 중립적 라틴아메리카, 리오플라텐세(아르헨티나) 중에서 선택하세요. 각 억양은 BCP-47 태그(es-ES, es-MX, es-419, es-AR)에 매핑되어, 브라우저에 해당 시스템 음성이 설치되어 있으면 미리듣기가 그 음성을 사용합니다.

문장 부호 기반 휴지 태그

쉼표, 콜론, 세미콜론에는 짧은 휴지 태그가, 문장을 끝내는 부호에는 더 긴 휴지 태그가 붙습니다. 휴지 스타일(일상 대화체, 드라마틱, 빠른 대사)에 따라 길이가 달라집니다.

예상 소요 시간

분당 150단어 기준값에 재생 속도 슬라이더 값을 곱해 예상 낭독 시간을 계산합니다. 녹음에 스튜디오 시간을 쓰기 전에 미리 확인할 수 있고, 키 입력마다 즉시 갱신되어 30초 광고나 90초 설명 영상 분량에 맞춰 스크립트를 다듬을 수 있습니다.

억양 가이드

알맞은 지역 억양 고르기

카스티야어 (es-ES)

c/z와 s를 구분하는 distinción 발음이 특징입니다. 스페인 대상 기업용 IVR과 콘텐츠의 기본값입니다.

중립적 라틴아메리카 (es-419)

세세오(seseo) 발음과 부드러운 리듬이 특징입니다. 범라틴아메리카 오디오북과 이러닝 모듈에 가장 무난한 기본 선택지입니다.

리오플라텐세 (es-AR)

보세오(voseo)와 셰이스모(sheísmo)가 특징이며, y/ll 발음이 sh 쪽으로 이동합니다. 브리프에서 아르헨티나나 우루과이 내레이터를 구체적으로 요구하거나, 게임 NPC의 지역색이 캐릭터 설정의 일부일 때 사용하세요.

스크립트에서 미리듣기까지, 세 단계로

  1. 1

    붙여넣고 태그 달기

    스페인어 스크립트를 입력창에 넣으세요. 문장 부호는 자동으로 휴지 태그가 되고, 단어를 별표(*)로 감싸거나 대문자로 입력하면 강조 표시가 됩니다.

  2. 2

    억양과 속도 설정

    지역 억양과 휴지 스타일을 고른 뒤 재생 속도 슬라이더를 조정하세요. 값을 바꿀 때마다 단어 수와 예상 소요 시간이 갱신됩니다.

  3. 3

    미리듣기 또는 내보내기

    브라우저 미리듣기로 속도감을 점검한 다음, 태그가 달린 스크립트를 AnyVoice나 SSML을 지원하는 엔진에 붙여넣으세요. 세션 노트: 브라우저 미리듣기는 방문자 OS에 설치된 시스템 음성을 그대로 사용하므로, 최종 믹스 기준이 아니라 속도감 점검용으로만 참고하세요.

자주 묻는 질문

이 도구가 실제 AI 음성 오디오를 생성하나요?
아니요. 미리듣기 버튼은 클론 음성이 아니라 브라우저에 내장된 speechSynthesis API와 설치된 스페인어 시스템 음성을 사용합니다. 감정 제어가 가능한 클론 스페인어 음성이 필요하다면, 태그된 스크립트를 AnyVoice에 넣어 실행하세요.
왜 브라우저에 스페인어 음성 옵션이 없나요?
음성 제공 여부는 이 도구가 아니라 운영체제에 달려 있습니다. Windows와 macOS는 기본적으로 es-ES 또는 es-MX 음성을 하나 이상 내장하지만, 일부 Chrome OS와 Android 기기는 스페인어 언어팩을 설치해야만 음성이 추가됩니다.
휴지와 강조 태그를 ElevenLabs나 Amazon Polly에 붙여넣을 수 있나요?
태그 문법은 SSML의 break time과 emphasis 요소를 본뜬 것으로, Polly, Azure, AnyVoice의 고급 파이프라인에서 모두 인식합니다. 일부 엔진은 태그를 speak 태그로 감싸야 인식하므로, 실제 제작 전에 사용 중인 엔진의 문서를 확인하세요.
예상 소요 시간은 어떻게 계산되나요?
단어 수를 분당 150단어(중립적인 내레이션의 일반적인 성우 작업 기준값)로 나눈 뒤, 재생 속도 슬라이더 값을 곱합니다. 이는 어디까지나 추정치이며 프레임 단위로 정확한 녹음 시간은 아닙니다.
글자 수 제한이 있나요?
강제되는 상한은 없지만, 브라우저 speechSynthesis는 한 번의 발화가 약 30,000자를 넘으면 버벅이는 경향이 있고, 일부 엔진도 하나의 긴 SSML 발화를 잘라버립니다. 긴 챕터는 미리듣기와 실제 제작 파이프라인 모두를 위해 장면 단위로 나누세요. 단어 수와 예상 소요 시간이 즉시 갱신되므로 장면별 분량을 가늠하기 쉽습니다.
이 도구가 스크립트를 어딘가에 저장하거나 전송하나요?
아니요. 모든 처리가 브라우저 탭 안에서만 이루어집니다. 텍스트 내용이 담기지 않는 익명 도구 실행 신호(beacon) 외에는, 어떤 내용도 업로드되거나 기록되거나 서버로 전송되지 않습니다.
IVR과 오디오북 내레이션 중 어떤 억양을 써야 하나요?
스페인의 IVR과 기업 전화 응대는 카스티야어가 기본입니다. 범라틴아메리카용 오디오북과 이러닝은 중립적 라틴아메리카(es-419) 쪽이 유리하고, 아르헨티나나 우루과이를 배경으로 한 게임 로컬라이제이션이라면 리오플라텐세가 맞습니다. 프로젝트가 라틴아메리카 전역에 한 번에 출시된다면 es-419가 가장 안전한 단일 트랙 선택지입니다.

브라우저 미리듣기 대신 클론된 스페인어 음성이 필요하신가요?

AnyVoice는 30초 샘플만으로 스페인어 음성을 클론하고, 실시간으로 조절되는 8개의 감정 슬라이더를 제공합니다. 시스템 TTS 음성보다 훨씬 세밀한 제어가 가능합니다.