요약
이 로봇 음성 생성기는 텍스트를 입력하고 5가지 프리셋으로 미리보기할 수 있습니다: Vocoder Bot, Monotone Synth, Glitch Stutter, 8-bit Quantize, Deep Drone. 각 프리셋은 TTS 엔진이나 보코더 체인에 입력할 고정 음성 높낮이와 포먼트 수치를 갖고 있으며, 강도 슬라이더는 일시정지 밀도와 Glitch Stutter의 음절 반복 빈도만 조절합니다. 게임 오디오 개발자가 NPC 대사 100개를 블록하거나 오디오북 제작자가 기계음 캐릭터 읽기를 전체 렌더링 전에 확인할 때 용이하며, 오디오 파일 생성 없음, 외부 API 호출 없음, 오직 태그된 스크립트만 제공합니다.
로봇 음성 생성기: 5가지 기계음 전달 스타일 미리보기
텍스트를 입력하고 프리셋을 선택한 후, 음성 높낮이, 포먼트, 속도 수치가 포함된 일시정지 태그 스크립트를 얻으세요. 읽기를 확인하기 위해 오디오 렌더링이 필요 없습니다.
각 프리셋이 실제로 변경하는 것
프리셋당 고정 음향 특성
각 프리셋은 자체의 음성 높낮이 이동과 포먼트 이동을 갖습니다. Vocoder Bot은 +2 반음과 30% 포먼트 감소로, Deep Drone은 -8 반음과 10% 포먼트 증가로 실행됩니다. 이것이 보코더 플러그인이나 TTS 엔진에 입력할 시작 수치입니다.
강도는 일시정지 밀도만 조절합니다
슬라이더는 일시정지 태그가 몇 단어마다 표시되는지를 변경하며, 100%에서는 2단어마다, 0%에서는 프리셋의 기본 간격으로 조절됩니다. Glitch Stutter에서는 음절 반복 빈도도 높입니다. 음성 높낮이나 포먼트 수치는 절대 변하지 않아서 음향 정체성이 예측 가능합니다.
출력은 렌더링이 아닌 스크립트입니다
[pause 120ms]와 같은 태그된 스크립트를 받으며, 이것이 SSML break 태그로 변환하거나 음성 세션 중에 읽을 수 있는 마커 형식입니다. 오디오는 생성되지 않으며 익명의 실행 카운터 외에는 브라우저를 벗어나지 않습니다.
세션에서 나온 질문들
[pause Xms] 태그가 TTS 엔진이 예상하는 SSML <break> 문법과 일치합니까?
Glitch Stutter가 'the'나 'and' 같은 짧은 단어를 왜 건너뜁니까?
300개의 NPC 라인을 한 번에 이 도구로 처리할 수 있습니까?
강도 슬라이더를 움직이면 음성 높낮이나 포먼트 이동이 변합니까?
예상 속도를 위한 150 wpm 기본값이 어디서 나왔습니까?
실제로 여기서 오디오가 생성됩니까?
어느 프리셋이 PA 공지보다는 거대한 산업 장비처럼 들립니까?
도구가 스크립트 텍스트를 어디든 저장하거나 보냅니까?
일회용 라인 이상을 구축합니까?
AnyVoice의 음성 클론 도구는 전체 NPC 대사 배치, 다중 장 오디오북 나레이션, 5가지 기계음 프리셋을 넘어선 감정 제어 전달을 다룹니다.