인덱스로 건너뛰기

GLOSSARY

음성 합성(TTS)

텍스트를 자연스러운 음성으로 바꾸는 기술. 음성 AI의 출력 절반으로, 많은 언어에서 사람 내레이션과 구별이 되지 않습니다.

현대 TTS 모델은 사실적인 운율·감정·웃음까지 담아 텍스트에서 직접 음성을 만듭니다 — 10년 전 로봇 목소리의 세대 교체입니다. 카탈로그의 음성 도구는 셋으로 나뉩니다. 범용 내레이터(Murf, PlayHT, WellSaid, 교육·영상용), 표현형(ElevenLabs, 오디오북·게임용), 전용형(목소리 변환, 더빙, 실시간 체인저).

실제로 중요한 선택 기준: 보이스 라이브러리 폭과 라이선스, 인터랙티브 용도의 지연, 세밀한 제어(멈춤·강세·발음), 상업 이용 조항. 내레이션의 불편한 골짜기는 사실상 닫혔습니다 — 그래서 공개 의무와 음성 소유자 동의가 업계의 현재 쟁점입니다.

관련 용어

이 기술을 사용하는 도구

관련 카테고리