GLOSSARY
음성 합성(TTS)
텍스트를 자연스러운 음성으로 바꾸는 기술. 음성 AI의 출력 절반으로, 많은 언어에서 사람 내레이션과 구별이 되지 않습니다.
현대 TTS 모델은 사실적인 운율·감정·웃음까지 담아 텍스트에서 직접 음성을 만듭니다 — 10년 전 로봇 목소리의 세대 교체입니다. 카탈로그의 음성 도구는 셋으로 나뉩니다. 범용 내레이터(Murf, PlayHT, WellSaid, 교육·영상용), 표현형(ElevenLabs, 오디오북·게임용), 전용형(목소리 변환, 더빙, 실시간 체인저).
실제로 중요한 선택 기준: 보이스 라이브러리 폭과 라이선스, 인터랙티브 용도의 지연, 세밀한 제어(멈춤·강세·발음), 상업 이용 조항. 내레이션의 불편한 골짜기는 사실상 닫혔습니다 — 그래서 공개 의무와 음성 소유자 동의가 업계의 현재 쟁점입니다.