오디오 생성
AI 음성 합성 및 음악 생성 도구
ElevenLabs
ElevenLabs
다양한 언어와 감정 표현을 지원하는 최첨단 AI 음성 합성 및 음성 복제 기술입니다.
Suno
Suno
텍스트 설명으로 완성된 곡을 만들어 주는 AI 음악 생성 도구입니다.
Udio
Udio
고품질 음악 제작으로 잘 알려진 AI 음악 생성 플랫폼입니다.
Descript
Descript
녹음과 영상을 문서처럼 편집하는 AI 오디오·비디오 에디터입니다. 단어를 지우면 해당 장면이 잘리고, 복제된 목소리로 수정이 가능하며, 스튜디오급 노이즈 제거도 자동입니다.
Murf AI
Murf
전문 내레이션을 위한 AI 보이스오버 스튜디오로, 20개 이상 언어의 120+ 사실적인 음성, 슬라이드·비디오 타이밍 동기화, 팀 워크스페이스와 API를 제공합니다.
PlayHT
PlayHT
초사실적인 음성, 보이스 클로닝, 실시간 음성 생성용 개발자 API를 갖춘 TTS 플랫폼.
Speechify
Speechify
문서·기사·웹페이지를 자연스러운 오디오로 바꾸는 읽기 도구로, 접근성과 속독에 인기가 있습니다.
AIVA
AIVA
수십 가지 스타일의 오리지널 배경 음악을 만드는 AI 작곡가로, 트랙 편집과 상업용 라이선스를 지원합니다.
Soundraw
Soundraw
무드·장르·길이별로 커스터마이즈 가능한 로열티 프리 음악을 생성하며, 영상과 팟캐스트용 라이선스를 제공합니다.
Boomy
Boomy
몇 초 만에 완성된 곡을 만들고 스트리밍 플랫폼 배포와 로열티 공유까지 지원하는 AI 음악 크리에이터.
Beatoven.ai
Beatoven
영상·팟캐스트 크리에이터를 위한 AI 사운드트랙 생성기로, 장면별로 무드에 맞는 로열티 프리 배경음악을 작곡합니다.
Podcastle
Podcastle
AI 기반 팟캐스트 스튜디오로, 스튜디오 품질 음성 강화·텍스트 기반 편집·원격 인터뷰·AI 음성을 한 곳에서 제공합니다.
Resemble AI
Resemble
게임·영화·앱을 위한 엔터프라이즈 보이스 클로닝 플랫폼으로, 감정 제어·실시간 음성 API·딥페이크 탐지 도구를 갖춥니다.
Listnr
Listnr
900개 이상 음성, 팟캐스트 호스팅, 블로그 임베드 플레이어를 갖춘 TTS·내레이션 플랫폼.
WellSaid Labs
WellSaid Labs
기업 교육, 광고, 제품을 위한 방송 품질 AI 음성을 제공하는 엔터프라이즈 TTS 플랫폼으로, 동의 기반 음성 모델을 중시합니다.
Krisp
Krisp
통화·녹음을 위한 AI 노이즈 캔슬레이션 계층으로, 배경 소리·잡음을 실시간 제거하고 에코 제거·억양 완화도 지원합니다.
Voicemod
Voicemod
게임·스트리밍용 실시간 AI 보이스체인저로, 수백 가지 음성 이펙트·사운드보드·텍스트 to 노래 생성을 갖췄습니다.
VoiceMaker
VoiceMaker
수백 가지 음성과 신경망 이펙트로 기사·스크립트를 다운로드 가능한 오디오로 변환하는 TTS 플랫폼.
Cleanvoice AI
Cleanvoice
팟캐스트용 AI 오디오 클리너로, 필러·입 소리·무음·더듬기를 자동으로 제거합니다.
Dubverse
Dubverse
수십 개의 인도 및 글로벌 언어로 영상 더빙을 제공하는 AI 플랫폼으로, 자막 생성도 포함됩니다.
ElevenLabs v3
ElevenLabs
최신 ElevenLabs 모델로, audio tag로 감정 — 웃음·속삭임·멈춤 — 을 제어하고 70+ 언어와 대화 생성을 한 번에 지원합니다.
ElevenLabs Music
ElevenLabs
ElevenLabs의 AI 음악 기능입니다. 텍스트 프롬프트에서 스타일·가사·구조를 제어하며 스튜디오 품질의 곡을 생성합니다.
Sonauto
Sonauto
프롬프트와 가사로 보컬이 포함된 완성곡을 만드는 AI 음악 생성 플랫폼으로, 품질과 창작 제어에서 경쟁합니다.
Kits
Kits AI
아티스트를 위한 AI 음악 툴킷. 커스텀 보이스 모델을 학습하고, AI 보컬·화음을 생성하며, 스템을 악기 연주로 변환하고, 브라우저에서 마스터링까지 합니다.
Stable Audio
Stability AI
Stability AI의 음악·효과음 생성기. 텍스트로 풀트랙까지 생성하고, 유료 등급은 상업 라이선스를 제공하며, 게임·앱 통합용 API도 있습니다.
Whisper
OpenAI
OpenAI의 오픈소스 음성 인식 모델. 다국어 전사·번역·타임스탬프를 로컬에서 실행하며, 시장 전사 도구 절반의 숨은 엔진입니다.
Cartesia
Cartesia
실시간 음성 AI 인프라. Sonic TTS 패밀리는 최단 약 40ms에 자연스러운 음성을 생성 — 전화와 라이브 에이전트에 충분한 속도 — 를 비롯해 보이스 체인지·클로닝 API도 제공합니다.
Moises
Moises (Music.ai)
음악가의 연습 AI. 어떤 곡이든 보컬·드럼·베이스 스템으로 분리하고, 흔적 없이 피치·템포를 바꾸고, 코드를 감지해 연습합니다 — 수백만 플레이어·프로듀서가 사용 중입니다.
Riverside
Riverside
원격 녹음 스튜디오. 팟캐스트·인터뷰의 무손실 로컬 오디오와 4K 영상을 캡처하고, AI Magic Clips가 세션을 소셜용 쇼츠와 쇼 노트로 바꿉니다.
AssemblyAI
AssemblyAI
API 형태의 스피치 AI 플랫폼. 프로덕션급 전사에 더해 화자 라벨·감성·주제 감지·요약 등 오디오 인텔리전스를 제공해 콜센터와 미디어 파이프라인을 떠받칩니다.
Deepgram
Deepgram
속도와 규모를 위해 만든 음성to텍스트·보이스 에이전트 API. 엔드투엔드 딥러닝 모델이 실시간 전사를 하고 비용은 기존의 일부 — 콜센터와 실시간 음성 앱을 떠받칩니다.