音声生成
AI音声合成・音楽生成ツール
ElevenLabs
ElevenLabs
最先端のAI音声合成と音声クローン技術。多言語と感情表現に対応します。
Suno
Suno
テキストの説明から完全な楽曲を生成するAI音楽生成ツール。
Udio
Udio
高品質な音楽制作で知られるAI音楽生成プラットフォーム。
Descript
Descript
録音や映像をドキュメントのように編集できる AI 音声・動画エディタ。単語を削除すればその部分の映像が切り取られ、声のクローンで差し替えや訂正が可能で、スタジオ品質のノイズ除去も自動です。
Murf AI
Murf
プロフェッショナル・ナレーション向けの AI 吹き替えスタジオ。20 以上の言語で 120+ のリアルな音声を備え、スライドや動画とのタイミング同期、チームワークスペース、API を提供します。
PlayHT
PlayHT
超リアルな音声、ボイスクローン、リアルタイム音声生成の開発者 API を備えるテキスト読み上げプラットフォーム。
Speechify
Speechify
ドキュメント・記事・ウェブページを自然な音声に変える読み上げツール。アクセシビリティや速聴に人気です。
AIVA
AIVA
数十のスタイルでオリジナルの伴奏音楽を作る AI 作曲家。トラック編集と商用ライセンスに対応します。
Soundraw
Soundraw
ムード・ジャンル・長さからカスタマイズ可能なロイヤリティフリー音楽を生成し、動画やポッドキャストにライセンス提供します。
Boomy
Boomy
数秒で完全な楽曲を生成する AI 音楽クリエイター。ストリーミング配信とロイヤルティ分配にも対応します。
Beatoven.ai
Beatoven
動画・ポッドキャスト制作者向けの AI サウンドトラック生成器。シーンごとにムードに合うロイヤリティフリー BGM を作曲します。
Podcastle
Podcastle
AI 搭載のポッドキャストスタジオ。スタジオ品質の音声強化、テキストベースの編集、リモート取材、AI ボイスを一つのワークスペースで。
Resemble AI
Resemble
ゲーム・映画・アプリ向けのエンタープライズ ボイスクローン基盤。感情制御、リアルタイム音声 API、ディープフェイク検出ツールを備えます。
Listnr
Listnr
900 以上のボイス、ポッドキャストホスティング、ブログ埋め込みプレーヤーを備える TTS・ナレーション基盤。
WellSaid Labs
WellSaid Labs
企業研修・広告・製品向けの放送品質 AI 音声を提供するエンタープライズ TTS プラットフォーム。同意ベースの音声モデルを重視します。
Krisp
Krisp
通話や録音のための AI ノイズキャンセレーション層。背景の声やノイズをリアルタイムで除去し、エコー除去やアクセントの滑らかな調整にも対応します。
Voicemod
Voicemod
ゲームや配信向けのリアルタイム AI ボイスチェンジャー。数百のボイスエフェクト、サウンドボード、テキストtoソングを備えます。
VoiceMaker
VoiceMaker
記事やスクリプトをダウンロード可能な音声に変換する、数百のボイスとニューラルエフェクトを備える TTS プラットフォーム。
Cleanvoice AI
Cleanvoice
ポッドキャスト向けの AI 音声クリーナー。フィラー・口noise・無音・吃音を自動で除去します。
Dubverse
Dubverse
インドおよびグローバルの数十言語で動画の吹き替えを行う AI 基盤。字幕生成も付属します。
ElevenLabs v3
ElevenLabs
最新 ElevenLabs モデル。audio tags で感情—笑い・ささやき・ポーズ — を制御し、70+ 言語とダイアログを一括生成できます。
ElevenLabs Music
ElevenLabs
ElevenLabs の AI 音楽機能。テキストプロンプトからスタイル・歌詞・構成を制御しながらスタジオ品質の楽曲を生成します。
Sonauto
Sonauto
プロンプトと歌詞からボーカル付きのフル楽曲を作る AI 音楽生成基盤。品質と創作コントロールで競います。
Kits
Kits AI
アーティスト向け AI 音楽ツールキット。独自のボイスモデルを学習し、AI ボーカルやハーモニーを生成、ステムを楽器演奏に変換、ブラウザでマスタリングまで行えます。
Stable Audio
Stability AI
Stability AI の音楽・効果音ジェネレーター。テキストからフルトラックまで生成し、有料プランは商用ライセンス、ゲームやアプリ統合向け API も提供します。
Whisper
OpenAI
OpenAI のオープンソース音声認識モデル。多言語の文字起こし・翻訳・タイムスタンプをローカルで実行でき、市場の半数の転写ツールに内蔵されています。
Cartesia
Cartesia
リアルタイム音声 AI インフラ。Sonic TTS ファミリーは最短約 40ms で自然な音声を生成 — 電話やライブエージェントに足る速さ — に加え、声変換・クローン API も提供します。
Moises
Moises (Music.ai)
ミュージシャンの練習 AI。どんな曲もボーカル・ドラム・ベースのステムに分解し、劣化なくピッチとテンポを変え、コードを検出して練習に使えます — 数百万のプレーヤーとプロデューサーが利用中です。
Riverside
Riverside
リモート録音スタジオ。ポッドキャストやインタビューのロスレスローカル音声と 4K 動画を記録し、AI Magic Clips がセッションを SNS 向け shorts とショーノートに変えます。
AssemblyAI
AssemblyAI
API としてのスピーチ AI プラットフォーム。本番級の文字起こしに加え、話者ラベル・センチメント・トピック検出・要約といった音声インテリジェンスを提供し、コールセンターやメディアパイプラインを支えます。
Deepgram
Deepgram
速度と規模のために作られた音声toテキストとボイスエージェント API。エンドツーエンドの深層学習モデルがリアルタイムで文字起こしし、従来の数分の一のコストで — コールセンターとライブ音声アプリを支えます。