インデックスへスキップ

Whisper

OpenAI

オープンソース音声生成 第 1 位

OpenAI のオープンソース音声認識モデル。多言語の文字起こし・翻訳・タイムスタンプをローカルで実行でき、市場の半数の転写ツールに内蔵されています。

プロダクトプレビュー

github.com
Whisper のプレビュー

詳細レビュー

Whisper が音声で果たした役割は、Stable Diffusion が画像で果たしたものです。OpenAI は 68 万時間の音声で頑健な多言語認識器を学習し、無償公開しました。明瞭な音声では有料 API に匹敵し、アクセントやノイズへの耐性は多くを上回ります。ローカル実行のため、機密の会議・医療メモ・個人的な日記の文字起こしは、マシンの外に出る必要がありません。

その子孫が業界を支えます。faster-whisper の再実装、distil-whisper 変種、MacWhisper のようなデスクトップアプリ、そして多くの商用メモツールの転写コア。弱点も率直です。長い無音で幻覚を起こし、話者分離は別ツールが要り、超長尺は分割が必要。何かに音声toテキストを足す開発者にとって、Whisper は既定の第一選択です。

長所 / 短所

長所

  • 最高水準の精度で API 費用ゼロ
  • 完全オフライン — 設計からプライベート
  • 翻訳込みで 99 言語
  • 巨大なラッパー/変種エコシステム

短所

  • 長い無音で幻覚テキスト
  • 話者分離は標準外
  • 大型モデルは実 GPU が要る

こんな人におすすめ

01

機密会議のプライベート文字起こし

02

字幕・キャプションパイプライン

03

アプリへの音声入力追加

04

音声システムの研究

総評

オープン音声toテキストの標準。あるツールの文字起こしが安くて正確なら、Whisper に感謝を。

主な機能

99 言語の文字起こし
英語への音声翻訳
単語レベルのタイムスタンプ
完全オフライン実行
tiny から large-v3 まで

タグ

音声認識オープンソースオフライン

Whisper と代替ツールの比較

よくある質問

Whisper とは?

Whisper は OpenAI が開発した音声生成ツールです。同社は 2022 年に設立され、本社はアメリカ・サンフランシスコにあります。OpenAI のオープンソース音声認識モデル。多言語の文字起こし・翻訳・タイムスタンプをローカルで実行でき、市場の半数の転写ツールに内蔵されています。

Whisper は無料ですか?

はい——Whisper は無料で利用できます。

Whisper はオープンソースですか?

はい——Whisper はオープンソースです。ソースコードは https://github.com/openai/whisper で公開されています。

Whisper のおすすめの代替ツールは?

注目の音声生成代替ツールには ElevenLabs、Suno、Udio などがあります。カテゴリーページで全 4 件のツールをご覧ください。

このページは役に立ちましたか?

公式サイトへソースを見る

基本情報

料金
無料
評価
4.7 (12,000 件のレビュー) 評価の説明
プラットフォーム
Self-hostedAPICLI
設立年
2022
本社
アメリカ・サンフランシスコ
最終検証日
2026-09-08