無料オンライン音声テキスト変換

AIによる文字起こしで音声をテキストに変換。音声ファイルをアップロード、マイクで録音、またはURLを貼り付け。100以上の言語、10以上のモデル、98%以上の精度。

公開されているオーディオとビデオで動作します。DRM 保護されたコンテンツはサポートされていません。

アップグレード
プライベート・トランスクリプト
転写付きチャット
プロでロック解除 →
ファイルをここにドラッグまたはクリックしてブラウズ
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — 最大2GB
アップグレード
プライベート・トランスクリプト
転写付きチャット
プロでロック解除 →
アップグレード
録音: 0:00
リアルタイム ワックス (瞬間)
強化 囁き (正確)
公開リンク:24時間、テキストのみ · 登録 7d+オーディオのための · プロ 私的なリンクを

リアルタイムの音声からテキストに変換。AI は話すときに自動的に訂正します。長い話をすると正確さが向上します。

まずマイクをテストしてください
❤️ STT.aiを愛しているなら 友達に伝えて!
あなたは無料の転写を使った

無料で登録して600分を得るか、月5ドルからアップグレードして、 さらに何千人もの人に話せるようになる。

10分フリー/日 600分無料 クレジットカードなし 暗号化
無料登録 →

1. 音声をアップロード

MP3、WAV、M4A、FLAC、OGGなど、あらゆる音声形式に対応。最大2GB。

2. AIが音声を処理

AIが音声から話者検出とタイムスタンプ付きで音声を抽出。

3. 文字起こしを取得

閲覧、編集、ダウンロード、共有。TXT、SRT、VTT、DOCX、PDFでエクスポート。

対応音声形式

音声テキスト変換モデル

ニーズに合ったAIモデルを選択 — または最適なモデルをお任せください。

音声テキスト変換の活用事例

音声をテキストに変換する準備はできましたか?

無料で始める →

よくある質問

音声ファイルをアップロードしたり URL を貼り付けたり、AI モデルを選択し、トランスクリプトをクリックします。STT.ai はタイムスタンプとスピーカーラベルを含む編集可能なテキストを返します。ほとんどのファイルは 5 分以内に完了します。

MP3, WAV, M4A, FLAC, OGG, AAC, AMR, その他10以上のフォーマットがサポートされています。フォーマット間の変換は必要ありません。レコーダーやアプリケーションが生成したものをアップロードします。

少し。WAVや FLACのような無損失フォーマットはビット完璧なオーディオを持ち、正確さはモデルとスピーカーの明瞭さに限られます。128 kbps 以上の損失フォーマット (MP3、M4A) は実質的に同じです。64 kbps 以下の非常に低いビットレートは数ポイントの損失をもたらします。

STT.aiは600分のフリープランです 登録なしで最初のファイルを 始めることができます 月額5ドルからの有料プランは より長いファイルを追加します プライベートの転写と優先処理

音声の清浄度を高めるために,音声の音声特性を考慮した音声特性評価を行った。

無料ユーザーはファイルごとに1時間まで転写できます。有料プランは8時間以上に拡張され、1回のパスでポッドキャスト、インタビュー、オーディオブックをカバーします。

はい。スピーカーダイアリズムは各声をラベル付けします。エディタで名前を変更できます。サポートされているすべてのオーディオフォーマットとモデルで動作します。

TXT、DOCX、PDF、JSON、SRT/VTT 字幕にエクスポートします。JSON は機械読み取れるタイムスタンプとスピーカーラベルを保持します。DOCX と PDF は共有とアーカイブに最適です。

はい。自動検出の100以上の言語、さらに手動で言語を設定するオプションがあります。混合言語のオーディオはファイルの中央で切り替えて扱い、結果を後で翻訳できます。

はい。オーディオは標準で処理され削除されます。プロプランではクライアント側暗号化を追加します。鍵なしでは転写は読み取れません。明示的なオプションなしでは訓練には使用されません。

はい。サポートされている1,300以上のプラットフォームのいずれかからリンクを貼り付けると、STT.aiはオーディオを直接取得します。DRM保護されたソースは転写できません。

REST API は Python と Node.js SDK を使って音声ファイルを直接受け入れ、 100 分/月のフリータイムを提供します。フリータイムを超えると秒単位で料金が課されます。