無料オンライン音声テキスト変換
AIによる文字起こしで音声をテキストに変換。音声ファイルをアップロード、マイクで録音、またはURLを貼り付け。100以上の言語、10以上のモデル、98%以上の精度。
1. 音声をアップロード
MP3、WAV、M4A、FLAC、OGGなど、あらゆる音声形式に対応。最大2GB。
2. AIが音声を処理
AIが音声から話者検出とタイムスタンプ付きで音声を抽出。
3. 文字起こしを取得
閲覧、編集、ダウンロード、共有。TXT、SRT、VTT、DOCX、PDFでエクスポート。
音声テキスト変換モデル
ニーズに合ったAIモデルを選択 — または最適なモデルをお任せください。
100以上の言語で音声を文字起こし
音声をテキストに変換する準備はできましたか?
無料で始める →よくある質問
音声ファイルをアップロードしたり URL を貼り付けたり、AI モデルを選択し、トランスクリプトをクリックします。STT.ai はタイムスタンプとスピーカーラベルを含む編集可能なテキストを返します。ほとんどのファイルは 5 分以内に完了します。
MP3, WAV, M4A, FLAC, OGG, AAC, AMR, その他10以上のフォーマットがサポートされています。フォーマット間の変換は必要ありません。レコーダーやアプリケーションが生成したものをアップロードします。
少し。WAVや FLACのような無損失フォーマットはビット完璧なオーディオを持ち、正確さはモデルとスピーカーの明瞭さに限られます。128 kbps 以上の損失フォーマット (MP3、M4A) は実質的に同じです。64 kbps 以下の非常に低いビットレートは数ポイントの損失をもたらします。
STT.aiは600分のフリープランです 登録なしで最初のファイルを 始めることができます 月額5ドルからの有料プランは より長いファイルを追加します プライベートの転写と優先処理
音声の清浄度を高めるために,音声の音声特性を考慮した音声特性評価を行った。
無料ユーザーはファイルごとに1時間まで転写できます。有料プランは8時間以上に拡張され、1回のパスでポッドキャスト、インタビュー、オーディオブックをカバーします。
はい。スピーカーダイアリズムは各声をラベル付けします。エディタで名前を変更できます。サポートされているすべてのオーディオフォーマットとモデルで動作します。
TXT、DOCX、PDF、JSON、SRT/VTT 字幕にエクスポートします。JSON は機械読み取れるタイムスタンプとスピーカーラベルを保持します。DOCX と PDF は共有とアーカイブに最適です。
はい。自動検出の100以上の言語、さらに手動で言語を設定するオプションがあります。混合言語のオーディオはファイルの中央で切り替えて扱い、結果を後で翻訳できます。
はい。オーディオは標準で処理され削除されます。プロプランではクライアント側暗号化を追加します。鍵なしでは転写は読み取れません。明示的なオプションなしでは訓練には使用されません。
はい。サポートされている1,300以上のプラットフォームのいずれかからリンクを貼り付けると、STT.aiはオーディオを直接取得します。DRM保護されたソースは転写できません。
REST API は Python と Node.js SDK を使って音声ファイルを直接受け入れ、 100 分/月のフリータイムを提供します。フリータイムを超えると秒単位で料金が課されます。