エクスポート形式

必要な形式で文字起こしをダウンロード。STT.aiは6つのエクスポート形式をサポートし、それぞれ異なるワークフローに最適化されています。

公開されているオーディオとビデオで動作します。DRM 保護されたコンテンツはサポートされていません。

アップグレード
プライベート・トランスクリプト
転写付きチャット
プロでロック解除 →
ファイルをここにドラッグまたはクリックしてブラウズ
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — 最大2GB
アップグレード
プライベート・トランスクリプト
転写付きチャット
プロでロック解除 →
アップグレード
録音: 0:00
リアルタイム ワックス (瞬間)
強化 囁き (正確)
公開リンク:24時間、テキストのみ · 登録 7d+オーディオのための · プロ 私的なリンクを

リアルタイムの音声からテキストに変換。AI は話すときに自動的に訂正します。長い話をすると正確さが向上します。

まずマイクをテストしてください
❤️ STT.aiを愛しているなら 友達に伝えて!
あなたは無料の転写を使った

無料で登録して600分を得るか、月5ドルからアップグレードして、 さらに何千人もの人に話せるようになる。

10分フリー/日 600分無料 クレジットカードなし 暗号化
無料登録 →

対応エクスポート形式

音声・動画の文字起こし後、以下の形式でダウンロードできます。すべての形式に完全なテキストが含まれ、タイムド形式にはタイムスタンプが含まれます。

TXT(プレーンテキスト)

.txt

フォーマットなしのシンプルなプレーンテキスト文字起こし。文書、メール、他のアプリケーションへのコピーに最適。話者検出有効時は話者ラベルを含みます。

Free plan

SRT(SubRip字幕)

.srt

最も広くサポートされている字幕形式。連番、タイムスタンプ、テキストを含みます。YouTube、Vimeo、VLC、Premiere Pro、Final Cutなど、ほぼすべてのビデオプレーヤーに対応。

Free plan

VTT(WebVTT)

.vtt

Web Video Text Tracks形式、HTML5ビデオキャプションの標準。スタイリング、ポジショニング、メタデータをサポート。

Basic plan+

DOCX(Word文書)

.docx

見出し、タイムスタンプ、話者ラベル付きのフォーマットされたWord文書。議事録、レポート、Microsoft WordやGoogle Docsでの編集に最適。

Basic plan+

JSON(構造化データ)

.json

単語レベルのタイムスタンプ、信頼度スコア、話者ID、セグメントデータを含む機械可読構造化形式。開発者に最適。

Basic plan+

PDF(ポータブル文書)

.pdf

タイムスタンプ、話者ラベル、STT.aiブランディング付きのプロフェッショナルなPDF。共有、アーカイブ、印刷に最適。

Basic plan+

形式の比較

特徴 TXT SRT VTT DOCX JSON PDF
Plain text
Timestamps
Speaker labels
Word-level timing
Confidence scores
Video player compatible
Editable
Machine-readable

どの形式を選ぶべき?

字幕用

Use SRT for maximum compatibility or VTT for web-based video players. SRT works with YouTube, Vimeo, Premiere Pro, Final Cut, and DaVinci Resolve.

文書とレポート用

Use DOCX for editable documents or PDF for sharing and archiving. Both include formatted timestamps and speaker labels.

開発者と統合用

Use JSON for the richest data including word-level timestamps, confidence scores, and speaker IDs. Ideal for building custom applications.

クイックコピペ用

Use TXT for a simple plain text transcript you can paste anywhere -- emails, notes, chat, or any text field.

一括エクスポート

Need to export multiple transcripts at once? STT.ai supports batch export from your transcript library. Select multiple transcripts, choose your format, and download them all in a single ZIP file. Available on all paid plans.

APIエクスポート

Developers can retrieve transcripts in any format via the STT.ai API. Simply specify the desired format in your API request and receive the formatted output directly. The JSON format includes the most detailed data including word-level timestamps and confidence scores.

文字起こしして任意の形式でエクスポート

音声・動画をアップロード。形式を選択。即座にダウンロード。

無料で文字起こしを開始

よくある質問

出力フォーマット はブラウザで実行されます。URLを貼り付け、ファイルをアップロード、またはマイクから録音します。STT.ai は AI モデルを選択し、5 分以内に転写を返します。 TXT、SRT、VTT、DOCX、JSON、PDF としてエクスポートします。

はい - 訪問者はSTT.aiで開始するために600分のフリーミニットを得ます。 出力フォーマット は他のワークフローと同じように使用できます。有料プランは月額5ドルから始まり、長いファイル、プライベートトランスクリプト、優先キューをロックします。

出力フォーマット は STT.ai の他の部分と同じ AI モデルで動作します。我々の最良のモデルは清潔な音声の 95-97% の正確さに達します。最初のパスが目標より低い場合は、モデルをフライで切り替えます。

出力フォーマットはSTT.aiの10以上のモデルで動作します。STT.ai Enhanced (最も正確)、Whisper Large V3 (99言語)、NVIDIA Canary (#1 WER on supported langs)、Whisper Turbo (fast)、Moonshine (lightweight)、その他。

はい。すべての字幕は SRT または VTT としてエクスポートされます。YouTube、Vimeo、TikTok、VLC、その他の主要なビデオプレーヤーで動作します。Burn-Subtitles ツールはこれらをビデオにハードサブとしてオーバーレイします。

はい。スピーカーダイアリズムは自動的に各音声にラベルを付けます (スピーカー 1, スピーカー 2, など)。内蔵エディタで名前を変更できます。すべてのモデルと言語で動作します。

出力フォーマット ジョブのほとんどは 5 分以内に完了します。1 時間のオーディオファイルは、最も速いモデルでは 2-3 分で完了します。速度は選択したモデルと現在の GPU 負荷に依存します。

出力フォーマット は MP3、WAV、M4A、FLAC、OGG、MP4、MKV、MOV、WebM、AVI などの 20 以上のフォーマットをサポートします。出力は TXT、SRT、VTT、DOCX、JSON、または PDF です。

はい。出力フォーマットに送信されたオーディオファイルは、標準で処理され削除されます。プロプランはクライアント側暗号化を追加します。STT.aiのデータベースが破壊されたとしても、鍵なしで転写は読み取れません。データは明示的なオプションなしにモデルの訓練に使用されません。

STT.aiはPythonとNode.js SDKを使ったREST APIを提供し、ClaudeとCursorのためのMCPサーバを提供します。これらはすべて出力フォーマットワークフローに使用できます。無料APIの階層には月間100分が含まれます。

はい。すべてのトランスポートは内蔵されたエディタで開きます。そこで言葉を訂正し、話者の名前を変更し、タイムスタンプを調整し、ノートを追加できます。すべての変更は自動的に保存されます。

すべての転写は共有可能なユニークな URL を持ちます。メールのために DOCX または PDF にエクスポートします。プロプランはパスワード保護された永続リンクを追加します。クライアントの作業に役立ちます。

STT.aiはYouTube、Vimeo、TikTok、SoundCloud、Zoom、Google Meet、ポッドキャストホストなど1,300以上のプラットフォームを扱う。URL転写は公開可能なコンテンツのみで動作します。DRM保護されたソースは転写できません。