Dictation
文書、メール、メモのための音声からテキストへのディクテーション。自然に話し、残りはAIに任せてください。
なぜSTT.aiを使うのか Dictation
人工知能を使ったプロフェッショナルディクテーション。自然に話し、フォーマットされたテキスト出力を得る。文書、メール、レポートを手の届かない場所で作成するプロフェッショナルに最適です。
業界トップの精度
10以上のAIモデルから選択して、最も低い単語誤り率を得る dictation 音声はNVIDIAのカナリーが 6%のWERを達成した
スピーカーダイアリズム内蔵
誰が何を言ったか自動的に識別する -- 重要なのは dictation 複数のスピーカーで録音できます 設定は必要ありません
必要なすべてのエクスポートフォーマット
転写を TXT、SRT、VTT、DOCX、JSON、または PDF としてダウンロードします。一度のアップロードで字幕、会議ノート、または構造化データを生成します。
自由に始めて あなたとともに拡大
600分の無料試用期間を利用できる。 もっと必要な場合は、有料プランを自動化のためのAPIアクセスを含めて月額8.33ドルから利用できます。
どうやって働くのか Dictation
1
アップロード dictation オーディオ
MP3、WAV、MP4、その他20以上のフォーマットで録音をドラッグ&ドロップできます。また、マイクからライブ録音もできます。YouTube、Vimeo、その他1,300以上のプラットフォームからURLを貼り付けることもできます。
2
人工知能は dictation 録音
望むモデルと言語を選択します。 もし、お使いのデバイスが自動検出をサポートしていない場合は、スピーカーダイアリズムを有効にしてください。 dictation 録音は複数のスピーカーから 処理には数秒から数分かかります
3
あなたの dictation 転写
ご好みのフォーマットでダウンロード -- メモは TXT、字幕は SRT/VTT、文書は DOCX、統合は JSON。リンクで共有したり、自動化されたワークフローのための API を使用してください。
エクスポートフォーマット Dictation
あなたのコンピュータに合ったフォーマットで すべての転写をエクスポートできます dictation ワークフロー:
TXT
クリアなプレーンテキスト - メモ、検索可能なアーカイブ、コピー・ペーストに最適
SRT / VTT
ビデオプラットフォーム、ソーシャルメディア、アクセシビリティのためのタイムアタック字幕
DOCX
フォーマットされた Word 文書にスピーカーラベルとタイムスタンプ
JSON
開発者と統合者のためのワードレベルタイムスタンプ付き構造化データ
PDF
共有、ファイル、正式な記録のための印刷可能な文書
キー機能 Dictation
よくある質問
Dictation では、オーディオやビデオファイルをアップロード (またはライブ録音) し、正確さと速度の要求に最も適合するモデルを選択します。ワークフローは write 3x faster に調整され、STT.ai の 600 分のフリー時間は有料プランなしで Dictation のほとんどのジョブをカバーするために使用できます。
Dictation の場合、STT.ai Enhanced または Whisper Large V3 は長いオーディオの正確さを最も高めますが、NVIDIA Canary は短いクリップの場合に速くなります。これらはすべて Dictation の基本機能: 8802 をサポートします。
Dictation ワークフローのほとんどでは、我々の最良のモデルはクリーンオーディオの精度93-95%に達します。内蔵されたトランスクリプトエディタは、エクスポートまたは公開前に、時々聞こえない単語を修正し、スピーカーの名前を変更することができます。
はい。スピーカーダイアリゼーションは、Dictation の各音声に自動的にラベルを付けます (スピーカー 1, スピーカー 2, …) 転写後に名前を変更できます。サポートされているすべてのモデルで動作します。
Dictationでは、共有には DOCX と PDF が最適で、コンテンツに字幕が必要な場合は SRT/VTT、機械読み取れるタイムスタンプを必要とする場合は JSON です。正しいエクスポートが役立ちます。
はい。Dictation オーディオファイルはデフォルトで処理され削除されます。プロプランはクライアント側暗号化を追加します。Dictation 転写は、STT.ai にも、あなたの鍵なしでは読み取れません。プライベートクラウドは完全に自己ホストされた Dictation ワークフローに使用できます。
はい。WebSocket ストリーミングを通してライブ転写が Dictation で動作します。事後ではなく、人が話している間にキャプションやノートが必要なときに便利です。
Dictationの場合、無料ユーザーは1時間までのファイルを転写できるが、有料プランではファイル当たり8時間以上まで拡張され、Dictationの長い形式の録音のほとんどをカバーする。
はい。 単語レベルと文レベルのタイムスタンプは Dictation の転写に含まれ、エディタで見ることができる。 瞬間にジャンプするのに役立ち、オーディオを引用したり、字幕を整列させる。
STT.aiは、REST APIを通じて、Slack、Zapier、WordPress、Chrome、MCP(Claude/Cursor用)、およびカスタムワークフローと統合できます。8801チームのほとんどは、これらのうちの2つか3つを使用しています。
はい - GDPR コンプライアンスはすべての Dictation ワークフローに組み込まれており、要求に応じてデータを削除し、オプションを選択しない限りコンテンツに関する訓練はありません。
Dictationオーディオを転写した後、字幕翻訳ツールは出力を100以上の目標言語に翻訳できる。国際的な聴衆や多言語Dictationチームにとって有用である。
無料プランは600分で、Dictationワークロードのほとんどに十分な容量を提供します。有料プランは月額5ドルで、長いファイル、プライベートトランスクリプション、優先キューのロックを解除します。APIの価格は秒単位で、超過料金はありません。