無料オンライブ文字起こし
AIによるライブ文字起こし。マイクに向かって話すと、リアルタイムでテキストとして表示されます。100以上の言語、10以上のモデル、98%以上の精度。
1. 録音をクリック
マイクボタンをクリックして話し始めてください。言葉が即座に表示されます。
2. AIがライブで文字起こし
Voskが即時に単語を提供。Whisperが話している間に自動的に修正して精度を向上。
3. 改善と共有
完全なAI文字起こしで改善。ダウンロード、共有、またはアカウントに保存。
ライブ文字起こしモデル
ニーズに合ったAIモデルを選択 — または最適なモデルをお任せください。
100以上の言語でライブ文字起こし
ライブ文字起こしを試す準備はできましたか?
無料で始める →よくある質問
ライブトランスペクションは録音が終わった後ではなく、話しながら実時間に音声をテキストに変換します。STT.aiは話し出された言葉を1秒から2秒以内にスクリーンにストリーミングします。
マイクをクリックし、ブラウザが要求するときにマイクのアクセスを許可し、話し始めます。キャプションがライブで表示されます。会議やコンピュータで再生されているビデオのキャプションを表示するには、マイクではなくシステムオーディオを共有します。
一般的には、テキストと音声の間に 1 秒から 2 秒の間隔があります。遅延はネットワークと GPU の負荷に依存します。安定した接続は、字幕が大きな間隔なしにスムーズに流れます。
標準のマイクとWebSocket APIを使用して、デスクトップとモバイル上の現在のChrome、Edge、Firefox、Safariで動作します。プラグインやダウンロードは必要ありません。マイクの権限を与えるだけです。
STT.aiは600分のフリーで ライブ転写を始める 月5ドルからの有料プランは 長いセッション プライベート転写 優先ストリーミングを追加
ライブ転写は,明瞭な音声の90〜95%に達するが,全体の録音を見直すよりも,モデルがリアルタイムで単語に取り組むため,バッチ転写よりもわずかに低い。
はい。ライブトランスポートをイベント音声 (マイクまたはシステム音声) に向け、アクセシビリティのためにスクリーンにキャプションを表示します。セッションが終了すると、完全なトランスポートを保存できます。
はい。100 以上の言語がサポートされています。自動検出には音声が必要なので、最も信頼できるリアルタイム結果を得るには、始める前に言語を設定してください。
はい。停止すると、ライブセッションは編集、スピーカーの名前変更、TXT、DOCX、PDF、SRT、VTTにエクスポートできる完全なトランスクリプトとして保存されます。
はい、スピーカーダイアリズムはセッション中に声をラベル付けします。 後で保存されたトランスクリプトで実名に名前を変更できます。
はい。ストリームされたオーディオはリアルタイムで処理され、転写を作成する以外は保持されません。転写は標準で削除されます。Proプランでは保存された転写にクライアント側暗号化を追加します。
遅延や落ちた言葉は、通常、不安定なネットワークやマイクから遠く離れた場所で話しているときに発生します。有線または強力な Wi-Fi 接続と近くのマイクは、リアルタイムのキャプションを正確でタイムリーに保つことができます。