AI政策と透明性

私たちが使用するAIは何であり、どこで動作し、公開要求にどのように従うか(EU AI Act Article 50, effective 2026-08-02)。

テレビ朝日

  • すべての転写はAIによって生成され 出力は機械読み取れる
  • すべてのAIは我々のGPU上で動作します。 私たちはあなたの音声やテキストを OpenAI、Anthropic、Google、その他のサードパーティのLLM APIに送信しません。
  • 基礎モデルは 翻訳に基づいて訓練されません。 あなたが明示的に行った修正を使うのは オプションのフィーニングだけです。
  • 合成音声クローン(TTS)は,ファイル名,メタデータ,ページ上で明確にAI生成とラベル付けされる。

モデル

モデル用途ライセンス続行中
Whisper large-v3-turbo (faster-whisper)転写 (デフォルト)MIT私たちのGPU
STT.ai Enhanced (custom fine-tune)転写(有料プラン)MIT (base) / Proprietary (fine-tune weights)私たちのGPU
VoskリアルタイムワードストリーミングApache 2.0私たちのGPU
SpeechBrain ECAPA-TDNN話者のダイアリズムApache 2.0私たちのGPU
MadLAD-400 3B翻訳(450以上の言語)Apache 2.0私たちのGPU
Qwen2.5-1.5B (llama.cpp)概要,分析,コンテンツ生成,RAGチャットApache 2.0私たちのGPU
F5-TTS音声クローンMIT私たちのGPU
all-MiniLM-L6-v2RAG検索の埋め込みApache 2.0私たちのGPU

私たちはOpenAI、Anthropic、Google Cloud、その他のサードパーティのLLM APIを呼び出すことはありません。上記のすべてのモデルは私たちが所有し運営するハードウェア上で動作します。外部AIサービスとして使うのは、 UI文字列を翻訳する translateapi.ai(Muddy Holdings も含む)だけです。これは、転写されたコンテンツに関係しません。

AIの生成を公開する方法

  • トランスクリプトHTMLページ: これは、メタデータの 保存先を指定するための ユーザの権限です。
  • テキストエクスポート (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): ファイルの上部に AIによる記録を 入れてください
  • 合成音声/TTS出力: WAV ファイルはメタデータに合成音声タグを含み、ダウンロードページに明確な注意を示しています。音声の免責はロードマップにあります。
  • API応答: 転写されたコンテンツを含むすべての JSON 応答に _ai_generated: true フィールドを含む。

訓練データ

  • 基礎モデル(Whisper、MadLAD、Qwenなど)はそれぞれの出版社から予め訓練されており、送られてきたときに使う。
  • 君の転写は 基礎モデルの訓練には使われない
  • 転写セグメントを修正するとき(鉛筆アイコン)または不正なものとマークするとき(フラグアイコン)、および /privacy-settings/ でオプションを設定した場合、この機能は自動的に有効になります。
  • 別に、音声実験室に修正とオーディオを提供するトグル(/privacy-settings/にもありますが、デフォルトではオフ)は、修正したセグメントのオーディオを修正されたテキストと組み合わせて、CC-BY-SA-4.0の下で音声実験室データセットに提供するかどうかを選択します。2つのトグルは独立しています。どちらか、両方、またはどちらも許可できます。
  • アップロードしたオーディオは cleanup_uploads cron を使って 24 時間以内に削除されます。

精度と誤差

人工知能による転写は完璧ではありません。単語の誤り率は話者のアクセント、音声品質、言語、ドメインの語彙によって異なります。重要な用途(法律、医療、規制された産業)の場合は、オリジナルのオーディオと比較して確認してください。モデルごとの公開 WER ベンチマークは以下です。 /models/.

コンプライアンス問題

EU AI Act、GDPR、その他のコンプライアンスの質問については、 hello@stt.ai または こちらの 連絡先フォーム.

更新日: 2026-04-26.