Politica și transparența AI

Ce folosim AI, unde se execută, și cum respectăm cerințele de informare (Articolul 50 din Legea UE privind AI, eficace 2026-08-02).

TL;DR

  • Toate transcripţiile sunt generate de AI. Fiecare ieșire transportă o divulgație de citire a mașinii.
  • Toate AI rulează pe propria noastră GPU. Nu trimitem audio sau text la OpenAI, Anthropic, Google sau orice API LLM de terțe părți.
  • Noi nu antrenăm modele de bază pe transcripții. Doar un opt-in fine-tun folosește corectiuni pe care le faceți explicit.
  • Clonele vocale sintetice (TTS) sunt etichetate în mod clar sub numele de nume, metadatele și pe pagina.

Modelele pe care le folosim

ModelUtilizat pentruLicențăFugi
Whisper large-v3-turbo (faster-whisper)Transcriere (defect)MITGPU-ul nostru
STT.ai Enhanced (custom fine-tune)Transcriere (planuri plătite)MIT (base) / Proprietary (fine-tune weights)GPU-ul nostru
VoskFlux de cuvinte în timp realApache 2.0GPU-ul nostru
SpeechBrain ECAPA-TDNNDiarizarea speakeruluiApache 2.0GPU-ul nostru
MadLAD-400 3BTraducerea (450+ limbi)Apache 2.0GPU-ul nostru
Qwen2.5-1.5B (llama.cpp)Rezumatul, analiza, generarea conținutului, chat RAGApache 2.0GPU-ul nostru
F5-TTSClonarea vocală / text-la-piciorMITGPU-ul nostru
all-MiniLM-L6-v2Incorporări pentru căutarea RAGApache 2.0GPU-ul nostru

Nu numim OpenAI, Anthropic, Google Cloud, sau orice API LLM de terțe părți pentru orice caracteristică. Fiecare model de mai sus funcționează pe hardware deține și funcționează. Singurul serviciu extern de AI pe care îl folosim este traducepi.ai (de asemenea, Muddy Holdings) pentru traducerea de stringi UI – acest lucru nu atinge conținutul transcris.

Cum vom dezvălui generaţia de IA

  • Pagini HTML transcrise: include <meta name=\
  • Exporturi text (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): include o linie de antet 'Transcripție generată de IA' în partea de sus a fiecărui fișier.
  • Voce sintetică / Ieșire TTS: Fişierele WAV includ un etichet'sintetic-voice' în metadate şi un anunţ clar pe pagina descărcare. Audible declaimer este pe roadmap.
  • Răspunsuri API: include un câmp _ai_generat: adevărat în fiecare răspuns JSON care conține conținut transcris.

Date de formare

  • Modelele de bază (Whisper, MadLAD, Qwen, etc.) sunt pre-învățate de la publicatorii lor respectivi. Noi le folosim ca naved.
  • Transcripcionele dvs. N- sunt folosite pentru a antrena modelele de bază.
  • Dacă corectaţi un segment de transcriere (icona creion) sau marcaţi-l incorect (icona steag), şi aţi optat în /privacy-settings/ (\
  • În mod separat, Contribui corecții plus audio la Voice Lab comuta (de asemenea, la /privacy-settings /, de asemenea oprire implicită) vă optă pentru a contribui la audio-ul segmentelor corecte, însoțite de textul corectat, la setul nostru de date Voice Lab sub CC-BY-SA-4.0. Cele două comutatoare sunt independente – puteți acorda fie, fie, nici nici.
  • Audio pe care îl încărcaţi este șterse în 24 de ore prin intermediul cron curățat_uploads — UNLESS ați optat să \

Precizie și erori

Transcripția IA nu este perfectă. Ratele de eroare ale cuvintelor variază de accentul speaker, calitatea audio, limbaj și vocabularul de domeniu. Pentru utilizare critică (industrii juridice, medicale, reglementate) verifică împotriva audioului original. Referințe publice WER pe model sunt la /models/.

Întrebări privind conformitatea

Pentru Actul UE privind AI, GDPR sau alte întrebări privind conformitatea: hello@stt.ai sau folosirea formular de contact.

Ultima actualizare: 2026-04-26.