AI politika ir skaidrumas

Ką AI naudojame, kur veikia, ir kaip mes laikomės informacijos atskleidimo reikalavimų (ES AIS akto 50 straipsnis, galiojantis 2026-08-02).

TL;DR

  • Visi stenogramos yra AI-sukurtas. Kiekvienas išvestis turi mašininio nuskaitomojo atskleidimo.
  • Visi AI veikia mūsų pačių GPU. Mes ne siųsti savo garso ar tekstą į OpenAI, Antropic, "Google", ar bet kurios trečiosios šalies LLM API.
  • Mes netreniruojame jūsų stenogramose esančių modelių. Tik pasirinkus smulkų kursą, naudojami jūsų aiškiai padaryti pataisymai.
  • Sintetiniai balso klonai (TTS) yra aiškiai pažymėti kaip AI sukurtas failo pavadinimas, metaduomenys ir puslapyje.

Modeliai, kuriuos naudojame

PavyzdysNaudojamasLicencijaVyksta toliau
Whisper large-v3-turbo (faster-whisper)Perraša (numatyta)MITMūsų VPU
STT.ai Enhanced (custom fine-tune)Perraša (mokami planai)MIT (base) / Proprietary (fine-tune weights)Mūsų VPU
VoskTikrojo laiko žodžio srautavimasApache 2.0Mūsų VPU
SpeechBrain ECAPA-TDNNGarsiakalbių diarizacijaApache 2.0Mūsų VPU
MadLAD-400 3BVertimas (450+ kalbomis)Apache 2.0Mūsų VPU
Qwen2.5-1.5B (llama.cpp)Santrauka, analizė, turinio generavimas, RAG pokalbiaiApache 2.0Mūsų VPU
F5-TTSBalso klonavimas / tekstas į garsąMITMūsų VPU
all-MiniLM-L6-v2Įterpiami RPG paieškos elementaiApache 2.0Mūsų VPU

Mes neskambiname OpenAI, Anthropic, Google Cloud, ar bet kokios trečiosios šalies LLM API bet kokiai funkcijai. Kiekvienas modelis veikia ant aparatūros mes turime ir veikia. Vienintelis išorinis AI paslauga, kurią naudojame, yra Translateapi.ai (taip pat Muddy Holdings) versti UI stygas - tai niekada paliečia jūsų transliuotas turinį.

Kaip mes atskleisti AI karta

  • Perrašymo HTML puslapiai: < Meta name=\
  • Tekstas eksportas (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): kiekvieno failo viršuje yra „AI sukurto stenogramos“ antraštė.
  • Sintetinis balsas / TTS išvestis: WAV failai apima "sintetinis balso" žymę metaduomenys ir aiškus pranešimas atsisiuntimo puslapyje. Garsus atsisakymas yra veiksmų plane.
  • API atsakas: įtraukti _ai_sukurtas: tikrasis laukas kiekviename JSON atsake, kuriame yra transtraced turinys.

Mokymo duomenys

  • Baziniai modeliai (Whisper, MadLAD, Qwen ir t.t.) iš anksto parengti iš jų leidėjų. Mes naudojame juos kaip laivyba.
  • Jūsų stenogramos NEGALIMA treniruoti bazinių modelių.
  • Jei taisyti transkripto segmentą ( pieštuko piktogramą) arba pažymėti jį neteisingai (kodo piktogramą), o jūs pasirinkote ties / privacy nustatymus / (\
  • Atskirai, Prisidėti pataisymai plius garso į Voice Lab toggle (taip pat /privacy-settings /, taip pat default off) pasirenka jums prisidėti prie garso segmentų jums ištaisyti, sujungti su pataisytu tekstu, į mūsų Balso Lab duomenų rinkinį pagal CC-BY-SA-4.0. Du perjungimai yra nepriklausomi – jūs galite suteikti tiek, arba nei.
  • Audio, įkelkite, ištrinami per 24 valandas per valymo_uploads Cron — UNLESS jums pasirinko \

Tikslumas ir klaidos

AI transkripcija nėra tobula. Žodinis klaidų lygis skiriasi pagal garsiakalbio akcentą, garso kokybę, kalbą ir domeno žodyną. Kritiniam naudojimui (teisinis, medicinos, reguliuojamos pramonės šakos) patikrinti pagal originalų garsą. Mūsų vieši WER lyginamieji pagal modelį yra: /models/.

Atitikties klausimai

ES PG akto, BDAR ar kitų atitikties klausimų atveju: hello@stt.ai arba naudoti Kontaktinė forma.

Paskutinis atnaujinimas: 2026-04-26.