AI politika un pārredzamība

Ko AI mēs izmantojam, kur tas darbojas, un kā mēs izpildām informācijas atklāšanas prasības (EU AI Act 50 pants, spēkā esošs 2026-08-02).

TL;DR

  • Visi transkripti ir AI ģenerēti. Katra izejas ir mašīnlasāma informācijas atklāšana.
  • Visi AI darbojas mūsu pašu GPU. Mēs NAV sūtīt jūsu audio vai tekstu uz OpenAI, Antropic, Google, vai jebkura trešās puses LLM API.
  • Mēs NAV apmācīt bāzes modeļus uz jūsu transkriptiem. Tikai opt-in smalku izmanto korekcijas jūs skaidri izdarīt.
  • Sintētiskie balss kloni (TTS) ir skaidri marķēti kā AI ģenerēti faila nosaukums, metadati un uz lapas.

Modeļi, kurus mēs izmantojam

ParaugsIzmantoLicenceSkrējējputns
Whisper large-v3-turbo (faster-whisper)Pārraksts (noklusētais)MITMūsu VPU
STT.ai Enhanced (custom fine-tune)Pārraksts (apmaksas plāni)MIT (base) / Proprietary (fine-tune weights)Mūsu VPU
VoskReālā laika vārdu straumēšanaApache 2.0Mūsu VPU
SpeechBrain ECAPA-TDNNSkaļruņu diarizācijaApache 2.0Mūsu VPU
MadLAD-400 3BTulkojums (450+ valodas)Apache 2.0Mūsu VPU
Qwen2.5-1.5B (llama.cpp)Kopsavilkums, analīze, satura paaudze, RAP tērzēšanaApache 2.0Mūsu VPU
F5-TTSBalss klonēšana / teksta uz speechMITMūsu VPU
all-MiniLM-L6-v2Ieliktņi RAP meklēšanaiApache 2.0Mūsu VPU

Mēs nezvanām OpenAI, Antropic, Google Cloud, vai jebkuru trešo personu LLM API jebkurām funkcijām. Katrs modelis iepriekš darbojas uz aparatūras mēs piederam un darbojas. Vienīgais ārējais AI pakalpojums, kuru mēs izmantojam, ir Translateapi.ai (arī Muddy Holdings) tulkot UI virknes — tas nekad pieskaras jūsu trancēts saturu.

Kā mēs atklājam AI paaudzi

  • Atzīmēt HTML lapas: ietver < meta nosaukums=\
  • Teksta eksports (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Katra faila augšpusē ir iekļauta "AI ģenerētā transkripta" galvene.
  • Sintētiska balss / TTS izvade: WAV faili ietver "sintētisko balsošanu" tagu metadatos un skaidru paziņojumu par lejupielādes lapā. Audioable atruna ir uz ceļvedi.
  • API atbildes: iekļaut _ai_sagatavots: patiess lauks katrā JSON atbildē, kas satur transtracētu saturu.

Mācību dati

  • Pamatmodeļi (Wisper, MadLAD, Qwen u.c.) nāk no saviem attiecīgajiem izdevējiem. Mēs tos izmantojam kā kuģus.
  • Jūsu transkripti NAV izmantoti, lai apmācītu bāzes modeļus.
  • Ja izlabosiet transkripta segmentu (zīmuli ikonu) vai atzīmēsiet to nepareizi (kartona ikonu), UN esat izvēlējies / privacy iestatījumus / (\
  • Atsevišķā veidā, Veicināt korekcijas plus audio uz Voice Lab toggle (arī /privacy-settings/, arī noklusējuma izslēgšana) izvēlas jums, lai veicinātu audio segmentiem jums labot, savienot ar laboto tekstu, mūsu Voice Lab datu kopa saskaņā ar CC-BY-SA-4.0. Abas toggles ir neatkarīgas — jūs varat piešķirt gan, vai nu, vai ne.
  • Audio jūs augšupielādēt tiek dzēsts 24 stundu laikā caur tīrīšanas_uploads cron — UNLES jūs esat izvēlējies \

Precizitāte un kļūdas

AI transkripcija nav perfekta. Vārda kļūdu līmenis atšķiras ar skaļruni akcentu, audio kvalitāti, valodu un domēna vārdnīcu. Kritiskai lietošanai (juridiskai, medicīniskai, regulētai rūpniecībai) pārbaudīt pret oriģinālo audio. Mūsu publiskie WER kritēriji katram modelim ir: /models/.

Atbilstības jautājumi

ES AI aktam, VDAR vai citiem atbilstības jautājumiem: hello@stt.ai vai Kontakta forma.

Pēdējo reizi atjaunināts: 2026-04-26.