AI politika un pārredzamība
Ko AI mēs izmantojam, kur tas darbojas, un kā mēs izpildām informācijas atklāšanas prasības (EU AI Act 50 pants, spēkā esošs 2026-08-02).
TL;DR
- Visi transkripti ir AI ģenerēti. Katra izejas ir mašīnlasāma informācijas atklāšana.
- Visi AI darbojas mūsu pašu GPU. Mēs NAV sūtīt jūsu audio vai tekstu uz OpenAI, Antropic, Google, vai jebkura trešās puses LLM API.
- Mēs NAV apmācīt bāzes modeļus uz jūsu transkriptiem. Tikai opt-in smalku izmanto korekcijas jūs skaidri izdarīt.
- Sintētiskie balss kloni (TTS) ir skaidri marķēti kā AI ģenerēti faila nosaukums, metadati un uz lapas.
Modeļi, kurus mēs izmantojam
| Paraugs | Izmanto | Licence | Skrējējputns |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Pārraksts (noklusētais) | MIT | Mūsu VPU |
| STT.ai Enhanced (custom fine-tune) | Pārraksts (apmaksas plāni) | MIT (base) / Proprietary (fine-tune weights) | Mūsu VPU |
| Vosk | Reālā laika vārdu straumēšana | Apache 2.0 | Mūsu VPU |
| SpeechBrain ECAPA-TDNN | Skaļruņu diarizācija | Apache 2.0 | Mūsu VPU |
| MadLAD-400 3B | Tulkojums (450+ valodas) | Apache 2.0 | Mūsu VPU |
| Qwen2.5-1.5B (llama.cpp) | Kopsavilkums, analīze, satura paaudze, RAP tērzēšana | Apache 2.0 | Mūsu VPU |
| F5-TTS | Balss klonēšana / teksta uz speech | MIT | Mūsu VPU |
| all-MiniLM-L6-v2 | Ieliktņi RAP meklēšanai | Apache 2.0 | Mūsu VPU |
Mēs nezvanām OpenAI, Antropic, Google Cloud, vai jebkuru trešo personu LLM API jebkurām funkcijām. Katrs modelis iepriekš darbojas uz aparatūras mēs piederam un darbojas. Vienīgais ārējais AI pakalpojums, kuru mēs izmantojam, ir Translateapi.ai (arī Muddy Holdings) tulkot UI virknes — tas nekad pieskaras jūsu trancēts saturu.
Kā mēs atklājam AI paaudzi
- Atzīmēt HTML lapas: ietver < meta nosaukums=\
- Teksta eksports (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Katra faila augšpusē ir iekļauta "AI ģenerētā transkripta" galvene.
- Sintētiska balss / TTS izvade: WAV faili ietver "sintētisko balsošanu" tagu metadatos un skaidru paziņojumu par lejupielādes lapā. Audioable atruna ir uz ceļvedi.
- API atbildes: iekļaut _ai_sagatavots: patiess lauks katrā JSON atbildē, kas satur transtracētu saturu.
Mācību dati
- Pamatmodeļi (Wisper, MadLAD, Qwen u.c.) nāk no saviem attiecīgajiem izdevējiem. Mēs tos izmantojam kā kuģus.
- Jūsu transkripti NAV izmantoti, lai apmācītu bāzes modeļus.
- Ja izlabosiet transkripta segmentu (zīmuli ikonu) vai atzīmēsiet to nepareizi (kartona ikonu), UN esat izvēlējies / privacy iestatījumus / (\
- Atsevišķā veidā, Veicināt korekcijas plus audio uz Voice Lab toggle (arī /privacy-settings/, arī noklusējuma izslēgšana) izvēlas jums, lai veicinātu audio segmentiem jums labot, savienot ar laboto tekstu, mūsu Voice Lab datu kopa saskaņā ar CC-BY-SA-4.0. Abas toggles ir neatkarīgas — jūs varat piešķirt gan, vai nu, vai ne.
- Audio jūs augšupielādēt tiek dzēsts 24 stundu laikā caur tīrīšanas_uploads cron — UNLES jūs esat izvēlējies \
Precizitāte un kļūdas
AI transkripcija nav perfekta. Vārda kļūdu līmenis atšķiras ar skaļruni akcentu, audio kvalitāti, valodu un domēna vārdnīcu. Kritiskai lietošanai (juridiskai, medicīniskai, regulētai rūpniecībai) pārbaudīt pret oriģinālo audio. Mūsu publiskie WER kritēriji katram modelim ir: /models/.
Atbilstības jautājumi
ES AI aktam, VDAR vai citiem atbilstības jautājumiem: hello@stt.ai vai Kontakta forma.
Pēdējo reizi atjaunināts: 2026-04-26.