AI политика и проѕирност
Што ВИ користиме, каде што работи и како ги исполнуваме барањата за откривање (член 50 на Актот на ЕУ за ВИ, кој е ефикасен 2026-08-02).
ТЛ; ДР
- Сите записи се создадени од ВИ, секој излез носи машинско читано откривање.
- Сите ВИ работи на сопствен ГПУ. НЕ го испраќаме вашиот аудио или текст до OpenAI, Antropic, Google, или било која LLM API од трета страна.
- Ние не тренираме модели на базата за вашите транскрипти, туку само една оптимална приспособувачка користи корекции кои ги правите.
- Синтетичките клонови на гласот (TTS) се јасно означени како AI генерирани во името на датотеката, метаданите и на страницата.
Модели кои ги користиме
| Модел | Користи се за | Лиценца | Продолжува |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Препис (стандардно) | MIT | Нашиот ГПУ |
| STT.ai Enhanced (custom fine-tune) | Препис (платени планови) | MIT (base) / Proprietary (fine-tune weights) | Нашиот ГПУ |
| Vosk | Реално временски пренос на зборови | Apache 2.0 | Нашиот ГПУ |
| SpeechBrain ECAPA-TDNN | Дијаризација на звучникот | Apache 2.0 | Нашиот ГПУ |
| MadLAD-400 3B | Преведување (450+ јазици) | Apache 2.0 | Нашиот ГПУ |
| Qwen2.5-1.5B (llama.cpp) | Кратка резиме, анализа, генерација на содржини, RAG- разговор | Apache 2.0 | Нашиот ГПУ |
| F5-TTS | Гласово клонирање / текст- во- говор | MIT | Нашиот ГПУ |
| all-MiniLM-L6-v2 | Вгнездувања за пребарување на RAG | Apache 2.0 | Нашиот ГПУ |
Не ги нарекуваме OpenAI, Antropic, Google Cloud или било која трета страна LLM API за било која можност. Секој модел над работи на хардверот што го поседуваме и работиме. Единствената надворешна ВИ сервис што ја користиме е translateapi.ai (иста така и Muddy Holdings) за преведување на низите на УИ — ова никогаш не ја допира вашата транскриптирана содржина.
Како ќе откриеме генерација на АИ
- HTML- страници на Transcript: вклучуваат <meta name=\
- Извоз на текст (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Вклучи ја линијата со „AI-generated transcrept“ на врвот на секоја датотека.
- Синтетички глас / TTS излез: WAV датотеките вклучуваат „ синтетички глас “ во метаподатоците и јасно известување на страницата за симнување. Чуеното одбивање е на патеката.
- API- одговори: вклучува _ai_generated: вистинското поле во секој одговор на JSON што содржи транскриптирана содржина.
Податоци за обука
- Базовите модели (Whisper, MadLAD, Qwen итн.) се предупредени од нивните издавачи.
- Вашите записи не се користат за обучување на модели на базата.
- Ако го корективирате сегментот на препис (икона на моливот) или ја обележувате неточно (икона на знамето), И сте го избрале во / privacy- sets / (\
- Посебно, корекциите на прилозите плус аудиото за Voice Lab прекинуваат (исто така во / privacy-settings /, исто така и стандардно исклучувани) ве избираат за придонесување на аудиото на сегментите што ги коректирате, впарени со коригираниот текст, на нашиот Гласов лабораториски сет под CC- BY- SA-4.0. Двата прекинувачи се независни — можете да доделите или двете, или ниту едното.
- Аудиото што го вчитате е избришано во рок од 24 часа преку чистењето_ оптоварување cron — НЕМА СИ ОДЛУЧУВАШЕ ДА ОДГОВОРИТЕ ЗА \
Точност и грешки
AI транскрипцијата не е совршена. Стапките на грешките на зборовите варираат според акцентот, аудио квалитетот, јазикот и доменот. За критична употреба (легална, медицинска, регулирана индустрија) се потврдуваат против оригиналниот аудио. Нашите јавни стандарди за WER според моделот се во /models/.
Прашања за соодветност
За Законот за МАИ на ЕУ, ГДП, или други прашања за согласност: hello@stt.ai или да го користиш Формат за контакт.
Последно ажурирано: 2026-04-26.