AI политика и проѕирност

Што ВИ користиме, каде што работи и како ги исполнуваме барањата за откривање (член 50 на Актот на ЕУ за ВИ, кој е ефикасен 2026-08-02).

ТЛ; ДР

  • Сите записи се создадени од ВИ, секој излез носи машинско читано откривање.
  • Сите ВИ работи на сопствен ГПУ. НЕ го испраќаме вашиот аудио или текст до OpenAI, Antropic, Google, или било која LLM API од трета страна.
  • Ние не тренираме модели на базата за вашите транскрипти, туку само една оптимална приспособувачка користи корекции кои ги правите.
  • Синтетичките клонови на гласот (TTS) се јасно означени како AI генерирани во името на датотеката, метаданите и на страницата.

Модели кои ги користиме

МоделКористи се заЛиценцаПродолжува
Whisper large-v3-turbo (faster-whisper)Препис (стандардно)MITНашиот ГПУ
STT.ai Enhanced (custom fine-tune)Препис (платени планови)MIT (base) / Proprietary (fine-tune weights)Нашиот ГПУ
VoskРеално временски пренос на зборовиApache 2.0Нашиот ГПУ
SpeechBrain ECAPA-TDNNДијаризација на звучникотApache 2.0Нашиот ГПУ
MadLAD-400 3BПреведување (450+ јазици)Apache 2.0Нашиот ГПУ
Qwen2.5-1.5B (llama.cpp)Кратка резиме, анализа, генерација на содржини, RAG- разговорApache 2.0Нашиот ГПУ
F5-TTSГласово клонирање / текст- во- говорMITНашиот ГПУ
all-MiniLM-L6-v2Вгнездувања за пребарување на RAGApache 2.0Нашиот ГПУ

Не ги нарекуваме OpenAI, Antropic, Google Cloud или било која трета страна LLM API за било која можност. Секој модел над работи на хардверот што го поседуваме и работиме. Единствената надворешна ВИ сервис што ја користиме е translateapi.ai (иста така и Muddy Holdings) за преведување на низите на УИ — ова никогаш не ја допира вашата транскриптирана содржина.

Како ќе откриеме генерација на АИ

  • HTML- страници на Transcript: вклучуваат <meta name=\
  • Извоз на текст (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Вклучи ја линијата со „AI-generated transcrept“ на врвот на секоја датотека.
  • Синтетички глас / TTS излез: WAV датотеките вклучуваат „ синтетички глас “ во метаподатоците и јасно известување на страницата за симнување. Чуеното одбивање е на патеката.
  • API- одговори: вклучува _ai_generated: вистинското поле во секој одговор на JSON што содржи транскриптирана содржина.

Податоци за обука

  • Базовите модели (Whisper, MadLAD, Qwen итн.) се предупредени од нивните издавачи.
  • Вашите записи не се користат за обучување на модели на базата.
  • Ако го корективирате сегментот на препис (икона на моливот) или ја обележувате неточно (икона на знамето), И сте го избрале во / privacy- sets / (\
  • Посебно, корекциите на прилозите плус аудиото за Voice Lab прекинуваат (исто така во / privacy-settings /, исто така и стандардно исклучувани) ве избираат за придонесување на аудиото на сегментите што ги коректирате, впарени со коригираниот текст, на нашиот Гласов лабораториски сет под CC- BY- SA-4.0. Двата прекинувачи се независни — можете да доделите или двете, или ниту едното.
  • Аудиото што го вчитате е избришано во рок од 24 часа преку чистењето_ оптоварување cron — НЕМА СИ ОДЛУЧУВАШЕ ДА ОДГОВОРИТЕ ЗА \

Точност и грешки

AI транскрипцијата не е совршена. Стапките на грешките на зборовите варираат според акцентот, аудио квалитетот, јазикот и доменот. За критична употреба (легална, медицинска, регулирана индустрија) се потврдуваат против оригиналниот аудио. Нашите јавни стандарди за WER според моделот се во /models/.

Прашања за соодветност

За Законот за МАИ на ЕУ, ГДП, или други прашања за согласност: hello@stt.ai или да го користиш Формат за контакт.

Последно ажурирано: 2026-04-26.