см› јерница и провидност ВИ
Шта ВИ користимо, где ради, и како се држимо захтева за откривање (Члан 50 ЕУ АИ Акта, ефикасан 2026-08-02).
ТЛДР
- Сваки излаз носи машинско очитавајуће откриће.
- Сви ВИ ради на нашем ГПУ-у. Не шаљемо ваш аудио или текст ОТЕАИ, Антропику, Гуглу, или било ког трећег ЛЛМ АПИ.
- Не тренирамо моделе на вашим транскриптима. Сваки модел који покренемо је модел отвореног извора.
- Синтетички гласни клонови (ТТС) су јасно означени као АИ-генерирани у датотеци, метаподаци, и на страници.
Модели које користимо
| Модел | Користи се за | Лиценца | Покреће се |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Транкрипција (подразумевано) | MIT | Наш ГПУ |
| Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced” | Транкрипција (плаћени планови) | MIT | Наш ГПУ |
| Vosk | Реалновременско проточење р› ијечи | Apache 2.0 | Наш ГПУ |
| SpeechBrain ECAPA-TDNN | Дијаризација звучника | Apache 2.0 | Наш ГПУ |
| MadLAD-400 3B | Превод (450+ језика) | Apache 2.0 | Наш ГПУ |
| Qwen2.5-1.5B (llama.cpp) | Сажетак, анализа, генерација садржаја, РАГ ћаскање | Apache 2.0 | Наш ГПУ |
| F5-TTS | Гласово клонирање / текст‐ у‐ говор | MIT | Наш ГПУ |
| all-MiniLM-L6-v2 | Угњежђивање за претрагу РАГ‐ а | Apache 2.0 | Наш ГПУ |
“ STT.ai Побољшани “ је наше име производа за Whisper big- v3 који ради на нашем ГПУ-у. То није обичајни модел, фино- прилагодљива или власничка тежина — то је највећа и најтачнија контролна тачка Виспера. То је прецизнији од подразумеваног Всвирача велики- v3-турбо, а око 1,5× спорије на дијаризовани посао, измерен на сопственом хардверу.
Не зовемо OpenAI, Antropic, Google Cloud, нити било који од трећих страна LLM API за било какве могућности. Сваки модел изнад ради на хардверу који поседујемо и радимо. Једини спољашњи ВИ сервис који користимо је translateapi.ai (ипак Muddy Holdings) за превођење УИ низова — ово никада не додирује ваш преписани садржај.
Како откривамо АИ генерацију
- Транкрипт ХТМЛ странице: укључи име <meta=\
- Извоз текста (ТXT, СРТ, ВТТТ, ЈСОН, ЦСВ, ДОЦКС, ПДФ): Укључује заглавље "АИ-генерирани транскрипт" линија на врху сваког фајла.
- Синтетички глас / ТТС излаз: У WAV фајлови укључује ознаку „ синтетичког гласа “ у метаподатоке и јасно обавештење на страници преузимања. Чује се одбиће на путу пута.
- АПИ одговори: Укључи _аи_generated: право поље у сваком одговору ЈСОН‐ а који садржи транскриптисани садржај.
Подаци о обуци
- Базни модели (Вхиспер, МадЛАД, Квен, итд.) долазе унапред обучени од њихових издавача.
- Ваши транскрипти се не користе за обуку модела базе.
- Ако исправите сегмент транскрипта (икона оловке) или је обележите неисправним (икона заставице), а одлучили сте се на / privacy- setstings / („ Модел обучавање “ искључује, подразумевано искључује), пар (неисправан текст → исправљен) може се прикупити за обуку будућег текстуалног корекција. Само пар текста — никада окружни аудио — користи ова путања. Данас не постоји такав модел: парови се складиште само и ништа што тренутно служимо није обучено за њих.
- Засебно, исправке доприноса плус аудио у Гласни лабораторију (такође на / privacy-settings /, такође подразум› ијевано) омогућавају да допринесете аудио сегментима које исправљате, упарени са исправљеним текстом, на наш Гласни лабораторијски сет под CC- BY- SA-4.0. Два превођења су независна — можете допустити или оба, или ниједно.
- Снимак који слањем обришете за 24 сата преко браме — осим ако сте одлучили да рашчистите
тачност и грешке
АИ транскрипција није савршена. Стање грешака р› ијечи варира по акценту, аудио квалитету, језику и домену речнику. За критичну употребу (законито, медицинско, регулисано индустрије) проверите у односу на оригинални аудио. Наше јавне стандарде ВЕР по моделу су на /models/.
Питања о подржавању
За МА МА, ГДП или друга питања о усклађењу: hello@stt.ai или користите обрасац контакта.
Пос‹ љедње ажурирање: 2026-08-05.