см› јерница и провидност ВИ

Шта ВИ користимо, где ради, и како се држимо захтева за откривање (Члан 50 ЕУ АИ Акта, ефикасан 2026-08-02).

ТЛДР

  • Сваки излаз носи машинско очитавајуће откриће.
  • Сви ВИ ради на нашем ГПУ-у. Не шаљемо ваш аудио или текст ОТЕАИ, Антропику, Гуглу, или било ког трећег ЛЛМ АПИ.
  • Не тренирамо моделе на вашим транскриптима. Сваки модел који покренемо је модел отвореног извора.
  • Синтетички гласни клонови (ТТС) су јасно означени као АИ-генерирани у датотеци, метаподаци, и на страници.

Модели које користимо

МоделКористи се заЛиценцаПокреће се
Whisper large-v3-turbo (faster-whisper)Транкрипција (подразумевано)MITНаш ГПУ
Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced”Транкрипција (плаћени планови)MITНаш ГПУ
VoskРеалновременско проточење р› ијечиApache 2.0Наш ГПУ
SpeechBrain ECAPA-TDNNДијаризација звучникаApache 2.0Наш ГПУ
MadLAD-400 3BПревод (450+ језика)Apache 2.0Наш ГПУ
Qwen2.5-1.5B (llama.cpp)Сажетак, анализа, генерација садржаја, РАГ ћаскањеApache 2.0Наш ГПУ
F5-TTSГласово клонирање / текст‐ у‐ говорMITНаш ГПУ
all-MiniLM-L6-v2Угњежђивање за претрагу РАГ‐ аApache 2.0Наш ГПУ

“ STT.ai Побољшани “ је наше име производа за Whisper big- v3 који ради на нашем ГПУ-у. То није обичајни модел, фино- прилагодљива или власничка тежина — то је највећа и најтачнија контролна тачка Виспера. То је прецизнији од подразумеваног Всвирача велики- v3-турбо, а око 1,5× спорије на дијаризовани посао, измерен на сопственом хардверу.

Не зовемо OpenAI, Antropic, Google Cloud, нити било који од трећих страна LLM API за било какве могућности. Сваки модел изнад ради на хардверу који поседујемо и радимо. Једини спољашњи ВИ сервис који користимо је translateapi.ai (ипак Muddy Holdings) за превођење УИ низова — ово никада не додирује ваш преписани садржај.

Како откривамо АИ генерацију

  • Транкрипт ХТМЛ странице: укључи име <meta=\
  • Извоз текста (ТXT, СРТ, ВТТТ, ЈСОН, ЦСВ, ДОЦКС, ПДФ): Укључује заглавље "АИ-генерирани транскрипт" линија на врху сваког фајла.
  • Синтетички глас / ТТС излаз: У WAV фајлови укључује ознаку „ синтетичког гласа “ у метаподатоке и јасно обавештење на страници преузимања. Чује се одбиће на путу пута.
  • АПИ одговори: Укључи _аи_generated: право поље у сваком одговору ЈСОН‐ а који садржи транскриптисани садржај.

Подаци о обуци

  • Базни модели (Вхиспер, МадЛАД, Квен, итд.) долазе унапред обучени од њихових издавача.
  • Ваши транскрипти се не користе за обуку модела базе.
  • Ако исправите сегмент транскрипта (икона оловке) или је обележите неисправним (икона заставице), а одлучили сте се на / privacy- setstings / („ Модел обучавање “ искључује, подразумевано искључује), пар (неисправан текст → исправљен) може се прикупити за обуку будућег текстуалног корекција. Само пар текста — никада окружни аудио — користи ова путања. Данас не постоји такав модел: парови се складиште само и ништа што тренутно служимо није обучено за њих.
  • Засебно, исправке доприноса плус аудио у Гласни лабораторију (такође на / privacy-settings /, такође подразум› ијевано) омогућавају да допринесете аудио сегментима које исправљате, упарени са исправљеним текстом, на наш Гласни лабораторијски сет под CC- BY- SA-4.0. Два превођења су независна — можете допустити или оба, или ниједно.
  • Снимак који слањем обришете за 24 сата преко браме — осим ако сте одлучили да рашчистите

тачност и грешке

АИ транскрипција није савршена. Стање грешака р› ијечи варира по акценту, аудио квалитету, језику и домену речнику. За критичну употребу (законито, медицинско, регулисано индустрије) проверите у односу на оригинални аудио. Наше јавне стандарде ВЕР по моделу су на /models/.

Питања о подржавању

За МА МА, ГДП или друга питања о усклађењу: hello@stt.ai или користите обрасац контакта.

Пос‹ љедње ажурирање: 2026-08-05.