ДК ережесі мен мөлдірлігі
Біз қандай ЖІ-ні қолданамыз, ол қайда жұмыс істейді және біз мәліметтерді жариялау талаптарына қалай сәйкес келеміз (Еуропалық Одақ ЖІ-нің актісінің 50-бабы, күшіне енуі 2026-08-02).
TL; DR
- Барлық транскрипттерді ДНҚ жасаған. Әрбір шығарылымда машина оқыйтын мәлімет бар.
- Барлық ДЖ өз графикалық процессорымызда жұмыс істейді. Біз аудио немесе мәтініңізді OpenAI, Anthropic, Google немесе басқа LLM API- ге жібермейміз.
- Біз сіздің транскрипцияларыңыз бойынша негізі модельдерді оқыта АЛМАЙМЫЗ. Тек сіздің жасаған түзетулеріңізді таңдап, ыңғайлау арқылы ғана.
- Синтетикалық дауыс клондары (TTS) файл атауында, метадеректерде және бетте AI-генерацияланған деп айқын белгіленеді.
Қолданатын үлгілер
| Үлгі | Келесіге қолданылады | Лицензия | Орындалуы |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Транскрипция (әдетті) | MIT | Біздің графикалық процессор |
| STT.ai Enhanced (custom fine-tune) | Транскрипция (ақылы жоспарлар) | MIT (base) / Proprietary (fine-tune weights) | Біздің графикалық процессор |
| Vosk | Тікелей сөз ағыны | Apache 2.0 | Біздің графикалық процессор |
| SpeechBrain ECAPA-TDNN | Дисплейді диаризациялау | Apache 2.0 | Біздің графикалық процессор |
| MadLAD-400 3B | Аудару (450+ тіл) Name | Apache 2.0 | Біздің графикалық процессор |
| Qwen2.5-1.5B (llama.cpp) | Тұжырымдама, талдау, мазмұнды құру, RAG чатыName | Apache 2.0 | Біздің графикалық процессор |
| F5-TTS | Дыбысты көшіру / Мәтінді сөйлеуге | MIT | Біздің графикалық процессор |
| all-MiniLM-L6-v2 | RAG іздеу үшін енгізілгенName | Apache 2.0 | Біздің графикалық процессор |
Біз OpenAI, Anthropic, Google Cloud немесе басқа LLM API- лерді ешбір мүмкіндік үшін қолданбаймыз. Жоғарыда келтірілген әрбір модель біздің жабдықтарымызда жұмыс істейді. Біз қолданатын бір ғана сыртқы AI қызметі translateapi. ai (Muddy Holdings) UI жолдарын аудару үшін - бұл ешқашан сіздің транскрипцияланған мазмұныңызға әсер етпейді.
ДНҚ-ның жаңа буынын қалай ашуға болады
- HTML парақтарын аудару: < meta name=\ include
- Мәтінді экспорттау (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): әрбір файлдың басына 'AI- generated transcript' айдар жолын қосу.
- Синтетикалық дыбыс / TTS шығысы: WAV файлдар метадеректерінде'synthetic- voice' тегі бар және жүктеп алу бетінде анық ескертуі бар. Аудио жауапкершілігінен бас тарту жол картасында көрсетілген.
- API жауаптары: әрбір JSON жауапта аударылған мазмұн бар _ai_generated: true өрісін қосу.
Оқыту деректері
- Негізгі үлгілер (Whisper, MadLAD, Qwen, т. б.) өздерінің шығарушыларынан алдын- ала оқытылған. Біз оларды жеткізілгендей қолданамыз.
- Сіздің транскрипцияларыңыз негізі модельдерді оқыту үшін қолданылмайды.
- Егер сіз транскрипт сегментін түзетсеңіз (қалам таңбашасы) немесе оны дұрыс емес деп белгілесеңіз (жалауша таңбашасы), және / privacy- settings / дегенде рұқсат берілсе, онда бұл файлды өшіруге болады.
- Аудио және түзетулерді Voice Lab- қа қосу параметрі (/ privacy- settings / дегенде, әдетті түрде өшірілген) түзеткен сегменттердің аудиосын түзетілген мәтінмен бірге Voice Lab деректер қорына CC- BY- SA- 4. 0 лицензиясы бойынша қосуға мүмкіндік береді. Бұл екі параметр бір- бірінен тәуелсіз, біреуін таңдап, екеуін таңдап, немесе екеуін де таңдап, қоса қос
- Жүктеген аудио файлдар 24 сағат ішінде cleanup_ uploads cron арқылы өшіріледі - егер осыны таңдамасаңыз\
Дұрыстығы мен қателері
ДК транскрипциясы мықты емес. Сөз қателерінің жиілігі сөйлеушінің акцентіне, дыбыс сапасына, тіліне және сөздік қорына байланысты. Қажет болғанда (құқықтық, медициналық, заңмен реттелген салаларда) бастапқы дыбыспен салыстырыңыз. WER- дің үлгі бойынша ашық ережелері мына жерде /models/.
Сұрақтар
Еуропалық Одақ ДЖ-ның заңына, GDPR-ға немесе басқа да талаптарға сәйкес келетін сұрақтар үшін: hello@stt.ai немесе келесіні қолданыңыз контакт пішін.
Соңғы жаңартылғаны: 2026-04-26.