Politika e AI dhe transparenca

Çfarë AI përdorim, ku ajo punon, dhe si ne përmbushim kërkesat e zbulimit (EU AI Act Article 50, efektive 2026-08-02).

TL;DR

  • Të gjitha transkriptat janë të krijuara nga AI, çdo rezultat ka një zbulim të lexueshme nga makina.
  • Të gjitha AI-të funksionojnë në GPU-në tonë. Ne nuk dërgojmë audion apo tekstin tuaj tek OpenAI, Anthropic, Google, apo ndonjë API të tretë LLM.
  • Ne nuk trajnojmë modelet bazë në transkriptat tuaja. Vetëm një rregullim i mirë përdor korrigjimet që ju bëni haptazi.
  • Klonet e zërit sintetik (TTS) janë të etiketuara qartë si të gjeneruara nga AI në emrin e file, metatë dhënat dhe në faqe.

Modelet që përdorim

ModeliPërdoret përLiçencaEkzekuto
Whisper large-v3-turbo (faster-whisper)Transkriptimi (i prezgjedhur)MITGPU jonë
STT.ai Enhanced (custom fine-tune)Transkriptim (plani i paguar)MIT (base) / Proprietary (fine-tune weights)GPU jonë
VoskFluksi i fjalëve në kohë realeApache 2.0GPU jonë
SpeechBrain ECAPA-TDNNDiarization SpeakerApache 2.0GPU jonë
MadLAD-400 3BPërkthim (450+ gjuhë)Apache 2.0GPU jonë
Qwen2.5-1.5B (llama.cpp)Përmbledhja, analiza, krijimi i përmbajtjes, biseda RAGApache 2.0GPU jonë
F5-TTSKlonimi i zërit / tekst-në-foljeMITGPU jonë
all-MiniLM-L6-v2KërkoApache 2.0GPU jonë

Ne nuk përdorim OpenAI, Anthropic, Google Cloud, apo ndonjë API të tretë LLM për ndonjë funksion. Çdo model i mësipërm funksionon në hardware që posedojmë dhe operojmë. Shërbimi i vetëm i jashtëm AI që përdorim është translateapi.ai (gjithashtu Muddy Holdings) për përkthimin e stringave të UI — kjo nuk prek kurrë përmbajtjen tuaj të transkriptuar.

Si e zbulojme gjeneraten e AI

  • Transkripto faqet HTML: përfshin <meta name=\
  • Eksporti i tekstit (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): përfshi një rresht të header 'AI-genered transcript' në krye të çdo file.
  • Zëri sintetik / TTS: File WAV përfshijnë një etiketë 'zëri sintetik' në metatë dhëna dhe një njoftim të qartë në faqen e shkarkimit. Një përjashtim i dëgjueshëm është në udhëzues.
  • Përgjigjet API: përfshi një fushë _ai_generated: true në çdo përgjigje JSON që përmban përmbajtje të transkriptuar.

Të dhëna trainimi

  • Modelet bazë (Whisper, MadLAD, Qwen, etj.) vijnë të paratrenuara nga botuesit e tyre respektivë. Ne i përdorim ato siç janë dërguar.
  • Transkriptat tuaja nuk përdoren për të trajnuar modelet bazë.
  • Nëse ju korrigjoni një segment të transkriptimit (ikona e lapit) ose e shënoni atë si të pakorrekt (ikona e flamurit), dhe ju keni zgjedhur në /privacy-settings/ (\
  • Më vete, butoni Kontribuo korrigjime plus audio tek Voice Lab (gjithashtu në /privacy-settings/, gjithashtu i ndaluar sipas prezgjedhjes) të lejon të kontribuosh audion e segmenteve që korrigjon, së bashku me tekstin e korrigjuar, tek dataset i Voice Lab nën CC-BY-SA-4.0. Të dyja këto butona janë të pavarur — mund të japësh njërin, të dytët ose asnjërin.
  • Audio që ngarkoni fshihet brenda 24 orëve nëpërmjet cron cleanup_uploads — NËSE nuk keni zgjedhur \

Saktësia dhe gabimet

Transkriptimi i AI nuk është i përsosur. Normat e gabimeve të fjalëve ndryshojnë sipas theksit të folësit, cilësisë së zërit, gjuhës dhe fjalorit të fushës. Për përdorim kritik (ligjor, mjekësor, industri të rregulluara) verifiko me zërin origjinal. Standardet tona publike WER për model janë në /models/.

Pyetja e përputhshmërisë

Për Aktin e AI të BE, GDPR, ose pyetje të tjera të përputhjes: hello@stt.ai ose përdor kontakti.

Përditësimi i fundit: 2026-04-26.