AI stefna og gagnsæi
Hvaða gervigreind við notum, hvar hún keyrir og hvernig við uppfyllum kröfur um birtingu (50. grein laga ESB um gervigreind, gildir frá 2026-08-02).
TL; DR
- Öll afritunarverk eru búin til af gervigreind. Hver framleiđsla ber vél-lesanlega birtingu.
- Öll AI keyrir á eigin GPU okkar.Við sendum EKKI hljóð eða texta til OpenAI, Anthropic, Google eða þriðja aðila LLM API.
- Við þjálfum EKKI grunnlíkön á afritunum þínum. Aðeins opt-in fínstilling notar leiðréttingar sem þú gerir sérstaklega.
- Tilbúnar raddklónur (TTS) eru greinilega merktar sem AI-myndaðar í skráarheiti, lýsigögn og á síðunni.
Líkön sem við notum
| Tegund | Notað fyrir | Leyfi | Keyrir á |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Uppskrift (sjálfgefið) | MIT | GPU okkar |
| STT.ai Enhanced (custom fine-tune) | Uppskrift (greidd áætlanir) | MIT (base) / Proprietary (fine-tune weights) | GPU okkar |
| Vosk | Rauntíma orð straumspilun | Apache 2.0 | GPU okkar |
| SpeechBrain ECAPA-TDNN | Hátalari diarization | Apache 2.0 | GPU okkar |
| MadLAD-400 3B | Þýðing (450+ tungumál) | Apache 2.0 | GPU okkar |
| Qwen2.5-1.5B (llama.cpp) | Samantekt, greining, efni kynslóð, RAG spjall | Apache 2.0 | GPU okkar |
| F5-TTS | Voice klónun / texti-til-tal | MIT | GPU okkar |
| all-MiniLM-L6-v2 | Embeddings for RAG search | Apache 2.0 | GPU okkar |
Við köllum ekki OpenAI, Anthropic, Google Cloud eða þriðja aðila LLM API fyrir hvaða eiginleika sem er. Sérhver líkan hér að ofan keyrir á vélbúnaði sem við eigum og starfrækjum. Eina ytri AI þjónustan sem við notum er translateapi.ai (einnig Muddy Holdings) til að þýða UI strengi - þetta snertir aldrei afritunarefni þitt.
Hvernig við birtum AI kynslóð
- Afrita HTML síður: include <meta name=\
- Textaflutningur (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Hafa 'AI-myndað afritunar' haus línu efst á hverri skrá.
- Syntetic rödd / TTS framleiðsla: WAV skrár innihalda'syntetic-voice' tag í lýsigögn og skýr tilkynning á niðurhalssíðunni. Audible fyrirvari er á vegvísi.
- API svör: innihalda _ai_generated: true reit í hverju JSON svari sem inniheldur afrituð efni.
Þjálfunargögn
- Grunnlíkön (Whisper, MadLAD, Qwen, osfrv.) Koma fyrirþjálfaðir frá viðkomandi útgefendum. Við notum þau eins og þau eru send.
- Uppskriftir þínar eru EKKI notaðar til að þjálfa grunnlíkön.
- Ef þú leiðréttir hluta af uppskrift (blýantstáknið) eða merkir hann sem rangan (flaggatáknið) OG þú hefur valið að skrá þig inn á /privacy-settings/ (\
- Að auki geturðu valið að senda hljóð úr þeim hlutum sem þú leiðréttir, ásamt leiðréttum texta, í Voice Lab gagnagrunninn okkar undir CC-BY-SA-4.0 með því að nota valmöguleikann „Bæta við leiðréttingum auk hljóðs í Voice Lab“ (sem er einnig að finna í /privacy-settings/ og sjálfgefið er slökkt á honum).
- Hljóð sem þú hleður upp er eytt innan 24 klukkustunda með cleanup_uploads cron — NEMA þú hafir valið að \
Nákvæmni og villur
AI uppskrift er ekki fullkomin. Orðvilla er breytileg eftir hátalara hreim, hljóðgæði, tungumál og lén orðaforða. Fyrir mikilvæga notkun (lögfræðileg, læknisfræðileg, stjórnað atvinnugreinum) staðfesta gegn upprunalegu hljóðinu. /models/.
Spurningar um samræmi
Fyrir ESB AI lög, GDPR, eða aðrar spurningar um samræmi: hello@stt.ai Eða notaðu Hafðu samband við okkur.
Síðast uppfært: 2026-04-26.