AI քաղաքականություն և թափանցիկություն
1999-ին թողարկվել է «Անհիշելի երգեր» ալբոմը, որը ճանաչվել է 2010 թվականի լավագույն ալբոմների ցանկում։ 2016-ին թողարկվել է «Անհիշելի երգեր» ալբոմը։
Տարբերակ
- Բոլոր տեքստեր ստեղծված են արհեստական բանականությամբ։ Յուրաքանչյուր ելք ունի մեքենագրված բացահայտում։
- Բոլոր AI-ները աշխատում են մեր սեփական GPU-ի վրա։ Մենք չենք ուղարկում ձեր ձայնը կամ տեքստը OpenAI, Anthropic, Google կամ որևէ այլ LLM API-ի։
- Մենք չենք սովորեցնում հիմնային մոդելները ձեր ձայնագրությունների վրա։ Միայն ընտրված մանրամասն կարգավորումը օգտագործում է ձեր կատարած ուղղումները։
- Սինթետիկ ձայնային կլոունները (TTS) ակնհայտորեն նշված են որպես AI-genered ֆայլի անվանումում, մետադատարկներում և էջում.
Մենք օգտագործում ենք հետևյալ մոդելները :
| մոդել | Օգտագործվում է | Լիցենզիա | Աշխատանք |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Տեղեկություն | MIT | Մեր GPU |
| STT.ai Enhanced (custom fine-tune) | Տեղեկագրություն (վճարովի պլաններ) | MIT (base) / Proprietary (fine-tune weights) | Մեր GPU |
| Vosk | Օգտագործել իրական ժամանակի լեզուների ալիքները | Apache 2.0 | Մեր GPU |
| SpeechBrain ECAPA-TDNN | Խոսողի դիարիզացիա | Apache 2.0 | Մեր GPU |
| MadLAD-400 3B | Թարգմանություն (450+ լեզուներ) | Apache 2.0 | Մեր GPU |
| Qwen2.5-1.5B (llama.cpp) | Համառոտում, վերլուծություն, բովանդակության ստեղծում, RAG զրույց | Apache 2.0 | Մեր GPU |
| F5-TTS | Ձայնի կլոնավորում / տեքստը խոսելու | MIT | Մեր GPU |
| all-MiniLM-L6-v2 | RAG որոնման ներկառուցվածքներ | Apache 2.0 | Մեր GPU |
Մենք չենք օգտագործում OpenAI, Anthropic, Google Cloud կամ որևէ այլ LLM API- ներ որևէ գործառույթի համար։ Ավելի վեր նշված բոլոր մոդելները աշխատում են մեր սեփական սարքավորումների վրա։ Մենք օգտագործում ենք միայն translateapi.ai (Muddy Holdings) արտաքին AI ծառայությունը UI տողերի թարգմանության համար՝ դա երբեք չի ազդում ձեր փոխանցված բովանդակության վրա։
Ինչպես ենք մենք բացահայտում արհեստական բանականության սերնդին :
- HTML էջերի թարգմանություն: ներառել <meta name=\
- Տեքստային արտահանում (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): ներառել 'AI-genered transcript' գլխամասային տողը յուրաքանչյուր ֆայլի վերևում
- Սինթեզացված ձայն / TTS արտահոսք: WAV ֆայլերը ներառում են մետա տվյալներում «synthetic-voice» պիտակ և պարզ տեղեկատվություն ներբեռնման էջում։ Առաջարկվող ճանապարհային քարտեզում ձայնային արգելափակում է։
- API պատասխաններ: ներառել _ai_generated: true դաշտը յուրաքանչյուր JSON պատասխանում, որը պարունակում է թարգմանված բովանդակություն։
Հաշվետվություն
- Բնական մոդելները (Whisper, MadLAD, Qwen և այլն) նախապատրաստված են իրենց հեղինակների կողմից։ Մենք օգտագործում ենք դրանք, ինչպես դրանք հասնում են մեզ։
- Ձեր տեքստը չի օգտագործվում մոդելների պատրաստման համար։
- Եթե դուք ճշգրտում եք տեքստի մի հատված (դեղին մատանի պատկերակը) կամ նշում եք այն որպես սխալ (դրոշ պատկերակը), ԵՎ դուք ընտրել եք / privacy- settings / (\
- Առանձին, «Կարող եք ներգրավել ճշգրտումներ և ձայնային տվյալներ Voice Lab-ի համար» մուտքագրման կոճակը (որը գտնվում է /privacy-settings/-ում, և ըստ էության անջատված է) թույլ է տալիս ձեզ ներգրավել ձեր ճշգրտած հատվածների ձայնային տվյալները, որոնք միասին են ճշգրտված տեքստի հետ, մեր Voice Lab տվյալների հավաքի մեջ CC-BY-SA-4.0-ի համաձայն։ Այս երկու մուտքագրումները անկախ են, դուք կարող եք դրանք տալ կամ մեկը, կամ երկուսը, կամ ոչ մեկը։
- Ձեր տեղադրած ձայնային ֆայլերը 24 ժամվա ընթացքում անհետանում են cleanup_uploads cron-ի միջոցով — եթե դուք չեք ընտրել\
Պարզություն և սխալներ
AI- ի փոխանցումը կատարյալ չէ։ Սխալների տոկոսները տարբերվում են ըստ խոսողի ակցենտ, ձայնի որակի, լեզվի և լեզվաբանական ոլորտի։ Կրկնօրինակման համար (օրինակ՝ իրավաբանական, բժշկական, կարգավորված արդյունաբերություն) ստուգեք սկզբնական ձայնը։ Մեր հանրային WER- ի մոդելի համար արժեքները գտնվում են՝ /models/.
Պատասխանատու հարցեր
Եվրոպական միության AI Act, GDPR կամ այլ համաձայնեցված հարցերի համար՝ hello@stt.ai կամ օգտագործեք կապի ձև.
Վերջին թարմացումը 2026-04-26.