AI ਨੀਤੀ ਅਤੇ ਪਾਰਦਰਸ਼ਤਾ
ਅਸੀਂ ਕਿਹੜੀ ਐੱਮਆਈ ਦੀ ਵਰਤੋਂ ਕਰਦੇ ਹਾਂ, ਇਹ ਕਿੱਥੇ ਚੱਲਦੀ ਹੈ ਅਤੇ ਅਸੀਂ ਖੁਲਾਸਾ ਦੀਆਂ ਜ਼ਰੂਰਤਾਂ (ਯੂਰਪੀ ਯੂਨੀਅਨ ਐੱਮਆਈ ਐਕਟ, ਧਾਰਾ 50, 2026-08-02 ਤੱਕ ਲਾਗੂ) ਦਾ ਪਾਲਣ ਕਿਵੇਂ ਕਰਦੇ ਹਾਂ।
TL; DR
- ਸਭ ਟਰਾਂਸਕਰੀਪਸ਼ਨ AI- ਬਣਾਈ ਗਈ ਹੈ । ਹਰ ਆਉਟਪੁੱਟ ਇੱਕ ਮਸ਼ੀਨ- ਪੜ੍ਹਨਯੋਗ ਖੁਲਾਸਾ ਲੈਂਦਾ ਹੈ ।
- ਸਭ AI ਸਾਡੇ ਆਪਣੇ GPU ਉੱਤੇ ਚੱਲਦਾ ਹੈ। ਅਸੀਂ ਤੁਹਾਡੀ ਆਡੀਓ ਜਾਂ ਟੈਕਸਟ OpenAI, Anthropic, Google, ਜਾਂ ਕਿਸੇ ਤੀਜੀ-ਧਿਰ LLM API ਨੂੰ ਨਹੀਂ ਭੇਜਦੇ।
- ਅਸੀਂ ਤੁਹਾਡੇ ਟਰਾਂਸਕਰੀਪਟ ਉੱਤੇ ਬੇਸ ਮਾਡਲ ਨਹੀਂ ਟਰੇਨ ਕਰਦੇ ਹਾਂ । ਸਿਰਫ ਇੱਕ ਚੋਣ- ਵਿੱਚ ਫਾਈਨ- ਟੂਨ ਹੀ ਸਹੀ ਕਰਨ ਲਈ ਵਰਤਦਾ ਹੈ, ਜੋ ਕਿ ਤੁਸੀਂ ਸਪੱਸ਼ਟ ਤੌਰ ਉੱਤੇ ਕਰਦੇ ਹੋ ।
- ਸਿੰਥੈਟਿਕ ਬੋਲੀ ਕਲੋਨ (TTS) ਨੂੰ ਫਾਇਲ ਨਾਂ, ਮੇਟਾਡਾਟਾ ਅਤੇ ਸਫ਼ੇ ਉੱਤੇ AI- ਬਣਾਇਆ ਵਜੋਂ ਸਪੱਸ਼ਟ ਤੌਰ ਉੱਤੇ ਲੇਬਲ ਕੀਤਾ ਜਾਂਦਾ ਹੈ ।
ਅਸੀਂ ਵਰਤੇ ਮਾਡਲ
| ਮਾਡਲ | ਇਸ ਲਈ ਵਰਤਿਆ | ਲਾਈਸੈਂਸ | ਚੱਲਦਾ ਹੈ |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | ਟਰਾਂਸਲੇਸ਼ਨ (ਮੂਲ) | MIT | ਸਾਡਾ GPU |
| STT.ai Enhanced (custom fine-tune) | ਟਰਾਂਸਕਰੀਪਸ਼ਨ (ਪੈਡ ਪਲਾਨ) | MIT (base) / Proprietary (fine-tune weights) | ਸਾਡਾ GPU |
| Vosk | ਰੀਅਲ-ਟਾਈਮ ਸ਼ਬਦ ਸਟਰੀਮਿੰਗ | Apache 2.0 | ਸਾਡਾ GPU |
| SpeechBrain ECAPA-TDNN | ਸਪੀਕਰ ਡਾਇਰੀਜ਼ੇਸ਼ਨ | Apache 2.0 | ਸਾਡਾ GPU |
| MadLAD-400 3B | ਅਨੁਵਾਦ (450+ ਭਾਸ਼ਾਵਾਂ) | Apache 2.0 | ਸਾਡਾ GPU |
| Qwen2.5-1.5B (llama.cpp) | ਸੰਖੇਪ, ਵਿਸ਼ਲੇਸ਼ਣ, ਸਮੱਗਰੀ ਨਿਰਮਾਣ, RAG ਗੱਲਬਾਤ | Apache 2.0 | ਸਾਡਾ GPU |
| F5-TTS | ਬੋਲੀ ਕਲੋਨਿੰਗ / ਪਾਠ- ਤੋਂ- ਬੋਲੀ | MIT | ਸਾਡਾ GPU |
| all-MiniLM-L6-v2 | RAG ਖੋਜ ਲਈ ਇੰਬੈੱਡਿੰਗ | Apache 2.0 | ਸਾਡਾ GPU |
ਅਸੀਂ ਕਿਸੇ ਵੀ ਫੀਚਰ ਲਈ OpenAI, Anthropic, Google Cloud, ਜਾਂ ਕਿਸੇ ਵੀ ਤੀਜੀ- ਧਿਰ LLM API ਨੂੰ ਨਹੀਂ ਬੁਲਾਉਂਦੇ ਹਾਂ। ਉੱਪਰਲੇ ਹਰੇਕ ਮਾਡਲ ਸਾਡੇ ਹਾਰਡਵੇਅਰ ਉੱਤੇ ਚੱਲਦਾ ਹੈ ਅਤੇ ਅਸੀਂ ਇਸ ਨੂੰ ਚਲਾਉਂਦੇ ਹਾਂ। ਸਿਰਫ ਬਾਹਰੀ AI ਸੇਵਾ ਜੋ ਅਸੀਂ ਵਰਤਦੇ ਹਾਂ translateapi.ai (Muddy Holdings ਵੀ) UI ਸਤਰ ਦਾ ਅਨੁਵਾਦ ਕਰਨ ਲਈ ਹੈ - ਇਹ ਤੁਹਾਡੀ ਟਰਾਂਸਕਰੀਪਟ ਸਮੱਗਰੀ ਨੂੰ ਕਦੇ ਨਹੀਂ ਛੂਹਦਾ ਹੈ।
ਅਸੀਂ ਐੱਮਆਈ ਜਨਰੇਸ਼ਨ ਨੂੰ ਕਿਵੇਂ ਪੇਸ਼ ਕਰਦੇ ਹਾਂ
- HTML ਸਫ਼ੇ ਟਰਾਂਸਕਰੀਪਟ: < meta name=\ ਸ਼ਾਮਲ
- ਟੈਕਸਟ ਐਕਸਪੋਰਟ (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): ਹਰੇਕ ਫਾਇਲ ਦੇ ਉੱਤੇ 'AI- ਬਣਾਈ ਟਰਾਂਸਕਰੀਪਟ' ਹੈੱਡਰ ਲਾਈਨ ਸ਼ਾਮਲ ਕਰੋ ।
- ਸੰਸਲੇਸ਼ਣ ਬੋਲੀ / TTS ਆਉਟਪੁੱਟ: WAV ਫਾਇਲਾਂ ਵਿੱਚ ਮੈਟਾਡਾਟਾ ਵਿੱਚ 'ਸਿੰਥੈਟਿਕ-ਵਾਇਸ' ਟੈਗ ਅਤੇ ਡਾਊਨਲੋਡ ਪੇਜ਼ ਉੱਤੇ ਇੱਕ ਸਪੱਸ਼ਟ ਨੋਟਿਸ ਸ਼ਾਮਲ ਹੈ । ਸੁਣਨਯੋਗ ਨਾਂਹ-ਪੱਖਤਾ ਰੋਡਮੈਪ ਉੱਤੇ ਹੈ ।
- API ਜਵਾਬ: ਹਰੇਕ JSON ਜਵਾਬ ਵਿੱਚ ਇੱਕ _ai_generated: true ਖੇਤਰ ਸ਼ਾਮਲ ਕਰੋ, ਜਿਸ ਵਿੱਚ ਤਬਦੀਲ ਸਮੱਗਰੀ ਹੈ।
ਟਰੇਨਿੰਗ ਡਾਟਾ
- ਬੇਸ ਮਾਡਲ (Whisper, MadLAD, Qwen, ਆਦਿ) ਆਪਣੇ ਸੰਬੰਧਿਤ ਪਬਲਿਸ਼ਰ ਤੋਂ ਪਹਿਲਾਂ- ਟਰੇਨ ਕੀਤੇ ਆਏ ਹਨ । ਅਸੀਂ ਉਹਨਾਂ ਨੂੰ ਜਿਵੇਂ- ਕਿ- ਸ਼ਿਪ ਕੀਤੇ ਵਰਤਦੇ ਹਾਂ ।
- ਤੁਹਾਡੀਆਂ ਟਰਾਂਸਕਰੀਪਟਾਂ ਬੇਸ ਮਾਡਲ ਟਰੇਨ ਕਰਨ ਲਈ ਵਰਤੀਆਂ ਨਹੀਂ ਜਾਂਦੀਆਂ ਹਨ ।
- ਜੇਕਰ ਤੁਸੀਂ ਇੱਕ ਟਰਾਂਸਕਰੀਪਟ ਸੈਗਮੈਂਟ (ਪੈਂਚ ਆਈਕਾਨ) ਨੂੰ ਸੋਧਿਆ ਜਾਂ ਗਲਤ ਮਾਰਕ ਕੀਤਾ (ਫਲੈਗ ਆਈਕਾਨ), ਅਤੇ ਤੁਸੀਂ / privacy- settings / (\ t) ਵਿੱਚ ਚੁਣਿਆ ਹੈ
- ਵੱਖਰੇ ਤੌਰ ਉੱਤੇ, ਵਾਇਸ ਲੈਬ ਲਈ ਸੁਧਾਰਾਂ ਅਤੇ ਆਡੀਓ ਦਾ ਯੋਗਦਾਨ (/privacy-settings/ ਉੱਤੇ ਵੀ, ਡਿਫਾਲਟ ਬੰਦ) ਤੁਹਾਨੂੰ CC-BY-SA-4.0 ਅਧੀਨ ਸਾਡੇ ਵਾਇਸ ਲੈਬ ਡਾਟਾਸੈੱਟ ਵਿੱਚ ਸੁਧਾਰੇ ਗਏ ਪਾਠ ਦੇ ਨਾਲ ਜੋੜ ਕੇ, ਤੁਸੀਂ ਜੋੜਿਆ ਸੈਗਮੈਂਟਾਂ ਦਾ ਆਡੀਓ ਯੋਗਦਾਨ ਦੇਣ ਲਈ ਚੁਣਦਾ ਹੈ। ਦੋਵੇਂ ਟੋਗਲ ਅਲੱਗ ਹਨ - ਤੁਸੀਂ ਕਿਸੇ ਨੂੰ ਵੀ, ਦੋਵਾਂ ਨੂੰ ਜਾਂ ਕਿਸੇ ਨੂੰ ਵੀ ਨਹੀਂ ਦੇ ਸਕਦੇ ਹੋ।
- ਆਡੀਓ, ਜੋ ਤੁਸੀਂ ਅੱਪਲੋਡ ਕੀਤਾ ਹੈ, ਨੂੰ cleanup_ uploads cron ਰਾਹੀਂ 24 ਘੰਟਿਆਂ ਵਿੱਚ ਹਟਾ ਦਿੱਤਾ ਜਾਵੇਗਾ - ਜੇ ਤੁਸੀਂ ਇਸ ਨੂੰ ਚੁਣਿਆ ਨਹੀਂ ਹੈ\
ਸਹੀਤਾ ਅਤੇ ਗਲਤੀਆਂ
AI ਟਰਾਂਸਲੇਸ਼ਨ ਸੰਪੂਰਨ ਨਹੀਂ ਹੈ । ਸ਼ਬਦ ਗਲਤੀ ਦਰ ਸਪੀਕਰ ਅਵਾਜ਼, ਆਡੀਓ ਕੁਆਲਟੀ, ਭਾਸ਼ਾ ਅਤੇ ਡੋਮੇਨ ਸ਼ਬਦ- ਕੋਸ਼ ਦੇ ਅਧਾਰ ਤੇ ਵੱਖਰੀ ਹੈ । ਗੰਭੀਰ ਵਰਤੋਂ (ਕਾਨੂੰਨੀ, ਮੈਡੀਕਲ, ਨਿਯਮਤ ਉਦਯੋਗ) ਲਈ ਅਸਲੀ ਆਡੀਓ ਨਾਲ ਤੁਲਨਾ ਕਰੋ । ਸਾਡੇ ਪਬਲਿਕ WER ਬੈਂਕਮਾਰਕ ਪ੍ਰਤੀ ਮਾਡਲ ਹਨ /models/.
ਅਨੁਕੂਲਤਾ ਸਵਾਲ
ਯੂਰਪੀਅਨ ਯੂਨੀਅਨ ਐੱਨਆਈ ਐਕਟ, ਜੀਡੀਪੀਆਰ ਜਾਂ ਹੋਰ ਸਹਿਯੋਗ ਸਵਾਲਾਂ ਲਈ: hello@stt.ai ਜਾਂ ਵਰਤੋਂ ਸੰਪਰਕ ਫਾਰਮ.
ਆਖਰੀ ਅੱਪਡੇਟ: 2026-04-26.