AI ਨੀਤੀ ਅਤੇ ਪਾਰਦਰਸ਼ਤਾ

ਅਸੀਂ ਕਿਹੜੀ ਐੱਮਆਈ ਦੀ ਵਰਤੋਂ ਕਰਦੇ ਹਾਂ, ਇਹ ਕਿੱਥੇ ਚੱਲਦੀ ਹੈ ਅਤੇ ਅਸੀਂ ਖੁਲਾਸਾ ਦੀਆਂ ਜ਼ਰੂਰਤਾਂ (ਯੂਰਪੀ ਯੂਨੀਅਨ ਐੱਮਆਈ ਐਕਟ, ਧਾਰਾ 50, 2026-08-02 ਤੱਕ ਲਾਗੂ) ਦਾ ਪਾਲਣ ਕਿਵੇਂ ਕਰਦੇ ਹਾਂ।

TL; DR

  • ਸਭ ਟਰਾਂਸਕਰੀਪਸ਼ਨ AI- ਬਣਾਈ ਗਈ ਹੈ । ਹਰ ਆਉਟਪੁੱਟ ਇੱਕ ਮਸ਼ੀਨ- ਪੜ੍ਹਨਯੋਗ ਖੁਲਾਸਾ ਲੈਂਦਾ ਹੈ ।
  • ਸਭ AI ਸਾਡੇ ਆਪਣੇ GPU ਉੱਤੇ ਚੱਲਦਾ ਹੈ। ਅਸੀਂ ਤੁਹਾਡੀ ਆਡੀਓ ਜਾਂ ਟੈਕਸਟ OpenAI, Anthropic, Google, ਜਾਂ ਕਿਸੇ ਤੀਜੀ-ਧਿਰ LLM API ਨੂੰ ਨਹੀਂ ਭੇਜਦੇ।
  • ਅਸੀਂ ਤੁਹਾਡੇ ਟਰਾਂਸਕਰੀਪਟ ਉੱਤੇ ਬੇਸ ਮਾਡਲ ਨਹੀਂ ਟਰੇਨ ਕਰਦੇ ਹਾਂ । ਸਿਰਫ ਇੱਕ ਚੋਣ- ਵਿੱਚ ਫਾਈਨ- ਟੂਨ ਹੀ ਸਹੀ ਕਰਨ ਲਈ ਵਰਤਦਾ ਹੈ, ਜੋ ਕਿ ਤੁਸੀਂ ਸਪੱਸ਼ਟ ਤੌਰ ਉੱਤੇ ਕਰਦੇ ਹੋ ।
  • ਸਿੰਥੈਟਿਕ ਬੋਲੀ ਕਲੋਨ (TTS) ਨੂੰ ਫਾਇਲ ਨਾਂ, ਮੇਟਾਡਾਟਾ ਅਤੇ ਸਫ਼ੇ ਉੱਤੇ AI- ਬਣਾਇਆ ਵਜੋਂ ਸਪੱਸ਼ਟ ਤੌਰ ਉੱਤੇ ਲੇਬਲ ਕੀਤਾ ਜਾਂਦਾ ਹੈ ।

ਅਸੀਂ ਵਰਤੇ ਮਾਡਲ

ਮਾਡਲਇਸ ਲਈ ਵਰਤਿਆਲਾਈਸੈਂਸਚੱਲਦਾ ਹੈ
Whisper large-v3-turbo (faster-whisper)ਟਰਾਂਸਲੇਸ਼ਨ (ਮੂਲ)MITਸਾਡਾ GPU
STT.ai Enhanced (custom fine-tune)ਟਰਾਂਸਕਰੀਪਸ਼ਨ (ਪੈਡ ਪਲਾਨ)MIT (base) / Proprietary (fine-tune weights)ਸਾਡਾ GPU
Voskਰੀਅਲ-ਟਾਈਮ ਸ਼ਬਦ ਸਟਰੀਮਿੰਗApache 2.0ਸਾਡਾ GPU
SpeechBrain ECAPA-TDNNਸਪੀਕਰ ਡਾਇਰੀਜ਼ੇਸ਼ਨApache 2.0ਸਾਡਾ GPU
MadLAD-400 3Bਅਨੁਵਾਦ (450+ ਭਾਸ਼ਾਵਾਂ)Apache 2.0ਸਾਡਾ GPU
Qwen2.5-1.5B (llama.cpp)ਸੰਖੇਪ, ਵਿਸ਼ਲੇਸ਼ਣ, ਸਮੱਗਰੀ ਨਿਰਮਾਣ, RAG ਗੱਲਬਾਤApache 2.0ਸਾਡਾ GPU
F5-TTSਬੋਲੀ ਕਲੋਨਿੰਗ / ਪਾਠ- ਤੋਂ- ਬੋਲੀMITਸਾਡਾ GPU
all-MiniLM-L6-v2RAG ਖੋਜ ਲਈ ਇੰਬੈੱਡਿੰਗApache 2.0ਸਾਡਾ GPU

ਅਸੀਂ ਕਿਸੇ ਵੀ ਫੀਚਰ ਲਈ OpenAI, Anthropic, Google Cloud, ਜਾਂ ਕਿਸੇ ਵੀ ਤੀਜੀ- ਧਿਰ LLM API ਨੂੰ ਨਹੀਂ ਬੁਲਾਉਂਦੇ ਹਾਂ। ਉੱਪਰਲੇ ਹਰੇਕ ਮਾਡਲ ਸਾਡੇ ਹਾਰਡਵੇਅਰ ਉੱਤੇ ਚੱਲਦਾ ਹੈ ਅਤੇ ਅਸੀਂ ਇਸ ਨੂੰ ਚਲਾਉਂਦੇ ਹਾਂ। ਸਿਰਫ ਬਾਹਰੀ AI ਸੇਵਾ ਜੋ ਅਸੀਂ ਵਰਤਦੇ ਹਾਂ translateapi.ai (Muddy Holdings ਵੀ) UI ਸਤਰ ਦਾ ਅਨੁਵਾਦ ਕਰਨ ਲਈ ਹੈ - ਇਹ ਤੁਹਾਡੀ ਟਰਾਂਸਕਰੀਪਟ ਸਮੱਗਰੀ ਨੂੰ ਕਦੇ ਨਹੀਂ ਛੂਹਦਾ ਹੈ।

ਅਸੀਂ ਐੱਮਆਈ ਜਨਰੇਸ਼ਨ ਨੂੰ ਕਿਵੇਂ ਪੇਸ਼ ਕਰਦੇ ਹਾਂ

  • HTML ਸਫ਼ੇ ਟਰਾਂਸਕਰੀਪਟ: < meta name=\ ਸ਼ਾਮਲ
  • ਟੈਕਸਟ ਐਕਸਪੋਰਟ (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): ਹਰੇਕ ਫਾਇਲ ਦੇ ਉੱਤੇ 'AI- ਬਣਾਈ ਟਰਾਂਸਕਰੀਪਟ' ਹੈੱਡਰ ਲਾਈਨ ਸ਼ਾਮਲ ਕਰੋ ।
  • ਸੰਸਲੇਸ਼ਣ ਬੋਲੀ / TTS ਆਉਟਪੁੱਟ: WAV ਫਾਇਲਾਂ ਵਿੱਚ ਮੈਟਾਡਾਟਾ ਵਿੱਚ 'ਸਿੰਥੈਟਿਕ-ਵਾਇਸ' ਟੈਗ ਅਤੇ ਡਾਊਨਲੋਡ ਪੇਜ਼ ਉੱਤੇ ਇੱਕ ਸਪੱਸ਼ਟ ਨੋਟਿਸ ਸ਼ਾਮਲ ਹੈ । ਸੁਣਨਯੋਗ ਨਾਂਹ-ਪੱਖਤਾ ਰੋਡਮੈਪ ਉੱਤੇ ਹੈ ।
  • API ਜਵਾਬ: ਹਰੇਕ JSON ਜਵਾਬ ਵਿੱਚ ਇੱਕ _ai_generated: true ਖੇਤਰ ਸ਼ਾਮਲ ਕਰੋ, ਜਿਸ ਵਿੱਚ ਤਬਦੀਲ ਸਮੱਗਰੀ ਹੈ।

ਟਰੇਨਿੰਗ ਡਾਟਾ

  • ਬੇਸ ਮਾਡਲ (Whisper, MadLAD, Qwen, ਆਦਿ) ਆਪਣੇ ਸੰਬੰਧਿਤ ਪਬਲਿਸ਼ਰ ਤੋਂ ਪਹਿਲਾਂ- ਟਰੇਨ ਕੀਤੇ ਆਏ ਹਨ । ਅਸੀਂ ਉਹਨਾਂ ਨੂੰ ਜਿਵੇਂ- ਕਿ- ਸ਼ਿਪ ਕੀਤੇ ਵਰਤਦੇ ਹਾਂ ।
  • ਤੁਹਾਡੀਆਂ ਟਰਾਂਸਕਰੀਪਟਾਂ ਬੇਸ ਮਾਡਲ ਟਰੇਨ ਕਰਨ ਲਈ ਵਰਤੀਆਂ ਨਹੀਂ ਜਾਂਦੀਆਂ ਹਨ ।
  • ਜੇਕਰ ਤੁਸੀਂ ਇੱਕ ਟਰਾਂਸਕਰੀਪਟ ਸੈਗਮੈਂਟ (ਪੈਂਚ ਆਈਕਾਨ) ਨੂੰ ਸੋਧਿਆ ਜਾਂ ਗਲਤ ਮਾਰਕ ਕੀਤਾ (ਫਲੈਗ ਆਈਕਾਨ), ਅਤੇ ਤੁਸੀਂ / privacy- settings / (\ t) ਵਿੱਚ ਚੁਣਿਆ ਹੈ
  • ਵੱਖਰੇ ਤੌਰ ਉੱਤੇ, ਵਾਇਸ ਲੈਬ ਲਈ ਸੁਧਾਰਾਂ ਅਤੇ ਆਡੀਓ ਦਾ ਯੋਗਦਾਨ (/privacy-settings/ ਉੱਤੇ ਵੀ, ਡਿਫਾਲਟ ਬੰਦ) ਤੁਹਾਨੂੰ CC-BY-SA-4.0 ਅਧੀਨ ਸਾਡੇ ਵਾਇਸ ਲੈਬ ਡਾਟਾਸੈੱਟ ਵਿੱਚ ਸੁਧਾਰੇ ਗਏ ਪਾਠ ਦੇ ਨਾਲ ਜੋੜ ਕੇ, ਤੁਸੀਂ ਜੋੜਿਆ ਸੈਗਮੈਂਟਾਂ ਦਾ ਆਡੀਓ ਯੋਗਦਾਨ ਦੇਣ ਲਈ ਚੁਣਦਾ ਹੈ। ਦੋਵੇਂ ਟੋਗਲ ਅਲੱਗ ਹਨ - ਤੁਸੀਂ ਕਿਸੇ ਨੂੰ ਵੀ, ਦੋਵਾਂ ਨੂੰ ਜਾਂ ਕਿਸੇ ਨੂੰ ਵੀ ਨਹੀਂ ਦੇ ਸਕਦੇ ਹੋ।
  • ਆਡੀਓ, ਜੋ ਤੁਸੀਂ ਅੱਪਲੋਡ ਕੀਤਾ ਹੈ, ਨੂੰ cleanup_ uploads cron ਰਾਹੀਂ 24 ਘੰਟਿਆਂ ਵਿੱਚ ਹਟਾ ਦਿੱਤਾ ਜਾਵੇਗਾ - ਜੇ ਤੁਸੀਂ ਇਸ ਨੂੰ ਚੁਣਿਆ ਨਹੀਂ ਹੈ\

ਸਹੀਤਾ ਅਤੇ ਗਲਤੀਆਂ

AI ਟਰਾਂਸਲੇਸ਼ਨ ਸੰਪੂਰਨ ਨਹੀਂ ਹੈ । ਸ਼ਬਦ ਗਲਤੀ ਦਰ ਸਪੀਕਰ ਅਵਾਜ਼, ਆਡੀਓ ਕੁਆਲਟੀ, ਭਾਸ਼ਾ ਅਤੇ ਡੋਮੇਨ ਸ਼ਬਦ- ਕੋਸ਼ ਦੇ ਅਧਾਰ ਤੇ ਵੱਖਰੀ ਹੈ । ਗੰਭੀਰ ਵਰਤੋਂ (ਕਾਨੂੰਨੀ, ਮੈਡੀਕਲ, ਨਿਯਮਤ ਉਦਯੋਗ) ਲਈ ਅਸਲੀ ਆਡੀਓ ਨਾਲ ਤੁਲਨਾ ਕਰੋ । ਸਾਡੇ ਪਬਲਿਕ WER ਬੈਂਕਮਾਰਕ ਪ੍ਰਤੀ ਮਾਡਲ ਹਨ /models/.

ਅਨੁਕੂਲਤਾ ਸਵਾਲ

ਯੂਰਪੀਅਨ ਯੂਨੀਅਨ ਐੱਨਆਈ ਐਕਟ, ਜੀਡੀਪੀਆਰ ਜਾਂ ਹੋਰ ਸਹਿਯੋਗ ਸਵਾਲਾਂ ਲਈ: hello@stt.ai ਜਾਂ ਵਰਤੋਂ ਸੰਪਰਕ ਫਾਰਮ.

ਆਖਰੀ ਅੱਪਡੇਟ: 2026-04-26.