AI নীতিমালা এবং স্বচ্ছতা
আমরা কোন ধরনের এআই ব্যবহার করি, কোথায় এটি চালানো হয় এবং আমরা কিভাবে প্রকাশের প্রয়োজনীয়তা মেনে চলব (ইইউ এআই আইনের ৫০ নম্বর ধারা, কার্যকর ২০২৬-০৮-০২)।
ট্যাব
- সব ট্রান্সক্রিপশন AI-এর দ্বারা তৈরি করা হয়েছে। প্রত্যেকটি আউটপুট মেশিন-পড়ার উপযোগী তথ্য বহন করে।
- সব AI আমাদের নিজের GPU-তে চলে। আমরা আপনার অডিও বা টেক্সট OpenAI, Anthropic, Google, বা অন্য কোন তৃতীয় পক্ষের LLM API-তে পাঠাই না।
- আমরা আপনার ট্রান্সক্রিপশনের উপর ভিত্তি মডেল প্রশিক্ষণ না. শুধু একটি অপশন-এ ফিন-টুন ব্যবহার করে সংশোধন আপনি স্পষ্টভাবে করা.
- ফাইলের নাম, মেটাডাটা এবং পাতায় স্পষ্টভাবে সিনথেটিক ভয়েস ক্লোন (টিটিএস)-এর লেবেল দেয়া হয়েছে যে এআই-এর দ্বারা তৈরি।
আমরা যে মডেল ব্যবহার করি
| মডেল | এর জন্য ব্যবহৃত | লাইসেন্স | চলছে |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | অনুবাদ (ডিফল্ট) | MIT | আমাদের GPU |
| STT.ai Enhanced (custom fine-tune) | অনুবাদ (পয়সা পরিশোধিত পরিকল্পনা) | MIT (base) / Proprietary (fine-tune weights) | আমাদের GPU |
| Vosk | বাস্তব-সময়ের শব্দ স্ট্রিমিং | Apache 2.0 | আমাদের GPU |
| SpeechBrain ECAPA-TDNN | স্পিকার ডায়ারিজম | Apache 2.0 | আমাদের GPU |
| MadLAD-400 3B | অনুবাদ (৪৫০+ ভাষা) | Apache 2.0 | আমাদের GPU |
| Qwen2.5-1.5B (llama.cpp) | সারসংক্ষেপ, বিশ্লেষণ, বিষয়বস্তু উৎপাদন, RAG চ্যাট | Apache 2.0 | আমাদের GPU |
| F5-TTS | শব্দ ক্লোন / টেক্সট-টু-স্পিকিং | MIT | আমাদের GPU |
| all-MiniLM-L6-v2 | RAG অনুসন্ধানের জন্য অন্তর্ভুক্ত করা হয়েছে | Apache 2.0 | আমাদের GPU |
আমরা কোন বৈশিষ্ট্যের জন্য ওপেনএআই, অ্যানথ্রোপিক, গুগল ক্লাউড, বা অন্য কোন তৃতীয় পক্ষের এলএলএম এপিআই ব্যবহার করি না। উপরের প্রতিটি মডেল আমাদের মালিকানাধীন হার্ডওয়্যারের উপর চালিত হয় এবং আমরা এটি পরিচালনা করি। আমরা যে একমাত্র বহিরাগত এআই সার্ভিস ব্যবহার করি তা হচ্ছে ট্রান্সলেটএপি.
আমরা কিভাবে AI প্রজন্ম প্রকাশ করি
- HTML পাতা অনুবাদ করুন: অন্তর্ভুক্ত করো <meta name=\
- টেক্সট রপ্তানি (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): প্রত্যেক ফাইলের উপরে একটি 'AI-generated transcript' শীর্ষচরণ লাইন অন্তর্ভুক্ত করুন।
- সিনথেটিক ভয়েস / TTS আউটপুট: WAV ফাইল মেটাডাটাতে'synthesized-voice' ট্যাগ এবং ডাউনলোড পাতায় একটি স্পষ্ট নোটিশ অন্তর্ভুক্ত করে। অডিবল ডিসগ্রেডিং রোডম্যাপ-এ রয়েছে।
- API প্রতিক্রিয়া: প্রত্যেক JSON প্রতিক্রিয়ায় একটি _ai_generated: true ক্ষেত্র অন্তর্ভুক্ত করা হবে যা অনুবাদকৃত বিষয়বস্তু অন্তর্ভুক্ত করে।
প্রশিক্ষণ তথ্য
- বেস মডেল (Whisper, MadLAD, Qwen, ইত্যাদি) তাদের নিজস্ব প্রকাশক থেকে পূর্ব-প্রশিক্ষিত আসে। আমরা তাদের ব্যবহার করি যেমন-শিপিং।
- তোমার ট্রান্সক্রিপশন বেস মডেল ট্রেনিং এর জন্য ব্যবহার করা হয় না।
- যদি আপনি একটি ট্রান্সক্রিপ্ট অংশ (পেন্সিল আইকন) সংশোধন করেন অথবা এটি ভুল হিসাবে চিহ্নিত করেন (ফ্ল্যাগ আইকন), এবং আপনি /privacy-settings/ (\
- আলাদাভাবে, ভয়েস ল্যাবে সংশোধন এবং অডিও যোগ করার টগল (এছাড়াও /privacy-settings/ এ, ডিফল্ট বন্ধ) আপনাকে আপনার সংশোধনকৃত অংশের অডিও যোগ করতে দেয়, সংশোধন করা টেক্সটের সাথে, সিসি-বাই-এসএ-৪. ০ এর অধীনে আমাদের ভয়েস ল্যাব ডেটাসেটে। এই দুই টগল স্বাধীন - আপনি যে কোন একটি, উভয়ই, অথবা উভয়ই দিতে পারেন।
- আপনি যে অডিও আপলোড করেন তা cleanup_uploads cron-এর মাধ্যমে ২৪ ঘণ্টার মধ্যে মুছে ফেলা হবে — যদি না আপনি \-এ সক্রিয় হয়ে থাকেন
সঠিকতা এবং ত্রুটি
AI অনুবাদ সম্পূর্ণ নয়। শব্দের ভুলের হার স্পিকারের উচ্চারণ, অডিও গুণমান, ভাষা এবং ডোমেইন শব্দভাণ্ডারের উপর নির্ভর করে। গুরুত্বপূর্ণ ব্যবহারের জন্য (আইনি, চিকিৎসা, নিয়ন্ত্রিত শিল্প) মূল অডিওটির সাথে পরীক্ষা করুন। আমাদের পাবলিক WER বেঞ্চমার্ক প্রতি মডেল এ /models/.
অনুমোদন প্রশ্ন
ইউরোপীয় ইউনিয়নের এআই আইন, জিডিপিআর, অথবা অন্যান্য আইনের প্রতি সম্মান প্রদর্শনের প্রশ্নের জন্য: hello@stt.ai অথবা ব্যবহার করুন যোগাযোগ ফর্ম.
সর্বশেষ হালনাগাদ: 2026-04-26.