AI ভয়েস ক্লোনার
একটি অডিও ক্লিপ থেকে যেকোন শব্দ ক্লোন করুন। ৩-১০ সেকেন্ডের কথা আপলোড করুন, আপনার লেখা টাইপ করুন এবং একই শব্দে অডিও তৈরি করুন।
শব্দ রেফারেন্স অডিও আপলোড করুন
MP3, WAV, M4A, FLAC
কোন সঙ্গীত বা পটভূমির শব্দ ছাড়াই একজন ব্যক্তির স্পষ্টভাবে কথা বলার ৩ থেকে ১০ সেকেন্ডের ভিডিও আপলোড করুন।
ক্লোন করা কন্ঠ ২৩টি ভাষায় কথা বলতে পারে। যদি সংক্ষিপ্ত টেক্সটের ক্ষেত্রে সনাক্তকরণ ভুল হয়, তাহলে একটি নির্বাচন করুন।
সর্বোচ্চ ৫০০ অক্ষর
0/500
প্রতি প্রজন্মে ১ ক্রেডিট ব্যবহার করে
অডিও তৈরি করা হয়েছে
এই অডিওটি AI দ্বারা তৈরি করা হয়েছে। ডাউনলোড করা WAV ফাইলটি EU AI Act Article 50 অনুযায়ী একটি মেশিন পড়া যায় এমন প্রকাশনা (RIFF INFO chunk) অন্তর্ভুক্ত করে। অনুমতি ছাড়া এই অডিওটিকে কোন বাস্তব ব্যক্তির রেকর্ড হিসেবে উপস্থাপন করবেন না।
AI নীতিমালা
কিভাবে কাজ করে
1
রেফারেন্স আপলোড করো
আপনি যে কণ্ঠস্বরটি ক্লোন করতে চান তা থেকে ৩-১০ সেকেন্ডের পরিষ্কার কথাবার্তা প্রদান করুন।
2
AI শব্দ বিশ্লেষণ করে
এই অ্যাআই মডেল শব্দের বৈশিষ্ট্য বের করে: টোন, পিচ, কথা বলার ধরন, উচ্চারণ।
3
বক্তৃতা তৈরি করো
আপনার লেখা ক্লোন করা কন্ঠে উচ্চারিত হবে । ফলাফলটি WAV হিসাবে ডাউনলোড করুন ।
ভয়েস ক্লোন করা শুধুমাত্র ব্যক্তিগত এবং অনুমোদিত ব্যবহারের জন্য। স্পিকারের অনুমতি ছাড়া ভয়েস ক্লোন করবেন না।
পুরো ট্রান্সক্রিপ্ট লাগবে, শুধু একটা টুল নয়?
অডিও বা ভিডিও আপলোড করুন, অথবা লিঙ্কটি পেস্ট করুন - ১০০+ ভাষায় AI transcription speaker detection এর সাথে। প্রতিদিন ১০ মিনিট বিনামূল্যে, কোন নিবন্ধন নেই।
প্রায়শই জিজ্ঞাসিত প্রশ্ন
শব্দের ক্লোন আপনার ব্রাউজার-এ চলবে: URL-এ পেস্ট করুন, ফাইল আপলোড করুন, অথবা মাইক্রোফোন থেকে রেকর্ড করুন। STT.ai AI মডেল বেছে নেয় এবং ৫ মিনিটের মধ্যে ট্রান্সক্রিপশন ফিরিয়ে দেয়। TXT, SRT, VTT, DOCX, JSON অথবা PDF-এ রপ্তানি করুন।
হ্যাঁ - প্রত্যেক ভিজিটর STT.ai শুরু করার জন্য ৬০০ মিনিট বিনামূল্যে পাবেন, যা শব্দের ক্লোন এর জন্য অন্য যে কোন ওয়ার্কফ্লোর মত ব্যবহার করা যাবে। মাসিক ৯ ডলারের বিনিময়ে শুরু হওয়া পরিকল্পনা দীর্ঘ ফাইল, ব্যক্তিগত ট্রান্সক্রিপশন এবং অগ্রাধিকার লাইন খোলার সুযোগ প্রদান করে।
শব্দের ক্লোন runs on the same AI models as the rest of STT.ai — our best models reach 95-97% accuracy on clean speech (3-5% Word Error Rate on benchmarks). Switch models on the fly if the first pass is below your target.
শব্দের ক্লোন Whisper মডেল STT.ai হোস্টের যে কোন একটিতে চলতে পারে - STT.ai Enhanced (Whisper large-v3, সবচেয়ে সঠিক, পেমেন্ট পরিকল্পনা), Whisper Large V3, Whisper Turbo (fast), Whisper Medium এবং Whisper Small।
হ্যাঁ। প্রত্যেকটি ট্রান্সক্রিপ্ট SRT অথবা VTT হিসাবে রপ্তানি করা হয় - ইউটিউব, ভিমিও, টিকটোক, VLC এবং সবচেয়ে বড় ভিডিও প্লেয়ারের সাথে কাজ করে। সাবটাইটেল বার্ন টুল ভিডিওতে তাদের হার্ডসাব হিসেবে ওভারলে করে।
হ্যাঁ । স্পিকার ডায়রিজম স্বয়ংক্রিয়ভাবে প্রত্যেকটি শব্দের লেবেল (স্পিকার ১, স্পিকার ২,...) তৈরি করে এবং আপনি তাদের নাম পরিবর্তন করতে পারেন অভ্যন্তরীণ সম্পাদকে । সব মডেল এবং ভাষায় কাজ করে ।
অধিকাংশ শব্দের ক্লোন কাজ ৫ মিনিটের মধ্যে শেষ হয়। আমাদের দ্রুততম মডেলের ক্ষেত্রে ১ ঘন্টা অডিও ফাইল সাধারণত ২-৩ মিনিটে শেষ হয়। গতি নির্বাচিত মডেল এবং বর্তমান GPU লোডের উপর নির্ভর করে।
শব্দের ক্লোন ২০+ ফরম্যাট গ্রহণ করে — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, এবং আরও অনেক। আউটপুট TXT, SRT, VTT, DOCX, JSON, অথবা PDF।
হ্যাঁ। শব্দের ক্লোন-এ প্রেরিত অডিও ফাইল ডিফল্টভাবে প্রক্রিয়াজাত করা হয় এবং মুছে ফেলা হয়। প্রফেশনাল প্ল্যানে ক্লায়েন্ট-পার্শ্বের এনক্রিপশন যোগ করা হয় - STT.ai-এর ডাটাবেসটি যদি ভাঙ্গে, আপনার কী ছাড়া আপনার ট্রান্সক্রিপশন পড়া সম্ভব হবে না। স্পষ্টভাবে অনুমোদন না করে মডেল প্রশিক্ষণের জন্য তথ্য কখনো ব্যবহার করা হয় না।
হ্যাঁ। STT.ai Python এবং Node.js SDKs সহ একটি REST API প্রদান করে, Claude এবং Cursor এর জন্য একটি MCP সার্ভার সহ — সব শব্দের ক্লোন ওয়ার্কফ্লোর জন্য ব্যবহারযোগ্য। বিনামূল্যে API স্তরে ১০০ মিনিট/মাস অন্তর্ভুক্ত রয়েছে।
হ্যাঁ, প্রত্যেকটি ট্রান্সক্রিপশন তৈরীকৃত সম্পাদকে খোলা হবে যেখানে আপনি শব্দ সংশোধন করতে পারবেন, স্পিকারের নাম পরিবর্তন করতে পারবেন, সময়সূচী পরিবর্তন করতে পারবেন এবং নোট যোগ করতে পারবেন। সব পরিবর্তন স্বয়ংক্রিয়ভাবে সংরক্ষিত হবে।
প্রতিটি ট্রান্সক্রিপ্ট একটি অদ্বিতীয় শেয়ারযোগ্য ইউআরএল পাবে। ই-মেইল করার জন্য DOCX অথবা PDF-এ রপ্তানি করুন। প্রফেশনাল প্ল্যান পাসওয়ার্ড-প্রুফ এবং স্থায়ী লিঙ্ক যোগ করে - ক্লায়েন্টের কাজের জন্য উপকারী।
STT.ai handles 1,300+ platforms including YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast hosts, and more. URL transcription works with publicly-available content only — DRM-protected sources can't be transcribed.