ভোকাল রিমুভার ও ভয়েস আইসোলেটর

গান থেকে ভোকাল সরান বা মিউজিক থেকে কণ্ঠ আলাদা করুন। AI-চালিত ভোকাল পৃথকীকরণ।

আপনার ফাইল এখানে ড্রপ করুন বা ব্রাউজ করতে ক্লিক করুন
সেন্টার-চ্যানেল ফেজ ক্যান্সেলেশন ব্যবহার করে। স্টিরিও ট্র্যাকে সবচেয়ে ভালো কাজ করে যেখানে ভোকাল কেন্দ্রে থাকে।
প্রসেসিং...

বিনামূল্যে। সাইনআপ প্রয়োজন নেই।

সব টুলস
❤️ STT.ai এর মত?

পুরো ট্রান্সক্রিপ্ট লাগবে, শুধু একটা টুল নয়?

অডিও বা ভিডিও আপলোড করুন, অথবা লিঙ্কটি পেস্ট করুন - ১০০+ ভাষায় AI transcription speaker detection এর সাথে। প্রতিদিন ১০ মিনিট বিনামূল্যে, কোন নিবন্ধন নেই।

প্রায়শই জিজ্ঞাসিত প্রশ্ন

শব্দের অপসারণ আপনার ব্রাউজার-এ চলবে: URL-এ পেস্ট করুন, ফাইল আপলোড করুন, অথবা মাইক্রোফোন থেকে রেকর্ড করুন। STT.ai AI মডেল বেছে নেয় এবং ৫ মিনিটের মধ্যে ট্রান্সক্রিপশন ফিরিয়ে দেয়। TXT, SRT, VTT, DOCX, JSON অথবা PDF-এ রপ্তানি করুন।

হ্যাঁ - প্রত্যেক ভিজিটর STT.ai শুরু করার জন্য ৬০০ মিনিট বিনামূল্যে পাবেন, যা শব্দের অপসারণ এর জন্য অন্য যে কোন ওয়ার্কফ্লোর মত ব্যবহার করা যাবে। মাসিক ৯ ডলারের বিনিময়ে শুরু হওয়া পরিকল্পনা দীর্ঘ ফাইল, ব্যক্তিগত ট্রান্সক্রিপশন এবং অগ্রাধিকার লাইন খোলার সুযোগ প্রদান করে।

শব্দের অপসারণ runs on the same AI models as the rest of STT.ai — our best models reach 95-97% accuracy on clean speech (3-5% Word Error Rate on benchmarks). Switch models on the fly if the first pass is below your target.

শব্দের অপসারণ Whisper মডেল STT.ai হোস্টের যে কোন একটিতে চলতে পারে - STT.ai Enhanced (Whisper large-v3, সবচেয়ে সঠিক, পেমেন্ট পরিকল্পনা), Whisper Large V3, Whisper Turbo (fast), Whisper Medium এবং Whisper Small।

হ্যাঁ। প্রত্যেকটি ট্রান্সক্রিপ্ট SRT অথবা VTT হিসাবে রপ্তানি করা হয় - ইউটিউব, ভিমিও, টিকটোক, VLC এবং সবচেয়ে বড় ভিডিও প্লেয়ারের সাথে কাজ করে। সাবটাইটেল বার্ন টুল ভিডিওতে তাদের হার্ডসাব হিসেবে ওভারলে করে।

হ্যাঁ । স্পিকার ডায়রিজম স্বয়ংক্রিয়ভাবে প্রত্যেকটি শব্দের লেবেল (স্পিকার ১, স্পিকার ২,...) তৈরি করে এবং আপনি তাদের নাম পরিবর্তন করতে পারেন অভ্যন্তরীণ সম্পাদকে । সব মডেল এবং ভাষায় কাজ করে ।

অধিকাংশ শব্দের অপসারণ কাজ ৫ মিনিটের মধ্যে শেষ হয়। আমাদের দ্রুততম মডেলের ক্ষেত্রে ১ ঘন্টা অডিও ফাইল সাধারণত ২-৩ মিনিটে শেষ হয়। গতি নির্বাচিত মডেল এবং বর্তমান GPU লোডের উপর নির্ভর করে।

শব্দের অপসারণ ২০+ ফরম্যাট গ্রহণ করে — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, এবং আরও অনেক। আউটপুট TXT, SRT, VTT, DOCX, JSON, অথবা PDF।

হ্যাঁ। শব্দের অপসারণ-এ প্রেরিত অডিও ফাইল ডিফল্টভাবে প্রক্রিয়াজাত করা হয় এবং মুছে ফেলা হয়। প্রফেশনাল প্ল্যানে ক্লায়েন্ট-পার্শ্বের এনক্রিপশন যোগ করা হয় - STT.ai-এর ডাটাবেসটি যদি ভাঙ্গে, আপনার কী ছাড়া আপনার ট্রান্সক্রিপশন পড়া সম্ভব হবে না। স্পষ্টভাবে অনুমোদন না করে মডেল প্রশিক্ষণের জন্য তথ্য কখনো ব্যবহার করা হয় না।

হ্যাঁ। STT.ai Python এবং Node.js SDKs সহ একটি REST API প্রদান করে, Claude এবং Cursor এর জন্য একটি MCP সার্ভার সহ — সব শব্দের অপসারণ ওয়ার্কফ্লোর জন্য ব্যবহারযোগ্য। বিনামূল্যে API স্তরে ১০০ মিনিট/মাস অন্তর্ভুক্ত রয়েছে।

হ্যাঁ, প্রত্যেকটি ট্রান্সক্রিপশন তৈরীকৃত সম্পাদকে খোলা হবে যেখানে আপনি শব্দ সংশোধন করতে পারবেন, স্পিকারের নাম পরিবর্তন করতে পারবেন, সময়সূচী পরিবর্তন করতে পারবেন এবং নোট যোগ করতে পারবেন। সব পরিবর্তন স্বয়ংক্রিয়ভাবে সংরক্ষিত হবে।

প্রতিটি ট্রান্সক্রিপ্ট একটি অদ্বিতীয় শেয়ারযোগ্য ইউআরএল পাবে। ই-মেইল করার জন্য DOCX অথবা PDF-এ রপ্তানি করুন। প্রফেশনাল প্ল্যান পাসওয়ার্ড-প্রুফ এবং স্থায়ী লিঙ্ক যোগ করে - ক্লায়েন্টের কাজের জন্য উপকারী।

STT.ai handles 1,300+ platforms including YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast hosts, and more. URL transcription works with publicly-available content only — DRM-protected sources can't be transcribed.