ভয়েস ৰিমুভাৰ আৰু ভয়েস আইসোলেটৰ
গানসমূহৰ পৰা কণ্ঠসমূহ আঁতৰাওক অথবা সঙ্গীতৰ পৰা কণ্ঠসমূহ আলাদা কৰক। AI-powered vocal separation।
আপোনাৰ নথিপত্ৰ ইয়াত পেলাওক অথবা ব্ৰাউছ কৰিবলৈ ক্লিক কৰক
কেন্দ্ৰ-চেনেল পৰ্যায় বাতিল ব্যৱহাৰ কৰে। ভয়েস কেন্দ্ৰিত ষ্টীৰিঅ' ট্ৰেকসমূহৰ সৈতে ভালেমান কাম কৰে।
এই নথিপত্ৰটি একক। ধ্বনি পৰিবৰ্তনৰ মাধ্যমে শব্দ অপসাৰণৰ বাবে ষ্ট্ৰেয়ো নথিপত্ৰ প্ৰয়োজন।
প্ৰক্ৰিয়া কৰা হৈছে...
মুক্ত। কোনো নিবন্ধন প্ৰয়োজনীয় নহয়।
সকলো সঁজুলিসম্পূৰ্ণ অনুলিপিৰ প্ৰয়োজন, কেৱল এটা টুল নহয়?
অডিঅ' বা ভিডিঅ' আপলোড কৰক, অথবা এটা লিঙ্ক পেস্ট কৰক — AI transcription in 100+ languages with speaker detection. দৈনিক ১০ মিনিট বিনামূলীয়া, কোনো নিবন্ধন নাই।
প্ৰায়শঃ সোধা প্ৰশ্নসমূহ
শব্দ অপসাৰণ আপোনাৰ ব্ৰাউছাৰত চলিছে: এটা URL পেস্ট কৰক, এটা নথিপত্ৰ আপলোড কৰক, অথবা আপোনাৰ মাইকৰ পৰা ৰেকৰ্ড কৰক। STT.ai এ AI মডেল নিৰ্বাচন কৰে আৰু ৫ মিনিটত অনুলিপি প্ৰদান কৰে। TXT, SRT, VTT, DOCX, JSON, অথবা PDF হিচাপে এক্সপোৰ্ট কৰক।
হ্যাঁ — প্ৰতিজন ভ্ৰমণকাৰীয়ে STT.ai ত আৰম্ভ কৰিবলৈ ৬০০ মুক্ত মিনিট পায়, যি শব্দ অপসাৰণ ৰ বাবে ব্যৱহাৰযোগ্য যিকোনো অন্য কাৰ্য্যপ্ৰবাহৰ দৰেই। $৫/মাহত আৰম্ভ হোৱা পৰিশোধিত পৰিকল্পনাসমূহে দীঘল ফাইলসমূহ, ব্যক্তিগত ট্ৰান্সক্ৰিপ্টসমূহ, আৰু প্ৰাথমিকতা কাৰ্ডিং আনলক কৰে।
শব্দ অপসাৰণ STT.ai ৰ বাকী অংশৰ দৰে একে AI মডেলসমূহত চলায় — আমাৰ সেৰা মডেলসমূহ ৯৫-৯৭% সঠিকতাত পৰিষ্কাৰ কথোপকথনত পৌঁছে (বেঞ্চমাৰ্কত ৩-৫% শব্দ ত্ৰুটিৰ হাৰ)। যদি প্ৰথম পাছ আপোনাৰ লক্ষ্যৰ তলত হয় তেন্তে মডেলসমূহ ফ্লাইত পৰিবৰ্তন কৰক।
শব্দ অপসাৰণ STT.ai ৰ ১০+ আৰ্হিৰ যিকোনো এটাত চলাব পাৰিব - STT.ai উন্নত (সৰ্বাধিক সঠিক), Whisper Large V3 (৯৯ ভাষা), NVIDIA Canary (#1 WER সমৰ্থিত langs), Whisper Turbo (দ্ৰুত), Moonshine (হালকা), আৰু অধিক।
হ'ব। প্ৰতিটো অনুলিপি SRT অথবা VTT ৰূপে এক্সপোৰ্ট কৰা হয় - YouTube, Vimeo, TikTok, VLC, আৰু সকলো প্ৰধান ভিডিঅ' প্লেয়াৰৰ সৈতে কাম কৰে। বাৰ্ন-সাবটাইটেল টুল দ্বাৰা ভিডিঅ'ত হার্ডসাব হিচাপে অভাৰলেইড কৰা হয়।
হ'ব। স্পিকার ডাইৰেকটৰিয়ে স্বয়ংক্ৰিয়ভাৱে প্ৰতিটো শব্দ (স্পিকাৰ ১, স্পিকাৰ ২,...) লেবেল কৰে আৰু আপুনি ইয়াক অভ্যন্তৰীণ সম্পাদকত পুনৰ নামকৰণ কৰিব পাৰে। সকলো মডেল আৰু ভাষাত কাম কৰে।
অধিকাংশ শব্দ অপসাৰণ কাম ৫ মিনিটত কম সময়ত সমাপ্ত হয়। এটা ১ ঘন্টাৰ অডিঅ' ফাইল সাধাৰণতে আমাৰ দ্রুততম মডেলৰ সৈতে ২-৩ মিনিটত সমাপ্ত হয়। গতি নিৰ্বাচিত মডেল আৰু বৰ্তমান GPU চাপৰ ওপৰত নিৰ্ভৰ কৰে।
শব্দ অপসাৰণ দ্বাৰা ২০+ বিন্যাস গ্ৰহণ কৰা হ'ব — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI আৰু আরো। আউটপুট TXT, SRT, VTT, DOCX, JSON অথবা PDF ৰূপে।
হ'ব। শব্দ অপসাৰণ লে প্ৰেৰিত অডিঅ' নথিপত্ৰসমূহ অবিকল্পিতৰূপে প্ৰক্ৰিয়া কৰা হয় আৰু আঁতৰুৱা হয়। প্ৰো প্লানসমূহে ক্লাএন্ট-সাইড এনক্ৰিপশন যোগ কৰে - STT.ai ৰ ডাটাবেইচ বিঘ্নিত হ'লেও, আপোনাৰ কি'ৰ অবিহনে আপোনাৰ ট্ৰান্সক্ৰিপ্টসমূহ পঢ়িব নোৱাৰি। স্পষ্টভাবে অ'প-ইন নকৰি তথ্য কখনোই মডেল প্ৰশিক্ষণৰ বাবে ব্যৱহাৰ কৰা নহয়।
হ্যাঁ। STT.ai এ Python আৰু Node.js SDKs ৰ সৈতে এটা REST API প্ৰদান কৰে, লগতে Claude আৰু Cursor ৰ বাবে এটা MCP সেৱক — সকলো শব্দ অপসাৰণ কাৰ্য্যপ্ৰবাহৰ বাবে ব্যৱহাৰযোগ্য। বিনামূলীয়া API স্তৰত ১০০ মিনিট/মাহ অন্তৰ্ভুক্ত আছে।
হ্যাঁ। প্ৰতিটো অনুলিপি অন্তৰ্নিহিত সম্পাদকত খোলা হয় য'ত আপুনি শব্দ সঠিক কৰিব পাৰে, স্পিকারৰ নাম পৰিবৰ্তন কৰিব পাৰে, সময়চিহ্ন সংশোধন কৰিব পাৰে, আৰু টোকা যোগ কৰিব পাৰে। সকলো পৰিবৰ্তন স্বয়ংক্ৰিয়ভাৱে সংৰক্ষণ কৰক।
প্ৰতিটো অনুলিপিক এটা অবিকল্পিত অংশীদাৰী URL প্ৰাপ্ত কৰে। ই-মেইলৰ বাবে DOCX অথবা PDF ৰ বাবে এক্সপোৰ্ট কৰে। প্ৰো প্লানসমূহ পাছৱাৰ্ড-প্ৰুফ আৰু স্থায়ী লিঙ্ক যোগ কৰে - ক্লায়েন্টৰ কামৰ বাবে উপযোগী।
STT.ai এ YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast hosts, আৰু আকৌ অধিক অন্তৰ্ভুক্ত ১,৩০০+ প্লেটফৰ্মসমূহ হ্যান্ডেল কৰে। URL transcription কেৱল জনসাধাৰণৰ বাবে উপলব্ধ সামগ্ৰীৰ সৈতে কাম কৰে - DRM-প্ৰতিৰক্ষা কৰা উৎসসমূহ transcribe কৰা নাযায়।