অডিঅ' ভাষা চিনাক্তক
কোন ভাষাত কথা কোৱা হৈছে সেয়া চিনাক্ত কৰিবলৈ এটা সংক্ষিপ্ত অডিঅ' ক্লিপ আপলোড কৰক।
আপোনাৰ নথিপত্ৰ ইয়াত পেলাওক অথবা ব্ৰাউছ কৰিবলৈ ক্লিক কৰক
সমৰ্থিত বিন্যাস: MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM
অডিঅ' ভাষা চিনাক্তকৰণ আমাৰ API ব্যৱহাৰ কৰে। বিনামূল্যে নিবন্ধন কৰক অধিক বৈশিষ্ট্যৰ বাবে
মুক্ত · কোনো নিবন্ধন প্ৰয়োজনীয় নহয় · ১০০% ক্লায়েন্ট-সাইড প্ৰসেসিং
সকলো সঁজুলিপ্ৰায়শঃ সোধা প্ৰশ্নসমূহ
অডিঅ' ভাষা চিনাক্তক আপোনাৰ ব্ৰাউছাৰত চলিছে: এটা URL পেস্ট কৰক, এটা নথিপত্ৰ আপলোড কৰক, অথবা আপোনাৰ মাইকৰ পৰা ৰেকৰ্ড কৰক। STT.ai এ AI মডেল নিৰ্বাচন কৰে আৰু ৫ মিনিটত অনুলিপি প্ৰদান কৰে। TXT, SRT, VTT, DOCX, JSON, অথবা PDF হিচাপে এক্সপোৰ্ট কৰক।
হ্যাঁ — প্ৰতিজন ভ্ৰমণকাৰীয়ে STT.ai ত আৰম্ভ কৰিবলৈ ৬০০ মুক্ত মিনিট পায়, যি অডিঅ' ভাষা চিনাক্তক ৰ বাবে ব্যৱহাৰযোগ্য যিকোনো অন্য কাৰ্য্যপ্ৰবাহৰ দৰেই। $৫/মাহত আৰম্ভ হোৱা পৰিশোধিত পৰিকল্পনাসমূহে দীঘল ফাইলসমূহ, ব্যক্তিগত ট্ৰান্সক্ৰিপ্টসমূহ, আৰু প্ৰাথমিকতা কাৰ্ডিং আনলক কৰে।
অডিঅ' ভাষা চিনাক্তক STT.ai ৰ বাকী অংশৰ দৰে একে AI মডেলসমূহত চলায় — আমাৰ সেৰা মডেলসমূহ ৯৫-৯৭% সঠিকতাত পৰিষ্কাৰ কথোপকথনত পৌঁছে (বেঞ্চমাৰ্কত ৩-৫% শব্দ ত্ৰুটিৰ হাৰ)। যদি প্ৰথম পাছ আপোনাৰ লক্ষ্যৰ তলত হয় তেন্তে মডেলসমূহ ফ্লাইত পৰিবৰ্তন কৰক।
অডিঅ' ভাষা চিনাক্তক STT.ai ৰ ১০+ আৰ্হিৰ যিকোনো এটাত চলাব পাৰিব - STT.ai উন্নত (সৰ্বাধিক সঠিক), Whisper Large V3 (৯৯ ভাষা), NVIDIA Canary (#1 WER সমৰ্থিত langs), Whisper Turbo (দ্ৰুত), Moonshine (হালকা), আৰু অধিক।
হ'ব। প্ৰতিটো অনুলিপি SRT অথবা VTT ৰূপে এক্সপোৰ্ট কৰা হয় - YouTube, Vimeo, TikTok, VLC, আৰু সকলো প্ৰধান ভিডিঅ' প্লেয়াৰৰ সৈতে কাম কৰে। বাৰ্ন-সাবটাইটেল টুল দ্বাৰা ভিডিঅ'ত হার্ডসাব হিচাপে অভাৰলেইড কৰা হয়।
হ'ব। স্পিকার ডাইৰেকটৰিয়ে স্বয়ংক্ৰিয়ভাৱে প্ৰতিটো শব্দ (স্পিকাৰ ১, স্পিকাৰ ২,...) লেবেল কৰে আৰু আপুনি ইয়াক অভ্যন্তৰীণ সম্পাদকত পুনৰ নামকৰণ কৰিব পাৰে। সকলো মডেল আৰু ভাষাত কাম কৰে।
অধিকাংশ অডিঅ' ভাষা চিনাক্তক কাম ৫ মিনিটত কম সময়ত সমাপ্ত হয়। এটা ১ ঘন্টাৰ অডিঅ' ফাইল সাধাৰণতে আমাৰ দ্রুততম মডেলৰ সৈতে ২-৩ মিনিটত সমাপ্ত হয়। গতি নিৰ্বাচিত মডেল আৰু বৰ্তমান GPU চাপৰ ওপৰত নিৰ্ভৰ কৰে।
অডিঅ' ভাষা চিনাক্তক দ্বাৰা ২০+ বিন্যাস গ্ৰহণ কৰা হ'ব — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI আৰু আরো। আউটপুট TXT, SRT, VTT, DOCX, JSON অথবা PDF ৰূপে।
হ'ব। অডিঅ' ভাষা চিনাক্তক লে প্ৰেৰিত অডিঅ' নথিপত্ৰসমূহ অবিকল্পিতৰূপে প্ৰক্ৰিয়া কৰা হয় আৰু আঁতৰুৱা হয়। প্ৰো প্লানসমূহে ক্লাএন্ট-সাইড এনক্ৰিপশন যোগ কৰে - STT.ai ৰ ডাটাবেইচ বিঘ্নিত হ'লেও, আপোনাৰ কি'ৰ অবিহনে আপোনাৰ ট্ৰান্সক্ৰিপ্টসমূহ পঢ়িব নোৱাৰি। স্পষ্টভাবে অ'প-ইন নকৰি তথ্য কখনোই মডেল প্ৰশিক্ষণৰ বাবে ব্যৱহাৰ কৰা নহয়।
হ্যাঁ। STT.ai এ Python আৰু Node.js SDKs ৰ সৈতে এটা REST API প্ৰদান কৰে, লগতে Claude আৰু Cursor ৰ বাবে এটা MCP সেৱক — সকলো অডিঅ' ভাষা চিনাক্তক কাৰ্য্যপ্ৰবাহৰ বাবে ব্যৱহাৰযোগ্য। বিনামূলীয়া API স্তৰত ১০০ মিনিট/মাহ অন্তৰ্ভুক্ত আছে।
হ্যাঁ। প্ৰতিটো অনুলিপি অন্তৰ্নিহিত সম্পাদকত খোলা হয় য'ত আপুনি শব্দ সঠিক কৰিব পাৰে, স্পিকারৰ নাম পৰিবৰ্তন কৰিব পাৰে, সময়চিহ্ন সংশোধন কৰিব পাৰে, আৰু টোকা যোগ কৰিব পাৰে। সকলো পৰিবৰ্তন স্বয়ংক্ৰিয়ভাৱে সংৰক্ষণ কৰক।
প্ৰতিটো অনুলিপিক এটা অবিকল্পিত অংশীদাৰী URL প্ৰাপ্ত কৰে। ই-মেইলৰ বাবে DOCX অথবা PDF ৰ বাবে এক্সপোৰ্ট কৰে। প্ৰো প্লানসমূহ পাছৱাৰ্ড-প্ৰুফ আৰু স্থায়ী লিঙ্ক যোগ কৰে - ক্লায়েন্টৰ কামৰ বাবে উপযোগী।
STT.ai এ YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast hosts, আৰু আকৌ অধিক অন্তৰ্ভুক্ত ১,৩০০+ প্লেটফৰ্মসমূহ হ্যান্ডেল কৰে। URL transcription কেৱল জনসাধাৰণৰ বাবে উপলব্ধ সামগ্ৰীৰ সৈতে কাম কৰে - DRM-প্ৰতিৰক্ষা কৰা উৎসসমূহ transcribe কৰা নাযায়।