মুক্ত AI বক্তৃতা থেকে টেক্সটName

১০০+ ভাষায় অডিও এবং ভিডিও টেক্সট অনুবাদ করুন। একাধিক Whisper মডেল। স্পিকার সনাক্তকরণ। কোন সাইন আপ প্রয়োজন নেই।

12K
অনুবাদ
290.5K
% 1 মিনিট
100+
ভাষা
70+
মুক্ত টুল

পাবলিকভাবে উপলব্ধ অডিও এবং ভিডিও সহযোগে কাজ করে। DRM-প্রতিরক্ষাপ্রাপ্ত বিষয়বস্তু সমর্থিত নয়।

উন্নত করার জন্য উন্নত করুন
ব্যক্তিগত ট্রান্সক্রিপশন
ট্রান্সক্রিপশনের সাথে আড্ডা
Pro-র সাথে আনলক করুন →
ফাইল এখানে ফেলে দিন অথবা ব্রাউজ করতে ক্লিক করুন
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — ২GB পর্যন্ত
উন্নত করার জন্য উন্নত করুন
ব্যক্তিগত ট্রান্সক্রিপশন
ট্রান্সক্রিপশনের সাথে আড্ডা
Pro-র সাথে আনলক করুন →
উন্নত করার জন্য উন্নত করুন
রেকর্ডিং: 0:00
বাস্তব সময় মোম (অবিলম্বে)
উন্নত Whisper (সঠিক)
পাবলিক লিংক: ২৪ ঘণ্টা, শুধু টেক্সট · নিবন্ধন করুন 7d + অডিও জন্য · প্রফেশনাল ব্যক্তিগত লিঙ্কের জন্য

বাস্তব সময়ের বাক্যের টেক্সট। আপনি কথা বললে AI স্বয়ংক্রিয়ভাবে সংশোধন করে - দীর্ঘ কথা বলার সাথে সাথে সঠিকতা উন্নত হয়।

প্রথমে মাইক্রোফোন পরীক্ষা করুন
❤️ STT.ai পছন্দ করেন? আপনার বন্ধুদের বলুন!
তুমি তোমার ফ্রি ট্রান্সক্রিপশন ব্যবহার করেছ

৬০০ মিনিট ফোন করার জন্য বিনামূল্যে নিবন্ধন করুন, অথবা মাসিক ৫ ডলার থেকে হাজার হাজার ডলারের জন্য আপগ্রেড করুন।

১০ মুক্ত মিনিট/দিন 600 মিনিট বিনামূল্যে সাইন আপ ক্রেডিট কার্ড নেই এনক্রিপ্ট করা
বিনামূল্যে নিবন্ধন করুন →
ক্লায়েন্ট-সাইড এনক্রিপ্টেড স্টোরেজ — আপনার ট্রান্সক্রিপশন আপনার ব্রাউজার এ এনক্রিপ্ট করা আছে, আমরাও তা পড়তে পারবো না। কিভাবে কাজ করে তা শিখুন →

বিশ্বব্যাপী পেশাদারদের বিশ্বাস করা

স্পিচ টু টেক্সট মডেল

আপনার অডিও জন্য সেরা ইঞ্জিন নির্বাচন করুন

সব মডেল দেখুন →

STT.ai কিভাবে কাজ করে

সঠিক অনুবাদ করার জন্য তিনটি পদক্ষেপ

১. আপলোড, রেকর্ড অথবা পেস্ট ইউ- আর- এল

যেকোন অডিও অথবা ভিডিও ফাইল (MP3, WAV, MP4, এবং ২০+ ফরম্যাট) টানুন এবং ছেড়ে দিন। আপনার মাইক্রোফোন থেকে বাস্তব সময়ে রেকর্ড করুন। অথবা ইউটিউব, ভিমিও, টিকটক এবং ১৩০০+ প্লাটফর্ম থেকে লিঙ্ক পেস্ট করুন।

২. আপনার পছন্দের মডেল ব্যবহার করে এআই অনুবাদ করে

Whisper মডেল নির্বাচন করুন যা আপনার জন্য উপযুক্ত: উন্নত (বড়-v3, সবচেয়ে সঠিক), টারবারো (দ্রুত, ডিফল্ট), মাঝারি বা ছোট। ৯৯টি অপশন থেকে স্বয়ংক্রিয়ভাবে ভাষা সনাক্ত করুন। স্পিকার ডায়ারিজম সনাক্ত করে কে কী বলেছে।

৩. রপ্তানি, শেয়ার অথবা সংযুক্ত করুন

TXT, SRT, VTT, DOCX, JSON, অথবা PDF হিসাবে ডাউনলোড করুন। লিঙ্কের মাধ্যমে শেয়ার করুন। আপনার অ্যাপলিকেশনে অনুবাদ অন্তর্ভুক্ত করতে আমাদের API ব্যবহার করুন। সাবটাইটেল, সভা নোট, পডকাস্ট এবং আরও অনেক কিছুর জন্য এটি উপযুক্ত।

অডিও এবং ভিডিও জন্য আপনার যা প্রয়োজন

AI দ্বারা চালিত ৭০+ বিনামূল্যে টুল

100+
সমর্থিত ভাষাName
70+
মুক্ত টুল
1,300+
সমর্থিত প্ল্যাটফর্ম
7
রপ্তানি ফরম্যাট

ডেভেলপার-প্রথম API

মিনিটের মধ্যে আপনার অ্যাপলিকেশনে বাক্যের জন্য টেক্সট একীভূত করুন। RESTful API বাস্তব-সময়ের WebSocket স্ট্রিমিং সহ।

ওয়েব- সকেট — ফাইল আপলোড এবং বাস্তব-সময়ের স্ট্রিমিং
একাধিক মডেল — Whisper Turbo, বড় V3, মাঝারি এবং ছোট
স্পিকারের ডায়ারিাইজেশন — স্বয়ংক্রিয়ভাবে সনাক্ত করো কে কি বলেছে
নমনীয় আউটপুট — শব্দ টাইমসটাম্প সহ JSON, TXT, SRT, VTT
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

অন্য কোন কথা থেকে টেক্সট সার্ভিসে পরিবর্তন করা হবে কি?

অনুবাদ করতে প্রস্তুত?

আপনার প্রথম ফাইলটি বিনামূল্যে আপলোড করুন। কোন ক্রেডিট কার্ড, কোন নিবন্ধন নেই। বিনামূল্যে পরিকল্পনা শুরু করার জন্য ৬০০ মিনিট।

অনুবাদ শুরু করো

প্রায়শই জিজ্ঞাসিত প্রশ্ন

শব্দ থেকে টেক্সট runs in your browser: paste a URL, upload a file, or record from your mic. STT.ai picks the AI model and returns the transcript in under 5 minutes. Export as TXT, SRT, VTT, DOCX, JSON, or PDF.

Yes — every visitor gets 600 free minutes/month on STT.ai, usable for শব্দ থেকে টেক্সট the same as any other workflow. Paid plans starting at $5/month unlock longer files, private transcripts, and priority queueing.

শব্দ থেকে টেক্সট runs on the same AI models as the rest of STT.ai — our best models reach 95-97% accuracy on clean speech (3-5% Word Error Rate on benchmarks). Switch models on the fly if the first pass is below your target.

শব্দ থেকে টেক্সট can run on any of the Whisper models STT.ai hosts — STT.ai Enhanced (Whisper large-v3, most accurate, on paid plans), Whisper Large V3, Whisper Turbo (fast), Whisper Medium and Whisper Small.

হ্যাঁ। প্রত্যেকটি ট্রান্সক্রিপ্ট SRT অথবা VTT হিসাবে রপ্তানি করা হয় - ইউটিউব, ভিমিও, টিকটোক, VLC এবং সবচেয়ে বড় ভিডিও প্লেয়ারের সাথে কাজ করে। সাবটাইটেল বার্ন টুল ভিডিওতে তাদের হার্ডসাব হিসেবে ওভারলে করে।

হ্যাঁ । স্পিকার ডায়রিজম স্বয়ংক্রিয়ভাবে প্রত্যেকটি শব্দের লেবেল (স্পিকার ১, স্পিকার ২,...) তৈরি করে এবং আপনি তাদের নাম পরিবর্তন করতে পারেন অভ্যন্তরীণ সম্পাদকে । সব মডেল এবং ভাষায় কাজ করে ।

অধিকাংশ শব্দ থেকে টেক্সট কাজ ৫ মিনিটের মধ্যে শেষ হয়। আমাদের দ্রুততম মডেলের ক্ষেত্রে ১ ঘন্টা অডিও ফাইল সাধারণত ২-৩ মিনিটে শেষ হয়। গতি নির্বাচিত মডেল এবং বর্তমান GPU লোডের উপর নির্ভর করে।

শব্দ থেকে টেক্সট ২০+ ফরম্যাট গ্রহণ করে — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, এবং আরও অনেক। আউটপুট TXT, SRT, VTT, DOCX, JSON, অথবা PDF।

হ্যাঁ। শব্দ থেকে টেক্সট-এ প্রেরিত অডিও ফাইল ডিফল্টভাবে প্রক্রিয়াজাত করা হয় এবং মুছে ফেলা হয়। প্রফেশনাল প্ল্যানে ক্লায়েন্ট-পার্শ্বের এনক্রিপশন যোগ করা হয় - STT.ai-এর ডাটাবেসটি যদি ভাঙ্গে, আপনার কী ছাড়া আপনার ট্রান্সক্রিপশন পড়া সম্ভব হবে না। স্পষ্টভাবে অনুমোদন না করে মডেল প্রশিক্ষণের জন্য তথ্য কখনো ব্যবহার করা হয় না।

হ্যাঁ। STT.ai Python এবং Node.js SDKs সহ একটি REST API প্রদান করে, Claude এবং Cursor এর জন্য একটি MCP সার্ভার সহ — সব শব্দ থেকে টেক্সট ওয়ার্কফ্লোর জন্য ব্যবহারযোগ্য। বিনামূল্যে API স্তরে ১০০ মিনিট/মাস অন্তর্ভুক্ত রয়েছে।

হ্যাঁ, প্রত্যেকটি ট্রান্সক্রিপশন তৈরীকৃত সম্পাদকে খোলা হবে যেখানে আপনি শব্দ সংশোধন করতে পারবেন, স্পিকারের নাম পরিবর্তন করতে পারবেন, সময়সূচী পরিবর্তন করতে পারবেন এবং নোট যোগ করতে পারবেন। সব পরিবর্তন স্বয়ংক্রিয়ভাবে সংরক্ষিত হবে।

প্রতিটি ট্রান্সক্রিপ্ট একটি অদ্বিতীয় শেয়ারযোগ্য ইউআরএল পাবে। ই-মেইল করার জন্য DOCX অথবা PDF-এ রপ্তানি করুন। প্রফেশনাল প্ল্যান পাসওয়ার্ড-প্রুফ এবং স্থায়ী লিঙ্ক যোগ করে - ক্লায়েন্টের কাজের জন্য উপকারী।

STT.ai handles 1,300+ platforms including YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast hosts, and more. URL transcription works with publicly-available content only — DRM-protected sources can't be transcribed.