مفت لفظ سے متن آن لائن
AI-powered transcrition کے ساتھ بولے کو متن میں تبدیل کریں. آڈیو فائلیں اپ لوڈ کریں، اپنے مائیکرو فون سے ریکارڈ کریں، یا ایک URL کو پسٹ کریں. 100+ زبانیں، 10+ ماڈل، 98%+ صحیح.
1. Upload Speech Recording
Upload an audio or video file, paste a URL, or record speech from your mic.
2. AI Converts Speech to Text
Choose from 10+ AI models. Speaker detection and language auto-detect included.
3. Export Your Transcript
Download in 6 formats. Share transcript links with audio playback.
Speech to Text Models
Choose the AI model that fits your needs — or let us pick the best one.
Speech to Text in 100+ Languages
Ready to convert speech to text?
مفت شروع کریں →عام سوالات
تقرير سے متن (اسے تقرير شناخت يا ASR بھی کہا جاتا ہے) خودکار طور پر تقرير کي او ديو کو لکھي لفظوں ميں تبديل کر تا هے STT.ai آپ کی ريج سٹري کو AI ماڈل کے ذریعے چلا تا هے جو او ديو کو سنتا هے اور وقت کے نشان اور تقرير کر نے والے ليبل کے ساتھ ايڈٹ کر نے والا متن نکالتا هے - ٹائپنگ کا احتياج نهيں
STT.ai GPU پر Whisper Large V3 اور NVIDIA Canary جیسے ماڈل کے ساتھ اس کو کر تا هے ، اس ليے يک گھنٹہ کا ريجو ريشن عام طور پر 2-3 منٹ ميں کر دیا جاتا هے
ہاں۔ ہر مہمان کو 600 مفت منٹ ملتے ہیں آپ کی پہلی فائلیں کے لئے کوئی سائن اپ کی ضرورت نہیں ہے۔ پیسے کے منصوبے $5/مہین سے شروع ہوتے ہیں اور لمبی فائلیں، نجی نقل، اور ترجیح کے عمل میں شامل ہوتے ہیں۔
صاف بولنے پر ہمارے بہترین ماڈل 95-97% صحیح جواب تک پہنچ جاتے ہیں (بنچمارک پر 3-5% لفظی غلطی کی شرح) پس منظر کی شور، بھاری اشاروں، کراس ٹول، یا کم بائٹریٹ آڈیو کے ساتھ صحیح جواب میں کمی ہوتی ہے - ایک مناسب مائیکرو فون اور ایک خاموش کمرے کا استعمال سب سے بڑا فرق کرتا ہے۔
ہاں. اپنے مائیکرو فون میں بولو اور STT.ai لائی و ری پرنٹ ٹول کے ذریعے لائی و ری پرنٹ کو رائج کرے۔ آپ ایک مکمل ریکارڈ بھی اپ لوڈ کر سکتے ہیں اگر آپ کو بات کرتے ہوئے لفظ سے لفظ اس کی ضرورت نہیں ہے۔
STT.ai 100+ زبانوں کو پہچانتا ہے اور زیادہ تر آڈیو کے لئے بولی ہوئی زبان کو خودکار طور پر دریافت کرتا ہے۔ آپ زبان کو چھوٹے سے صحیح لیفت کے لئے ہاتھ سے بھی ترتیب دے سکتے ہیں، اور مرکب زبان کی ریکارڈنگ کو وسط کلیپ کے ذریعے تبدیل کر کے ہینڈل کیا جاتا ہے۔
ہاں۔ اسپیکر ڈائريزيشن ہر آواز کو لیبل کرتا ہے (سپیکر 1، اسپیکر 2،...) اور آپ ان کا نام ایڈیٹر میں بدل سکتے ہیں۔ یہ ہر مدد شدہ ماڈل اور زبان پر کام کرتا ہے۔
STT.ai 20+ فارمیٹ قبول کرتا ہے جن میں MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM اور AVI شامل ہیں. TXT, SRT, VTT, DOCX, JSON یا PDF میں خروجی.
STT.ai دو ں کو کر تا هے - نقل اور ناطق کا فہرست بنانا - ليکن لفظ مختلف کاموں کا بيان کر تا هے
ہاں. آڈیو کو پروسیسنگ اور ڈیفالٹ سے حذف کیا جاتا ہے. پرو پلان کلائنٹ-سایڈ خفیہ سازی کو شامل کرتے ہیں تاکہ نقل آپ کی کلید کے بغیر پڑھنے میں نہ آئے، حتی STT.ai تک، اور آپ کا ڈیٹا واضح آپٹ-ان کے بغیر ماڈل تربیت کے لئے کبھی استعمال نہیں کیا جاتا.
ہاں۔ STT.ai میں پایٹن اور Node.js SDKs کے ساتھ ایک REST API اور Claude اور Cursor کے لئے ایک MCP سرور ہے۔ مفت API ٹیئر میں 100 منٹ/مہینت شامل ہیں، اس سے زیادہ کے لئے ہر سیکنڈ بلنگ کے ساتھ۔
ہاں ہر نقل ایک اندرونی ایڈیٹر میں کھولا جاتا ہے جہاں آپ غلط سنے ہوئے لفظوں کو ٹھیک کرسکتے ہیں، اسپیکروں کا نام بدل سکتے ہیں، ٹائم سٹیمپس کو تعدیل کرسکتے ہیں اور نوٹس شامل کرسکتے ہیں. اصلاحات ہر صادراتی فارمیٹ میں باقی رہتی ہیں.