مفت لفظ سے متن آن لائن
AI-powered transcrition کے ساتھ بات کو متن میں تبدیل کریں. آڈیو فائلیں اپ لوڈ کریں، اپنے مائکرو فون سے ریکارڈ کریں، يا URL کو پسٹ کریں. 100+ زبانیں، کھلے ماڈل، 98%+ صحیح.
1. Upload Speech Recording
Upload an audio or video file, paste a URL, or record speech from your mic.
2. AI Converts Speech to Text
ويسپر ماڈل منتخب کريں جو آپکے آ ديو سے ملتا هے اسپيکر کٹ کٹ اور زبان خودکار کٹ کٹ شامل هے
3. Export Your Transcript
Download in 6 formats. Share transcript links with audio playback.
Speech to Text Models
Choose the AI model that fits your needs — or let us pick the best one.
Speech to Text in 100+ Languages
Ready to convert speech to text?
مفت شروع کریں →عام سوالات
تقرير سے متن (اسے تقرير شناخت يا ASR بھی کہا جاتا ہے) خودکار طور پر تقرير کي او ديو کو لکھي لفظوں ميں تبديل کر تا هے STT.ai آپ کی ريج سٹري کو AI ماڈل کے ذریعے چلا تا هے جو او ديو کو سنتا هے اور وقت کے نشان اور تقرير کر نے والے ليبل کے ساتھ ايڈٹ کر نے والا متن نکالتا هے - ٹائپنگ کا احتياج نهيں
ايک آ کو ٹک ماڈل آواز کي موج کي آواز کو فونم ميں ميپ کر تا هے ، پھر زبان ماڈل ان کو سب سے زيادہ ممکن لفظ اور علامات ميں جمع کر تا هے STT.ai GPU پر Whisper خاندان (Large V3 اور Turbo) کے ساتھ اس کو کر تا هے ، تو يک گھنٹہ ريکورڈ عام طور پر 2-3 منٹ ميں کريے جا تا هے
ہاں۔ ہر مہمان کو ہر مہینے 600 مفت منٹ ملتے ہیں اور آپ کی پہلی فائلیں کے لئے کوئی سائن اپ کی ضرورت نہیں ہوتی۔ پیسے کی ادائیگی $9/مئی سے شروع ہوتی ہے اور زیادہ طویل فائلیں، نجی نقل، اور ترجیح کے عمل میں شامل ہوتی ہے۔
صاف بولنے پر ہمارے بہترین ماڈل 95-97% صحیح جواب تک پہنچ جاتے ہیں (بنچمارک پر 3-5% لفظی غلطی کی شرح) پس منظر کی شور، بھاری اشاروں، کراس ٹول، یا کم بائٹریٹ آڈیو کے ساتھ صحیح جواب میں کمی ہوتی ہے - ایک مناسب مائیکرو فون اور ایک خاموش کمرے کا استعمال سب سے بڑا فرق کرتا ہے۔
ہاں. اپنے مائیکرو فون میں بولو اور STT.ai لائی و ری پرنٹ ٹول کے ذریعے لائی و ری پرنٹ کو رائج کرے۔ آپ ایک مکمل ریکارڈ بھی اپ لوڈ کر سکتے ہیں اگر آپ کو بات کرتے ہوئے لفظ سے لفظ اس کی ضرورت نہیں ہے۔
STT.ai 100+ زبانوں کو پہچانتا ہے اور زیادہ تر آڈیو کے لئے بولی ہوئی زبان کو خودکار طور پر دریافت کرتا ہے۔ آپ زبان کو چھوٹے سے صحیح لیفت کے لئے ہاتھ سے بھی ترتیب دے سکتے ہیں، اور مرکب زبان کی ریکارڈنگ کو وسط کلیپ کے ذریعے تبدیل کر کے ہینڈل کیا جاتا ہے۔
ہاں۔ اسپیکر ڈائريزيشن ہر آواز کو لیبل کرتا ہے (سپیکر 1، اسپیکر 2،...) اور آپ ان کا نام ایڈیٹر میں بدل سکتے ہیں۔ یہ ہر مدد شدہ ماڈل اور زبان پر کام کرتا ہے۔
STT.ai 20+ فارمیٹ قبول کرتا ہے جن میں MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM اور AVI شامل ہیں. TXT, SRT, VTT, DOCX, JSON یا PDF میں خروجی.
STT.ai دو ں کو کر تا هے - نقل اور ناطق کا فہرست بنانا - ليکن لفظ مختلف کاموں کا بيان کر تا هے
ہاں. آڈیو کو پروسیسنگ اور ڈیفالٹ سے حذف کیا جاتا ہے. پرو پلان کلائنٹ-سایڈ خفیہ سازی کو شامل کرتے ہیں تاکہ نقل آپ کی کلید کے بغیر پڑھنے میں نہ آئے، حتی STT.ai تک، اور آپ کا ڈیٹا واضح آپٹ-ان کے بغیر ماڈل تربیت کے لئے کبھی استعمال نہیں کیا جاتا.
ہاں۔ STT.ai میں پایٹن اور Node.js SDKs کے ساتھ ایک REST API اور Claude اور Cursor کے لئے ایک MCP سرور ہے۔ مفت API ٹیئر میں 100 منٹ/مہینت شامل ہیں، اس سے زیادہ کے لئے ہر سیکنڈ بلنگ کے ساتھ۔
ہاں ہر نقل ایک اندرونی ایڈیٹر میں کھولا جاتا ہے جہاں آپ غلط سنے ہوئے لفظوں کو ٹھیک کرسکتے ہیں، اسپیکروں کا نام بدل سکتے ہیں، ٹائم سٹیمپس کو تعدیل کرسکتے ہیں اور نوٹس شامل کرسکتے ہیں. اصلاحات ہر صادراتی فارمیٹ میں باقی رہتی ہیں.