مفت AI ڳالھائڻ کان متن

100 کان وڌيڪ ٻولين ۾ آڊيو ۽ وڊيو کي متن ۾ تبديل ڪريو. ڪيترا ويسپر ماڊل. ڳالهائيندڙ ڳولا. ڪوبه رجسٽريشن جي ضرورت نه آھي.

12.2K
ترڪيبون
292.9K
منٽ
100+
ٻوليون
70+
مفت اوزار

عام طور تي دستياب آڊيو ۽ وڊيو سان ڪم ڪري ٿو. DRM-protected مواد کي مدد نه ڏني وئي آهي.

وڌايل لاءِ اپ گريڊ
پرائيويٽ ٽرانسڪرپٽ
ٽرانسڪريٽ سان ڳالھايو
پرو سان کوليو →
فائل ھيڏانهن ڇڏ يا ڪلڪ ڪريو ته ڏسو
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — 2GB تائين
وڌايل لاءِ اپ گريڊ
پرائيويٽ ٽرانسڪرپٽ
ٽرانسڪريٽ سان ڳالھايو
پرو سان کوليو →
وڌايل لاءِ اپ گريڊ
رڪارڊنگ: 0:00
ريئل-ٽائم موکي (وقت)
وڌايل ويسپر (صحيح)
عام لنڪ: 24h، صرف متن · رجسٽر ٿيو 7d + آڊيو لاءِ · پرو پرائيويٽ لنڪ لاءِ

سچي وقت جي ڳالھائڻ کي متن ۾. AI پاڻمرادو درست ڪندو جيئن توھان ڳالھايو - دقت ڊگھي ڳالھائڻ سان بهتر ٿيندي.

پنھنجو مائڪروفون پھريون پرکي
❤️ STT.ai کي پيارو آهي؟ پنھنجن دوستن کي چئو!
توھان پنھنجي مفت ترميم استعمال ڪئي آھي

600 منٽن جي حاصل ڪرڻ لاءِ مفت ۾ رجسٽر ٿيو، يا $5/مھيني کان وڌيڪ هزارين جي حاصل ڪرڻ لاءِ اپ گريڊ ڪريو.

10 مفت منٽ/ ڏينھن 600 منٽ مفت سان رجسٽريشن ڪو ڪريڊٽ ڪارڊ نه ڳجھي طرح محفوظ
مفت ۾ رجسٽر ٿيو →
ڪلائنٽ-سائڊ انڪرپٽ ٿيل اسٽوريج — توھان جا ترانسڪريپٽ توھان جي برائوزر ۾ ڳجھي طرح محفوظ آھن. اسان به انھن کي نه پڙھي سگھندا آھيون. ڪيئن ڪم ڪري ٿو ڄاڻو →

STT.ai ڪيئن ڪم ڪري ٿو

صحيح نقل لاءِ ٽي قدم

1. اپ لوڊ، رڪارڊ يا پيسٽ URL

ڪنهن به آڊيو يا وڊيو فائل (MP3، WAV، MP4، ۽ 20+ فارميٽ) کي ڌڪيو ۽ ڇڏ. پنهنجي مائڪروفون کان ريڪارڊ کي حقيقي وقت ۾. يا يوٽيوب، ويميو، ٽڪ ٽاڪ ۽ 1,300+ پليٽ فارمن مان لنڪ کي چٽيو.

2. AI توهان جي ماڊل جي چونڊ سان نقل ڪري ٿو

ويسپِر ماڊل چونڊيو جيڪو توهان کي وڻندو آهي: وڌايل (وڏا-v3، تمام صحيح)، ٽائربو (شريعت، آخري)، وچولي يا ننڍي. 99 اختيارن مان ٻولي پاڻمرادو ڳوليو. ڳالهائيندڙ جي ڊيائريزيشن کي ڄاڻايو ته ڪير ڇا چيو.

3. برآمد، حصيداري يا گڏ ڪرڻ

TXT، SRT، VTT، DOCX، JSON، يا PDF طور ڊائون لوڊ ڪريو. لنڪ ذريعي شيئر ڪريو. اسان جي API کي پنهنجي ايپليڪيشن ۾ ترميم ڪرڻ لاءِ استعمال ڪريو. سبٽيڪل، ڪانفرنس جون نوٽس، پوڊ ڪاسٽس ۽ وڌيڪ لاءِ مڪمل.

100+
مدد ڪيل ٻوليون
70+
مفت اوزار
1,300+
مدد ڪيل پليٽ فارم
7
برآمد جي شڪل

ڊيولپر-پھرين API

منٽن ۾ پنھنجي ايپليڪيشن ۾ ڳالهائڻ-لکڻ کي شامل ڪريو. RESTful API سان حقيقي وقت WebSocket اسٽريمنگ.

ويب ساڪٽ — فائل اپ لوڊ ۽ ريئل ٽائيم اسٽريمنگ
گھڻا ماڊل — ويسپر ٽوربو، وڏا V3، وچولي ۽ ننڍا
اسپيڪر — پاڻمرادو ڳولا ڪير ڇا چيو
لچڪدار ٻاھرجوءِ — JSON, TXT, SRT, VTT لفظن سان گڏ وقت جي نشانين سان
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

ٻئي ڳالھائڻ مان متن جي خدشات ۾ تبديل ڪرڻ چاهيو ٿا؟

نقل ڪرڻ لاءِ تيار آھيو؟

پنهنجي پهرين فائيل مفت ۾ اپ لوڊ ڪريو. ڪوبه ڪرائيٽ ڪارڊ، ڪوبه رجسٽريشن. مفت منصوبي تي شروع ڪرڻ لاءِ 600 منٽ.

لکڻ شروع ڪريو

گھڻا پڇيل سوال

ڳالھائڻ کي متن ۾ توھان جي برائوزر ۾ هلندو آھي: URL کي چٽيو، فائل اپ لوڊ ڪريو، يا توھان جي مائڪ کان رڪارڊ ڪريو. STT.ai AI ماڊل چونڊيندو آھي ۽ 5 منٽن ۾ ترانسڪريپٽ موٽائيندو آھي. TXT، SRT، VTT، DOCX، JSON يا PDF طور برآمد ڪريو.

ھائو - هر هڪ مهمان STT.ai تي شروع ڪرڻ لاءِ 600 مفت منٽ حاصل ڪري ٿو، ڳالھائڻ کي متن ۾ لاءِ استعمال ڪري سگهجي ٿو جيئن ڪنهن به ٻئي ڪم جي وهڪري وانگر. ادا ڪيل منصوبا $5 / مهيني ۾ شروع ٿيندڙ ڊگهي فائلن، ذاتي ترڪيبون ۽ ترجيح واري قطار کي کولڻ.

ڳالھائڻ کي متن ۾ STT.ai جي باقي حصي وانگر AI ماڊل تي هلندو آهي - اسان جا بهترين ماڊل صاف ڳالهائڻ تي 95-97٪ درستگي تائين پهچي ٿو (3-5٪ لفظ غلطي جي شرح تي بينڪ مارڪ). جيڪڏهن پهريون پاسو توهان جي مقصد جي هيٺان آهي ته ماڊل کي تبديل ڪريو.

ڳالھائڻ کي متن ۾ ڪنهن به ويسپري ماڊل STT.ai ميزبان تي هلائي سگھي ٿو - STT.ai وڌايل (ويسپري وڏي-v3، سڀ کان وڌيڪ صحيح، ادا ڪيل منصوبن تي)، ويسپري وڏي V3، ويسپري ٽوربو (فائيئر)، ويسپري وچولي ۽ ويسپري ننڍو.

ھائو. سڀ ترنسڪريٽ SRT يا VTT طور برآمد ڪري ٿو — يوٽيوب، ويميو، ٽڪ ٽاڪ، وي ايل سي ۽ سڀ وڊيو پليئر سان ڪم ڪري ٿو. برائون-سوٽائيٽس ٽولز انهن کي وڊيو تي هارڊ سبس وانگر مٿاڇري ڪري ٿو.

ھائو. اسپيڪر جي ڊيائريزيشن پاڻمرادو هر آواز کي نشان لڳائيندو آھي (Speaker 1, Speaker 2,...) ۽ توھان انھن جو نالو داخل ٿيل ايڊيٽر ۾ مٽائي سگھوٿا. سڀ ماڊل ۽ ٻوليون ڪم ڪن ٿيون.

ڳالھائڻ کي متن ۾ جا وڏا ڪم 5 منٽن کان گھٽ ۾ پورا ٿيندا آھن. ھڪ ڪلاڪ جي آڊيو فائل عام طور اسان جي تيز ماڊلن سان 2-3 منٽن ۾ مڪمل ٿيندي آھي. رفتار چونڊيل ماڊل ۽ موجوده GPU لوڊ تي منحصر آھي.

ڳالھائڻ کي متن ۾ 20+ فارميٽ قبول ڪري ٿو - MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, ۽ وڌيڪ. TXT, SRT, VTT, DOCX, JSON, يا PDF ۾ نڪتو.

ھائو. آڊيو فائلون جيڪي ڳالھائڻ کي متن ۾ کي موڪليون ويون آھن سي عمل ۾ آيون آھن ۽ اڻ سڌو سنئون ختم ڪيون ويون آھن. پرو پلان ڪلائنٽ پاسي جي ڪوڊنگ شامل ڪندا آھن - جيتوڻيڪ جيڪڏھن STT.ai جي ڊيٽابيس ۾ ڀڃڪڙي ٿئي ٿي، توھان جون ترانسڪريپشن توھان جي ڪوڊ کانسواءِ پڙھڻ ۾ نه اينديون. ڊيٽا ڪڏهن به ماڊل جي تربيت لاءِ استعمال نه ٿيندو آھي بغير واضح طور تي داخل ٿيڻ جي.

ھائو. STT.ai Python ۽ Node.js SDKs سان REST API پيش ڪري ٿو، ۽ Claude ۽ Cursor لاءِ MCP سرور — سڀ ڳالھائڻ کي متن ۾ ڪم جي وهڪري لاءِ استعمال ڪري سگهجي ٿو. مفت API ٽائر ۾ 100 منٽ / مهينو شامل آهي.

ھائو. سڀئي ترانسڪريٽ اندروني ايڊيٽر ۾ کولبا جتي توھان لفظ درست ڪري سگھوٿا، ڳالهائيندڙن جو نالو مٽائي سگھوٿا، وقت جي نشانين کي ترتيب ڏئي سگھوٿا ۽ نوٽس شامل ڪري سگھوٿا. سڀ تبديليون پاڻمرادو محفوظ ڪيون وينديون.

هر transcript هڪ منفرد شيئر ڪري سگھجي ٿو URL حاصل ڪري ٿو. DOCX يا PDF اي ميل لاء برآمد. پرو منصوبن پاسورڊ-محفوظ ۽ دائمي لنڪ شامل ڪريو - گراهڪ جي ڪم لاء فائديمند.

STT.ai يوٽيوب ، ويميو ، ٽڪ ٽاڪ ، ساؤنڊ ڪلوڊ ، زووم ، گوگل ميٽ ، پوڊ ڪاسٽ هوسٽس ۽ وڌيڪ سميت 1,300+ پليٽ فارمن کي هلائي ٿو. URL ترميم صرف عوامي رسائي واري مواد سان ڪم ڪري ٿي - DRM-محفوظ ذريعن کي ترميم نه ڪري سگهجي ٿو.