फ्री एआई पाठ से वार्ता

100+ भाषाओं में पाठ के लिए ऑडियो वीडियो स्केल करें. बहुमुखी मॉडिंग मॉडल. स्पीकर का पता लगाना जरूरी नहीं है.

12K
देखने की पट्टी
290.2K
मिनट ट्रिस्टेक्ट्ड
100+
भाषाएँ
70+
मुक्त उपकरण

सार्वजनिक उपलब्ध ऑडियो व वीडियो के साथ कार्य करता है. वीएनसी सामग्री समर्थित नहीं है.

उन्नत बनाने के लिए उन्नत बनाएँ
निजी उच्चारण
चेक के साथ गपशप करें
योजना के साथ ताला खोलें →
फ़ाइल यहाँ क्लिक करें या ब्राउज़ करने के लिए क्लिक करें
एमपी3, W4A, FLAC, एमपी4, एमकेवी, एम. वी.
उन्नत बनाने के लिए उन्नत बनाएँ
निजी उच्चारण
चेक के साथ गपशप करें
योजना के साथ ताला खोलें →
उन्नत बनाने के लिए उन्नत बनाएँ
रिकार्डिंग: 0:00
रीयल- टाइम वोस्क (प्रयोग में)
एनहैंस्ड Whisper (सटीक)
सार्वजनिक लिंक: 24h, पाठ सिर्फ · ऊपर हस्ताक्षर करें 7d + ऑडियो के लिए · प्रोग्रेड निजी कड़ियों के लिए

पाठ को सही तरह से बोलने के लिए सही समय. एआई स्वचालित सुधार जैसे आप बोलते हैं - सही भाषा के साथ सुधार.

अपना माइक्रोफोन पहले टेस्ट करें
❤️ अपने दोस्तों को बताओ!
आप अपने मुफ्त विज्ञापन इस्तेमाल किया है

600 मिनट पाने के लिए मुफ्त का हस्ताक्षर करें, या $5/ महीनों में से $5 महीने की उन्नयन के लिए हज़ारों.

10 खाली मि. / दिन साइन अप के साथ 600 मिनट मुक्त कोई क्रेडिट कार्ड नहीं गुप्त
मुक्त साइन अप →
क्लाइंट-साइड एन्क्रिप्टेड स्टोरेज — तुम्हारा लेख आपके ब्राउज़र में गुप्त है. हम उन्हें पढ़ भी नहीं सकते. सिखें कि यह कैसे काम करता है →

स्पीच टू टेक्स्ट मॉडल

अपने ऑडियो के लिए सर्वोत्तम इंजिन चुनें

सभी मॉडलों को देखें →

STT.ai कैसे काम करता है

सही अनुवाद करने के लिए तीन कदम

1. अपलोड, रेकॉर्ड, या चिपकाएँ यूआरएल

किसी भी ऑडियो या वीडियो फ़ाइल को छोड़ें (एमपी3, एमपी4, एमपी4, तथा 20+ फॉर्मेट्स). अपने माइक्रोफोन से सूचना वास्तव में समय में दर्ज करें. या यूट्यूब से लिंक को चिपकािए, म्यूक्स, टीआईएओ, और 135+4] स्क्रीन में.

2. एआई रेवर्स आपके मॉडल के चुनाव से सहमत हैं

इलेक्ट्रॉनिक मॉडल चुनें जो फिट करता है: एपलैंड्ब्स (बड़ा- वीव3, सबसे सही), एबोबो (तेज, मध्यम, या छोटा). 99 विकल्पों से भाषा स्वचालित पता लगाएँ. स्पीकरीकरण ने क्या कहा.

3. निर्यात, साझेदारी या एकीकृत

टीएक्सटी के रूप में डाउनलोड करें, एसआरटी, वीटीटी, डीसीएक्स, JSON, या पीडीएफ लिंक के द्वारा. हमारे एपीआई का उपयोग आपके ऐप में एकीकृत करने के लिए करें. सभा, पोस्ट, और अधिक से अधिक.

ऑडियो व वीडियो के लिए आपको जो आवश्यकता है

एआई द्वारा बनी 70+ मुक्त औज़ारों को ऊर्जा मिली

100+
भाषाएँ समर्थित
70+
मुक्त औज़ार
1,300+
प्लेटफ़ॉर्म समर्थित
7
निर्यात फॉर्मेट्स

डेवलपर- प्रथम एपीआई

मिनट में आपके पाठ से वार्ता हो रही है. वास्तविक समय वेबस्कर स्ट्रीम के साथ प्रक्षेपक एपीआई.

RESV + वेबकॉंच — फ़ाइल अपलोड और वास्तविक समय स्ट्रीमिंग
अनेक मॉडल — व्लोबो, बड़े वी3, मध्यम व छोटा
स्पीकर कमीशन — अपने आप पता लगाएँ कि क्या कहा
समाहित आउटपुट — JSON, टीएक्सटी, एसआरटी, शब्दों के साथ वीक
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

अन्य भाषण से पाठ सेवा में स्विच किया जा रहा है?

ट्रेंटर के लिए तैयार है?

अपना प्रथम फ़ाइल मुक्त अपलोड करें. कोई क्रेडिट कार्ड नहीं है. मुफ्त योजना पर शुरू करने के लिए 600 मिनट.

ट्रांसबॉबिंग प्रारंभ करें

अक्सर पूछे जाने वाले प्रश्न

पाठ से बात करें अपने ब्राउज़र में चला जाता है: एक यूआरएल, एक फ़ाइल अपलोड, या अपने mic से रिकॉर्ड। STT.ai आकर्षित करता है और 5 मिनट के अंदर seT, STT, DRT, DCX, DCX, JSON, या पीडीएफ में लौटाता है।

हाँ, हर दर्शक को STT.ai पर शुरू करने के लिए 600 मिनट लगते हैं, और इसी तरह पाठ से बात करें के लिए किसी भी अन्य काम के प्रवाह के लिए प्रयोग किया जाता है. Pid योजना $5/Mpiows, निजी प्रदर्शन, और प्राथमिकताओं पर शुरू की योजना.

पाठ से बात करें runs on the same AI models as the rest of STT.ai — our best models reach 95-97% accuracy on clean speech (3-5% Word Error Rate on benchmarks). Switch models on the fly if the first pass is below your target.

पाठ से बात करें Paghwest मॉडल STT.ai मेजबानों में से किसी भी पर चल सकता है — STT.ai रॉक (अपने बड़े-छोटे, सबसे सही, सबसे सही, भुगतान की योजना, महान वी3, वुल्बो (तेज), मध्यम और गन छोटे गन.

जी हाँ, हर प्रदर्शन निर्यात RTT या WAC के रूप में करता है - यूट्यूब, वीआईएम, वीआईटी, वीआईसी, और प्रत्येक प्रमुख वीडियो प्लेयर के साथ काम करता है. जल-घल उपकरण उन्हें वीडियो के रूप में कठिन के रूप में वीडियो के रूप में।

स्पीकर अवरोक्‍तता स्वचालित हर आवाज को (फोनपरे 1, स्पीकर 2,...) और आप इन्हें निर्माण-इन संपादक में बदल सकते हैं. सभी मॉडलों और भाषाओं के पार कार्य करता है.

पाठ से बात करें कार्य 5 मिनट में समाप्त. एक 1 घंटे की ध्वनि फ़ाइल विशेष रूप से हमारे सबसे तेज मॉडल के साथ पूरा होता है. गति चुना मॉडल और जीपी लोड पर निर्भर करता है.

पाठ से बात करें 20+ फ़ॉर्मेट स्वीकार करते हैं — एमपी3, एमवी, एमईए, एएसए, ओईसी, एनईएफसी, एमईवी, एमवी, एमएम, और अधिक. आउटपुट TXT, STT, वी.

जी हाँ. ऑडियो फ़ाइलें पाठ से बात करें में पेश की गई हैं तथा नष्ट कर दी जाती हैं. प्रोक्शन की योजना जोड़ें क्लाएंट- बाजू-पूर्व एनक्रिप्शन जोड़ें - चाहे STT.ai का डाटाबेस खराब हो, आपका उच्चारण बिना किसी खास घटना के बिना बिना पढ़ा जा सकता है. डाटा को प्रदर्शित करने के लिए प्रयोग नहीं किया गया है बिना विशिष्ट स्तर-से-अप- इन्जिक प्रशिक्षण के.

जी. STT.ai एक ReTHE API को पायथन और नोड के साथ प्रस्तुत करता है. jsss Sssss, साथ एमसीपी सर्वर किच और संकेतक के लिए एक एमसीपी सर्वर - सभी उपयोग के लिए उपयोग में आते हैं पाठ से बात करें काम के लिए. फ्री-ttacrer 100 मिनट/Mec.

जी हाँ. प्रत्येक लेख को संपादक में खोलता है जहाँ आप सही शब्द, समय- चिह्नों का नाम बदल सकते हैं, समय- चिह्न बदल सकते हैं तथा नोट जोड़ सकते हैं. सभी परिवर्तन स्वचालित सहेजते हैं.

प्रत्येक उद्धरण एक अद्वितीय साझेदारी यूआरएल हो जाता है. ईमेल के लिए डॉकX या पीडीएफ को निर्यात करें. योजना संरक्षित और स्थायी लिंक — क्लाएंट कार्य के लिए उपयोगी है.

STT.ai तकल, वेमियो, sek, ध्वनि-क, ज़ूम, गूगल सहवास, गूगल संपर्क, और अधिक. यूआरएल अ-भरिक सामग्री के साथ काम करता है — DCM-M-C-MAC- अप स्रोतों द्वारा बाध्य नहीं किया जा सकता.