स्वतन्त्र एआई पाठमा भाषणName

100+ भाषाहरूमा पाठमा अडियो र भिडियो transcribe। बहु Whisper मोडेल। वक्ता पत्ता लगाउन। कुनै साइन अप आवश्यक।

15.8K
प्रतिलिपि
400.5K
मिनेट
100+
भाषाहरू
59
स्वतन्त्र उपकरणहरू

सार्वजनिक रूपमा उपलब्ध अडियो र भिडियोसँग काम गर्दछ । DRM-संरक्षित सामग्री समर्थन गरिएको छैन ।

बढाइएकोका लागि स्तरबृद्धि गर्नुहोस्
निजी प्रतिलिपि
मुद्रणसँग कुराकानी गर्नुहोस्
प्रोसँग ताल्चा खोल्नुहोस् →
यहाँ फाइल छोड्नुहोस् वा ब्राउज गर्न क्लिक गर्नुहोस्
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM - सम्म 2GB
बढाइएकोका लागि स्तरबृद्धि गर्नुहोस्
निजी प्रतिलिपि
मुद्रणसँग कुराकानी गर्नुहोस्
प्रोसँग ताल्चा खोल्नुहोस् →
बढाइएकोका लागि स्तरबृद्धि गर्नुहोस्
रेकर्डिङ: 0:00
वास्तविक समय मोइस्च (अवकाश)
बढाइएको फुस्फुसाउँनुहोस् (सहि)
सार्वजनिक लिङ्क: 24h, पाठ मात्र · दर्ता गर्नुहोस् 7d + अडियोका लागि · प्रो निजी लिङ्कका लागि

पाठ गर्न वास्तविक समय भाषण। AI तपाईं बोल्न रूपमा स्वचालित-सही - सटीकता लामो भाषण संग सुधार.

तपाईँको माइक्रोफोन पहिले परीक्षण गर्नुहोस्
❤️ प्रेम STT.ai? आफ्नो साथीहरूलाई भन्नुहोस्!
तपाईँले आफ्नो निःशुल्क प्रतिलिपि प्रयोग गर्नुभएको छ

600 मिनेट प्राप्त गर्न निःशुल्क लागि साइन अप, वा हजारौं थप लागि $9/month देखि अपग्रेड.

10 निःशुल्क मिनेट / दिन 600 मिनेट साइन अप संग निःशुल्क क्रेडिट कार्ड छैन गुप्तिकरण गरिएको
निःशुल्क दर्ता गर्नुहोस् →
क्लाइन्ट-साइड गुप्तिकरण गरिएको भण्डारण — तपाईँको अनुक्रमणिका तपाईँको ब्राउजरमा गुप्तिकरण गरिएको छ । हामी पनि तिनीहरूलाई पढ्न सक्दैनौं । यो कसरी काम गर्दछ सिक्नुहोस् →

पाठमा भाषण मोड्युलName

तपाईँको अडियोका लागि उत्तम इन्जिन रोज्नुहोस्

सबै नमूनाहरू हेर्नुहोस् →

कसरी STT.ai काम गर्दछ

सटीक प्रतिलिपि गर्न तीन चरणहरू

१. अपलोड, रेकर्ड, वा टाँस्नुहोस् यूआरएल

कुनै पनि अडियो वा भिडियो फाइल (MP3, WAV, MP4, र 20+ ढाँचाहरू) तान्नुहोस् र छोड्नुहोस्। वास्तविक समयमा तपाईंको माइक्रोफोनबाट रेकर्ड गर्नुहोस्। वा यूट्यूब, भिमेओ, TikTok र 1,300+ प्लेटफर्महरूबाट लिंक टाँस्नुहोस्।

2. एआई मोडेल को आफ्नो चयन संग transcribes

फिट Whisper मोडेल रोज्नुहोस्: बढाइएको (ठूलो-v3, सबैभन्दा सही), टर्बो (छिटो, पूर्वनिर्धारित), मध्यम वा सानो. 99 विकल्प देखि स्वचालित-पत्ता भाषा. वक्ता diarization जो के भने पहिचान.

3. निर्यात, साझेदारी, वा एकीकृत

TXT रूपमा डाउनलोड, SRT, VTT, DOCX, JSON, वा PDF. लिंक मार्फत साझेदारी. आफ्नो अनुप्रयोगमा अनुक्रमण एकीकृत गर्न हाम्रो API प्रयोग गर्नुहोस्. उपशीर्षक लागि सही, बैठक द्रष्टव्यहरू, पोडकास्टहरू, र अधिक.

अडियो र भिडियोका लागि तपाईँलाई आवश्यक सबै कुरा

AI द्वारा संचालित निःशुल्क उपकरणहरू

100+
समर्थित भाषाहरू
59
नि: शुल्क उपकरण
1,300+
समर्थन गरिएको प्लेटफर्म
7
निर्यात ढाँचा

विकासकर्ता-पहिलो API

मिनेटमा आफ्नो अनुप्रयोगमा भाषण-देखि-पाठ एकीकृत। वास्तविक-समय WebSocket स्ट्रिमिंग संग RESTful एपीआई।

REST + वेबसकेट — फाइल अपलोड र वास्तविक समय स्ट्रिमिङ
बहुविध नमूना — Whisper टर्बो, ठूलो V3, मध्यम र सानो
वक्ता डायरिजेसन — कसले के भने स्वत: पत्ता लगाउनुहोस्
लचिलो निर्गत — JSON, TXT, SRT, VTT शब्द टाइमस्ट्याम्पहरूसँग
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

अन्य भाषणबाट पाठ सेवामा स्विच गर्दैछ?

प्रतिलिपि गर्न तयार?

आफ्नो पहिलो फाइल निःशुल्क अपलोड गर्नुहोस्। कुनै क्रेडिट कार्ड, कुनै साइन अप। 600 मिनेट नि: शुल्क योजना मा सुरु गर्न।

प्रतिलिपि सुरु गर्नुहोस्

प्राय सोधिने प्रश्नहरू

पाठमा भाषण तपाईको ब्राउजरमा चल्छ: यूआरएल टाँस्नुहोस्, फाइल अपलोड गर्नुहोस्, वा तपाईको माइकबाट रेकर्ड गर्नुहोस्। STT.ai ले एआई मोडेल रोज्दछ र5मिनेटमा रेकर्ड फिर्ता गर्दछ। TXT, SRT, VTT, DOCX, JSON, वा PDF को रूपमा निर्यात गर्नुहोस्।

हो - हरेक आगन्तुक प्राप्त 600 STT.ai मा सुरु गर्न निःशुल्क मिनेट, पाठमा भाषण लागि प्रयोग गर्न कुनै पनि अन्य कार्यप्रवाह रूपमा नै. भुक्तानी योजना $9/महिना लामो फाइलहरू अनलक सुरु, निजी transcripts, र प्राथमिकता लामबद्ध.

पाठमा भाषण STT.ai को अन्य भागको रूपमा एउटै एआई मोडेलहरूमा चल्छ - हाम्रो सबै भन्दा राम्रो मोडेलहरू सफा भाषणमा 95-97% सटीकता (बेन्चमार्कमा 3-5% शब्द त्रुटि दर) मा पुग्दछ। यदि पहिलो पास तपाईंको लक्ष्य भन्दा तल छ भने फ्लाईमा मोडेलहरू स्विच गर्नुहोस्।

पाठमा भाषण Whisper मा कुनै पनि STT.ai होस्टहरूमा चलाउन सकिन्छ - STT.ai उन्नत (Whisper ठूलो-v3, सबैभन्दा सही, भुक्तानी योजनाहरूमा), Whisper ठूलो V3, Whisper टर्बो (फास्ट), Whisper मध्यम र Whisper सानो।

हो। हरेक transcript SRT वा VTT रूपमा निर्यात - यूट्यूब संग काम गर्दछ, Vimeo, TikTok, VLC, र हरेक प्रमुख भिडियो प्लेयर। बर्न-उपशीर्षक उपकरणले हार्डसुबहरूको रूपमा भिडियोमा तिनीहरूलाई ओभरले गर्दछ।

हो । वक्ता डायराइजेसनले स्वचालित रूपमा प्रत्येक आवाज ( वक्ता १, वक्ता २,...) लेबुल गर्दछ र तपाईँले तिनीहरूलाई निर्माण गरिएको सम्पादकमा पुन: नामकरण गर्न सक्नुहुन्छ । सबै नमूना र भाषाहरूमा काम गर्दछ ।

धेरैजसो पाठमा भाषण कार्यहरू ५ मिनेटमा समाप्त हुन्छन् । १ घण्टा अडियो फाइल सामान्यतया हाम्रो छिटो मोडेलहरूसँग २-३ मिनेटमा पूरा हुन्छ । गति चयन गरिएको मोडेल र हालको GPU लोडमा निर्भर गर्दछ ।

पाठमा भाषण ले 20+ ढाँचाहरू स्वीकार गर्दछ - एमपी3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, वेबएम, AVI, र अधिक। टीएक्सटी, एसआरटी, वीटीटी, DOCX, जेसन, वा पीडीएफमा निर्गत।

हो। पाठमा भाषण मा पेश गरिएको अडियो फाइलहरू पूर्वनिर्धारित रूपमा प्रक्रिया र मेटाइन्छ। प्रो योजनाहरूले क्लाइन्ट-साइड गुप्तिकरण थप्दछ - यदि STT.ai को डाटाबेस उल्लंघन भए पनि, तपाईंको लिखितहरू तपाईंको कुञ्जी बिना पढ्न सकिँदैन। डेटा स्पष्ट विकल्प-इन बिना मोडेल प्रशिक्षणको लागि कहिल्यै प्रयोग गरिँदैन।

हो। STT.ai पाइथन र Node.js एसडीकेहरूको साथ एक REST API प्रस्ताव गर्दछ, साथै क्लाउड र कर्सरको लागि एक एमसीपी सर्भर - सबै पाठमा भाषण कार्यप्रवाहहरूको लागि प्रयोग गर्न सकिन्छ। नि: शुल्क एपीआई तहमा 100 मिनेट / महिना समावेश छ।

हो। हरेक transcript तपाईं शब्दहरू सही गर्न सक्नुहुन्छ जहाँ निर्माण सम्पादक मा खोलिन्छ, वक्ताहरू पुन: नामकरण, timestamps समायोजन, र द्रष्टव्य थप्न। सबै परिवर्तन स्वचालित रूपमा बचत।

प्रत्येक transcript एक अद्वितीय shareable यूआरएल प्राप्त. ईमेल लागि DOCX वा PDF निर्यात. प्रो योजनाहरू पासवर्ड-सुरक्षित र स्थायी लिङ्क थप्न - ग्राहक काम लागि उपयोगी.

STT.ai युट्युब, भिमेओ, टिक-टॉक, साउन्डक्लाउड, जुम, गुगल मीट, पोडकास्ट होस्टहरू र अधिक सहित 1,300+ प्लेटफर्महरू ह्यान्डल गर्दछ। यूआरएल अनुक्रमण केवल सार्वजनिक रूपमा उपलब्ध सामग्रीसँग काम गर्दछ - डीआरएम-सुरक्षित स्रोतहरू अनुक्रमण गर्न सकिँदैन।