د متن په انلاین وړیا وینا
د AI-powered transcription سره متن ته د خبرو بدلول. د غږ فایلونه پورته کړئ، د خپل مایکروفون څخه ریکارډ، یا یو URL واچوئ. 100 + ژبې، خلاص ماډلونه، 98٪ + دقیق.
1. د خبرو ثبتولو پورته
غږيزه يا ويډيو دوتنه لېښل، يو URL نښلول، يا له خپل غږيزې دوتنې څخه خبرې ثبتول.
2. AI د متن ته وینا بدلوي
د Whisper ماډل چې ستاسو د غږ برابر انتخاب. د غږونو کشف او ژبه د اتومات کشف شامل دي.
3. ستاسو د نقل صادرول
په 6 بڼو کې ډاونلوډ کړئ. د غږیز غږولو سره د نقل لینکونه شریک کړئ.
د ليکنې لپاره د وينا ماډلونه
د AI ماډل غوره کړئ چې ستاسو اړتیاوې پوره کوي - یا اجازه راکړئ چې غوره غوره کړو.
په 100 + ژبو کې د متن خبرې
د ليکنې لپاره د وينا بدلولو لپاره چمتو ياست؟
وړیا پېل →ډېرې پوښتنې
د متن خبرو ته (د خبرو پیژندلو یا ASR په نوم هم یادیږي) په اوتومات ډول د لیکل شوي کلمو ته د خبرو آډیو بدلوي. STT.ai ستاسو ریکارډ د AI ماډل له لارې چلوي چې د آډیو اوریدل او د وختونو او سفیر لیبلونو سره د تعدیل وړ متن تولیدوي - هیڅ ډول ډول اړتیا نلري.
د آکوستیک ماډل د فونیمونو لپاره د غږ څپې شکل نقشه کوي، بیا د ژبې ماډل هغه کسان راټولوي چې د احتمالي کلمو او ټکو کې راځي. STT.ai د ویسپ کورنۍ (لوی V3 او توربو) سره د GPU په اړه دا کوي، نو د یو ساعت ریکارډ معمولا په 2-3 دقیقو کې ترسره کیږي.
هو. هر لیدونکی د خپل لومړي فایل لپاره د اړتیا وړ د 600 وړیا دقیقو سره په میاشت کې د 600 وړیا دقیقې ترلاسه کوي. د تادیې پلانونه په $ 9 / میاشت کې پیل کیږي او اوږدې فایلونه، شخصي نقلونه او د لومړیتوب پروسس اضافه کړئ.
په پاکې وینا کې زموږ غوره ماډلونه د 95-97٪ دقت ته رسیږي (د معیارونو په اړه د 3-5٪ کلمې غلطۍ نرخ). د پس منظر غږ، دروند غږ، کراسټال، یا ټیټ بیټریټ آډیو سره دقت راټیټیږي - د یو مناسب مایکروفون او آرام خونه کارولو سره ترټولو لوی توپیر کوي.
هو. ستاسو په مایکروفون کې خبرې وکړئ او د ژوندی-ترمیم وسیلې له لارې د STT.ai جریانونو ژوندی نقل کړئ. تاسو کولی شئ د ډله ایزې ژباړې لپاره بشپړ ریکارډ هم پورته کړئ که تاسو د کلمې په واسطه کلمه ته اړتیا نلرئ لکه څنګه چې تاسو خبرې کوئ.
STT.ai د 100 + ژبو پیژني او د ډیری غږ لپاره د غږیز ژبې اټکل کوي. تاسو کولی شئ د کوچني دقیق لیفت لپاره په لاسي ډول ژبه هم تنظیم کړئ، او د مخلوط ژبې ریکارډونه د منځني کلیپ په بدلولو سره اداره کیږي.
هو. د غږونکي diarization هر غږ نښانونه (غږونکی 1، غږونکی 2،...) او تاسو کولی شئ په سمونګر کې دوی نوم بدل کړئ. دا په هر ملاتړ شوي ماډل او ژبه کې کار کوي.
STT.ai په شمول د MP3، WAV، M4A، FLAC، OGG، MP4، MKV، MOV، WebM، او AVI 20+ بڼې مني. ته TXT، SRT، VTT، DOCX، JSON، یا PDF محصول.
د متن خبرې کول په کلمو کې څه ویل شوي؛ د غږ پیژندنه (د غږ پیژندنه) دا معلوموي چې څوک یې وویل. STT.ai دواړه کوي - د غږ لیکل او د غږ لیکل - مګر شرایط مختلف دندې تشریح کوي.
هو. آډیو د تل لپاره پروسس او حذف کیږي. د پرو پلانونه د پیرودونکي خوا کوډ کولو اضافه کوي نو د ترانسکریپټونه ستاسو د کلید پرته غیر قابل لوستلو دي، حتی STT.ai ته، او ستاسو ډاټا هیڅکله د واضح انتخاب پرته د ماډل روزنې لپاره نه کارول کیږي.
هو. STT.ai د پایټن او نوډ. جی ایس SDKs سره یو REST API لري او د کلاډ او کرسر لپاره یو MCP سرور. د وړیا API کچه د 100 دقیقې / میاشت شامل دي، د هر ثانیې بل سره.
هو. هر نقل په جوړ شوي مدیر کې پرانیستل کیږي چیرې چې تاسو کولی شئ غلط کلمې حل کړئ، د ویناوالو نوم بدل کړئ، د وخت ټایمپونه تنظیم کړئ او یادونه اضافه کړئ. د هر صادراتو بڼه کې بدلونونه دوام لري.