Свабодны онлайн-аўдыё-тэкстName
Ператварэньне аўдыё ў тэкст з дапамогай транскрыпцыі на аснове штучнага інтэлекту. Загрузка аўдыёфайлаў, запіс з мікрафона ці ўстаўка URL. 100+ моваў, 10+ мадэляў, 98%+ дакладнасьць.
Загрузіць гук
Загрузка MP3, WAV, M4A, FLAC, OGG, або любога іншага фармату. Да 2 Гб.
2. AI апрацоўвае гук
AI выводзіць мову з вашага аўдыё з выяўленнем гукарэжысёра і часовымі штампамі.
3. Атрымаць ваш транскрыпт
Прагляд, рэдагаваньне, сцягваньне і абмен. Экспарт у фармаце TXT, SRT, VTT, DOCX ці PDF.
Модулі пераўтварэння аўдыё ў тэкстName
Выберыце мадэлі машыннага навучання, якія адпавядаюць вашым патрэбам, або дайце нам выбраць найлепшую.
Транскрыпцыя аўдыё на 100+ мовах
Пераўтварыць гук у тэкст?
Пачаць бясплатна →Часта задаваемыя пытанні
Загрузка аўдыё файла або ўстаўка URL, выбар мадэлі AI і націск Транскрыпцыя. STT.ai вяртае рэдагуемы тэкст з часовымі знакамі і зваротнымі спасылкамі на гаворку - большасць файлаў скончыцца менш чым за пяць хвілін.
Падтрымліваюцца фарматы MP3, WAV, M4A, FLAC, OGG, AAC, AMR і яшчэ 10+ іншых. Не трэба пераўтвараць фарматы, проста загрузіце тое, што вытворыць ваш запісчык ці праграма.
Неяк. Без страт фарматы, такія як WAV і FLAC, пераносяць аўдыё з ідэальнымі бітамі, таму дакладнасць абмяжоўваецца толькі мадэллю і гучнасцю гукавой каробкі. Форматы з стратамі (MP3, M4A) з 128 кб/ с і вышэй фактычна ідэнтычныя; вельмі нізкія бітрэйсы ніжэй 64 кб/ с могуць каштаваць некалькі пунктаў.
Так. STT.ai уключае 600 бясплатных хвілін, каб пачаць без падпіскі на ваш першы файл. Плацежныя планы, пачынаючы з $ 5 / месяц, дадаюць доўгія файлы, прыватныя транскрыпты і прыярытэтную апрацоўку.
Нашы лепшыя мадэлі дасягаюць дакладнасці 95- 97% (3- 5% памылак у словах) пры чыстай гукавой інфармацыі. Фонавы шум, перакрываючыяся гукавыя сістэмы і моцныя акцэнты - галоўныя фактары, якія зніжаюць дакладнасць.
Так. Бясплатныя карыстальнікі могуць перапісваць да аднаго гадзіны на файл; платныя планы пашыраюць гэта да 8+ гадзін, што ахоплівае поўны доўг падкастаў, інтэрв'ю і аўдыёкніг у адным праходзе.
Так. Дыялёг гукавых файлаў падпісвае кожны голас (Голас 1, Голас 2,...) і вы можаце змяніць іх назву ў рэдактара - працуе на ўсіх падтрымліваемых аўдыёфарматах і мадэлях.
Экспарт субтытраў у фармат TXT, DOCX, PDF, JSON або SRT/ VTT. JSON захоўвае часопісныя надпісы і зваротныя спасылкі на гаворку; DOCX і PDF найбольш падыходзяць для абмену і архівавання.
Так. Больш за 100 моў з аўтаматычным выяўленнем, плюс магчымасць усталяваць мову ўручную. Смешаныя аўдыё- мовы апрацоўваюцца пераключэннем у сярэдзіне файла, і вы можаце перакласці вынік пасля.
Так. Па змаўчанні гук апрацоўваецца і выдаляецца, а ў Pro- планах дадаецца шыфраванне з боку кліента, таму транскрыпты не чытаюцца без вашага ключа. Нішто не выкарыстоўваецца для трэніровак без выразнага дазволу.
Так. Усталюйце спасылку з любой з 1300+ падтрымліваемых платформаў - падкаст-хостынг, SoundCloud, YouTube і іншыя - і STT.ai атрымае аўдыё. DRM-ахоўваныя крыніцы не могуць быць перапісаныя.
Так. REST API прымае аўдыё файлы без прамежкаў, з Python і Node.js SDK і бясплатным пакетам 100 хвілін/месяц. Секундная аплата прымяняецца да вышэйшых за бясплатны пакет.