Laisvas garsas tekstui internete
Konvertuoti garsą į tekstą su AI-motored transkripcija. Įkelkite garso failus, įrašyti iš savo mikrofono, arba įklijuokite URL. 100+ kalbos, 10+ modeliai, 98%+ tikslumas.
1. Įkelkite garsą
Įkelkite MP3, WAV, M4A, FLAC, OGG ar bet kokio garso formato. Iki 2GB.
2. AI apdoroja garsą
AI ištraukia kalbą iš jūsų garso su garsiakalbio aptikimo ir žymes.
3. Gaukite savo transkripciją
Peržiūrėti, redaguoti, parsisiųsti ar pasidalinti. Eksportuoti kaip TXT, SRT, VTT, DOCX ar PDF.
Garso ir tekstų modeliai
Pasirinkite AI modelį, atitinkantį jūsų poreikius, arba leiskite mums pasirinkti geriausią.
Atsekti garsą 100+ kalbomis
Pasiruošę konvertuoti garsą į tekstą?
Pradėti nemokamai →Dažnai užduodami klausimai
Įkelkite savo garso failą arba įklijuokite URL, pasirinkite AI modelį, ir spustelėkite Perrašo. STT.ai grąžinkite redaguojamą tekstą timestamp reikšmėmis ir garsiakalbio etiketėmis — dauguma failų baigti per penkias minutes.
MP3, WAV, M4A, FLAC, OGG, AAC, AMR ir 10+ palaikomi. Jums nereikia konvertuoti tarp formatų pirmiausia – įkelkite, ką jūsų įrašymo aparatas ar programėlė gamina.
Maža. Nuostolingi formatai, pavyzdžiui, WAV ir FLAC atlikti bitų tobulos garso, todėl tikslumas yra apribotas tik modelio ir garsiakalbio aiškumo. Nuostolingi formatai (MP3, M4A) esant 128 kbps ar didesnis yra efektyviai identiški; labai mažas bitų skaičius iki 64 kbps gali kainuoti kelis taškus.
Taip. STT.ai apima 600 nemokamai minučių pradėti be registracijos jūsų pirmasis failas. Mokami planai pradedant $5 mėnesį pridėti ilgiau failus, privačių stenogramos, ir prioritetinis apdorojimas.
Švaraus garso atveju mūsų geriausi modeliai pasiekia 95-97% tikslumo (3-5% žodžio klaidų rodiklis).
Taip. Nemokami vartotojai gali transliuoti iki vienos valandos už failą; apmokami planai pratęsti, kad iki 8+ valandų, kuri apima viso ilgio Podcast, interviu, ir garso knygų vienu perdavimu.
Taip. Garsiakalbio diarizacijos etiketes kiekvieną balsą (garsiakalbis 1, garsiakalbis 2,...) ir galite pervadinti juos redaktorius — veikia kiekvieną palaikomą garso formatą ir modelį.
Eksportuoti į TXT, DOCX, PDF, JSON, arba SRT/VTT subtitrai. JSON palaiko žymes ir garsiakalbius; DOCX ir PDF geriausiai dalijasi ir archyvuoja.
Taip. 100+ kalbos su automatinio nustatymo, plius galimybė nustatyti kalbą rankiniu būdu. Mišrus kalbos garso tvarko perjungiant vidurinį failą, ir jūs galite versti rezultatą po to.
Taip. Audio yra apdorojamas ir ištrinamas pagal numatytąjį, ir Pro planai pridėti kliento pusėje šifravimo, todėl transkriptai yra neįskaitomi be jūsų rakto. Nieko nėra naudojamas mokymui be aiškios pasirinkimo.
Taip. Įdėti nuorodą iš bet kurios iš 1300+ palaikomų platformų – Podcast šeimininkai, SoundCloud, "YouTube", ir daugiau – ir STT.ai gauna garso tiesiogiai. DRM-apsaugoti šaltiniai negali būti transliuojamas.
Taip. REST API tiesiogiai priima garso failus, su Python ir Node.js SDK ir nemokama pakopa 100 minučių/mėnesį. Už sekundę sąskaita taikoma už nemokamą pakopą.