Laisvas garsas tekstui internete

Konvertuoti garsą į tekstą su AI-motored transkripcija. Įkelkite garso failus, įrašyti iš savo mikrofono, arba įklijuokite URL. 100+ kalbos, 10+ modeliai, 98%+ tikslumas.

Veikia su viešai prieinama garso ir vaizdo medžiaga. DRM apsaugotas turinys nepalaikomas.

Atnaujinti tobulinimui
Privatus stenograma
Pokalbis su stenograma
Atrakinti su Pro →
Numeskite failą čia arba spustelėkite norėdami naršyti
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM – iki 2GB
Atnaujinti tobulinimui
Privatus stenograma
Pokalbis su stenograma
Atrakinti su Pro →
Atnaujinti tobulinimui
Įrašas: 0:00
Realusis laikas Voskas (nuolat)
Sustiprintas Visper (tikslus)
Viešosios nuorodos: 24h, tik tekstas · Užsiregistruoti skirtas 7d + audio · Pro asmeniniams ryšiams

Kalbėjimas realiu laiku su tekstu. AIS auto-korekcija, kai jūs kalbate — tikslumas pagerina ilgiau kalba.

Pirmiausia patikrinkite mikrofoną
❤️ Love STT.ai? Tell your friends!
Jūs naudojote savo nemokamus transkripciją

Užsiregistruoti nemokamai gauti 600 minučių, arba atnaujinti nuo $5 mėnesių tūkstančiams daugiau.

10 nemokamų min. per dieną 600 min be registracijos Nėra kredito kortelės Šifruojama
Užsiregistruoti nemokamai →

1. Įkelkite garsą

Įkelkite MP3, WAV, M4A, FLAC, OGG ar bet kokio garso formato. Iki 2GB.

2. AI apdoroja garsą

AI ištraukia kalbą iš jūsų garso su garsiakalbio aptikimo ir žymes.

3. Gaukite savo transkripciją

Peržiūrėti, redaguoti, parsisiųsti ar pasidalinti. Eksportuoti kaip TXT, SRT, VTT, DOCX ar PDF.

Palaikomi garso formatai

Garso ir teksto naudojimo atvejai

Pasiruošę konvertuoti garsą į tekstą?

Pradėti nemokamai →

Dažnai užduodami klausimai

Įkelkite savo garso failą arba įklijuokite URL, pasirinkite AI modelį, ir spustelėkite Perrašo. STT.ai grąžinkite redaguojamą tekstą timestamp reikšmėmis ir garsiakalbio etiketėmis — dauguma failų baigti per penkias minutes.

MP3, WAV, M4A, FLAC, OGG, AAC, AMR ir 10+ palaikomi. Jums nereikia konvertuoti tarp formatų pirmiausia – įkelkite, ką jūsų įrašymo aparatas ar programėlė gamina.

Maža. Nuostolingi formatai, pavyzdžiui, WAV ir FLAC atlikti bitų tobulos garso, todėl tikslumas yra apribotas tik modelio ir garsiakalbio aiškumo. Nuostolingi formatai (MP3, M4A) esant 128 kbps ar didesnis yra efektyviai identiški; labai mažas bitų skaičius iki 64 kbps gali kainuoti kelis taškus.

Taip. STT.ai apima 600 nemokamai minučių pradėti be registracijos jūsų pirmasis failas. Mokami planai pradedant $5 mėnesį pridėti ilgiau failus, privačių stenogramos, ir prioritetinis apdorojimas.

Švaraus garso atveju mūsų geriausi modeliai pasiekia 95-97% tikslumo (3-5% žodžio klaidų rodiklis).

Taip. Nemokami vartotojai gali transliuoti iki vienos valandos už failą; apmokami planai pratęsti, kad iki 8+ valandų, kuri apima viso ilgio Podcast, interviu, ir garso knygų vienu perdavimu.

Taip. Garsiakalbio diarizacijos etiketes kiekvieną balsą (garsiakalbis 1, garsiakalbis 2,...) ir galite pervadinti juos redaktorius — veikia kiekvieną palaikomą garso formatą ir modelį.

Eksportuoti į TXT, DOCX, PDF, JSON, arba SRT/VTT subtitrai. JSON palaiko žymes ir garsiakalbius; DOCX ir PDF geriausiai dalijasi ir archyvuoja.

Taip. 100+ kalbos su automatinio nustatymo, plius galimybė nustatyti kalbą rankiniu būdu. Mišrus kalbos garso tvarko perjungiant vidurinį failą, ir jūs galite versti rezultatą po to.

Taip. Audio yra apdorojamas ir ištrinamas pagal numatytąjį, ir Pro planai pridėti kliento pusėje šifravimo, todėl transkriptai yra neįskaitomi be jūsų rakto. Nieko nėra naudojamas mokymui be aiškios pasirinkimo.

Taip. Įdėti nuorodą iš bet kurios iš 1300+ palaikomų platformų – Podcast šeimininkai, SoundCloud, "YouTube", ir daugiau – ir STT.ai gauna garso tiesiogiai. DRM-apsaugoti šaltiniai negali būti transliuojamas.

Taip. REST API tiesiogiai priima garso failus, su Python ir Node.js SDK ir nemokama pakopa 100 minučių/mėnesį. Už sekundę sąskaita taikoma už nemokamą pakopą.