Lliure d' àudio al text en línia
Converteix l' àudio al text amb una transcripció intel· ligent. Carrega fitxers d' àudio, registre del micròfon, o enganxant un URL. 100+ idiomes, models oberts, format del 98%+ precisió.
1. Puja l' àudio
Publica MP3, WAV, M4A, FLAC, OGG, o qualsevol format d' àudio. Fins a 2GB.
2, IA processos d' àudio
L'AI exclou el discurs de l'àudio amb detecció de l'altaveu i marques de temps.
3. Agafa el teu Transcript.
Visualitza, edita, descarrega o comparteix. Exporta com TXT, SRT, VT, DOCX, o PDF.
Àudio als models de text
Escolliu el model IA que encaixi amb les vostres necessitats o deixeu-nos triar el millor.
Grava l' àudio en 100+ llengües
Àudio als casos d' ús de text
Preparat per convertir àudio al text?
Inicia lliure →Preguntes més freqüents
Puja el fitxer d' àudio o enganxa un URL, escolliu un model AA i cliqueu Trancric. STT.ai retorna el text editable amb marques de temps i etiquetes d' altaveu que acaben en menys de cinc minuts.
MP3, WAV, M4A, FLAC, OGG, AAC, AMR i 10+ més estan tots permesos. No cal convertir entre formats primer konc pujar el que produeix la teva gravadora o l' aplicació.
Una mica. Els formats sense pèrdua com WAV i FLAC porten àudio bit-perfect, per tant la precisió només està vinculada pel model i la claredat de l' altaveu. Els formats de pèrdua (MP3, M4A) en 128 kbps o superior són idèntics efectivament; les taxa de bits molt baixes sota 64 kbps poden costar alguns punts.
Sí. STT.ai inclou 600 minuts lliures per mes sense signar pel vostre primer fitxer. Els plans que s' han d' iniciar a $9/ mesos afegeixen fitxers més llargs, transcripcions privades i processament de prioritat.
En netejar els nostres millors models d' àudio abasten el 95- 9% de precisió (3% de la taxa d' error de paraula). El soroll de fons, els parlants sobreposades i els accents forts són els factors principals que tenen una precisió menor.
Sí. Els usuaris lliures poden transcribir fins a una hora per fitxer; els plans pagats s'estenen a 8+ hores, que cobreixen podcasts d' alta longitud, entrevistes i llibres d'àudio en un sol pas.
Sí. Presidenta diarization etiquetes cada veu (parlador 1, President 2,...) i els podeu reanomenar a l' editor Kork treballa en tots els formats d' àudio acceptats i model.
Exporta a TXT, DOCX, PDF, JSON o SRT/ VT subtítols. JSON manté marques de temps llegibles i etiquetes d' altaveu; DOCX i PDF són millors per a compartir i arxivar.
Sí. 100+ idiomes amb auto- detectació, i l' opció per establir manualment el llenguatge. L' àudio mixt en l' idioma es gestiona canviant el fitxer mig, i després podeu traduir el resultat.
Sí. L' àudio es processa i s' esborra per omissió, i els plans Pro, afegeixen un xifrat client a la vora de la qual les transcripcions no són illegibles sense la vostra clau. No s' usa res per a entrenar sense opt- hi explícites.
Sí. Enganxa un enllaç des de qualsevol de 1.300+ plataformes acceptades per podcasts de podcasts de podcasts de podcasts de podcast, màquines de soCloudd, YouTube i més identificador i STT.ai recull directament l' àudio. No es poden transclar fonts d' àudio.
Sí. L' API REST accepta directament fitxers d' àudio, amb Python i Nodes.js SDKs i un corbata lliure de 100 minuts/ mesos. Per segon, s' aplica més enllà del òmbol.