Lliure d' àudio al text en línia

Converteix l' àudio al text amb una transcripció intel· ligent. Carrega fitxers d' àudio, registre del micròfon, o enganxant un URL. 100+ idiomes, models oberts, format del 98%+ precisió.

Funciona amb el & vídeo d' àudio públic & disponible. El contingut de DRM no està implementat.

Actualització per millorar
Recripció privada
Xat amb transcripció
Desbloqueja amb Pro →
Deixeu anar el fitxer aquí o cliqueu per a navegar
MP3, WAV, M4A, FLAC, MP4, MKV, MV, MOV, WebM KDE fins a 2GB
Actualització per millorar
Recripció privada
Xat amb transcripció
Desbloqueja amb Pro →
Actualització per millorar
Gravació: 0:00
Temps real Vosk (instant) russia_ subjects. kgm
Millorada Rumuz (acrati)
Enllaços públics: 24h, només text · Signa per a 7d + àudio · Pro per a enllaços privats

El discurs en temps real al text. Els errors de l' IA tal i com esteu parlant milloren les precisiós amb el discurs més llarg.

Primer prova el micròfon
❤️ Love STT.ai? Tell your friends!
Has utilitzat les teves transcripcions lliures

Signa't per obtenir 600 minuts, o actualitzar-se des de 9/ mesos per milers més.

10 dies lliures 600 mins de franc amb senyal Sense targeta de crèdit Xifrat
Compareu- vos lliurement →

1. Puja l' àudio

Publica MP3, WAV, M4A, FLAC, OGG, o qualsevol format d' àudio. Fins a 2GB.

2, IA processos d' àudio

L'AI exclou el discurs de l'àudio amb detecció de l'altaveu i marques de temps.

3. Agafa el teu Transcript.

Visualitza, edita, descarrega o comparteix. Exporta com TXT, SRT, VT, DOCX, o PDF.

Formats d' àudio acceptats

Àudio als models de text

Escolliu el model IA que encaixi amb les vostres necessitats o deixeu-nos triar el millor.

Preparat per convertir àudio al text?

Inicia lliure →

Preguntes més freqüents

Puja el fitxer d' àudio o enganxa un URL, escolliu un model AA i cliqueu Trancric. STT.ai retorna el text editable amb marques de temps i etiquetes d' altaveu que acaben en menys de cinc minuts.

MP3, WAV, M4A, FLAC, OGG, AAC, AMR i 10+ més estan tots permesos. No cal convertir entre formats primer konc pujar el que produeix la teva gravadora o l' aplicació.

Una mica. Els formats sense pèrdua com WAV i FLAC porten àudio bit-perfect, per tant la precisió només està vinculada pel model i la claredat de l' altaveu. Els formats de pèrdua (MP3, M4A) en 128 kbps o superior són idèntics efectivament; les taxa de bits molt baixes sota 64 kbps poden costar alguns punts.

Sí. STT.ai inclou 600 minuts lliures per mes sense signar pel vostre primer fitxer. Els plans que s' han d' iniciar a $9/ mesos afegeixen fitxers més llargs, transcripcions privades i processament de prioritat.

En netejar els nostres millors models d' àudio abasten el 95- 9% de precisió (3% de la taxa d' error de paraula). El soroll de fons, els parlants sobreposades i els accents forts són els factors principals que tenen una precisió menor.

Sí. Els usuaris lliures poden transcribir fins a una hora per fitxer; els plans pagats s'estenen a 8+ hores, que cobreixen podcasts d' alta longitud, entrevistes i llibres d'àudio en un sol pas.

Sí. Presidenta diarization etiquetes cada veu (parlador 1, President 2,...) i els podeu reanomenar a l' editor Kork treballa en tots els formats d' àudio acceptats i model.

Exporta a TXT, DOCX, PDF, JSON o SRT/ VT subtítols. JSON manté marques de temps llegibles i etiquetes d' altaveu; DOCX i PDF són millors per a compartir i arxivar.

Sí. 100+ idiomes amb auto- detectació, i l' opció per establir manualment el llenguatge. L' àudio mixt en l' idioma es gestiona canviant el fitxer mig, i després podeu traduir el resultat.

Sí. L' àudio es processa i s' esborra per omissió, i els plans Pro, afegeixen un xifrat client a la vora de la qual les transcripcions no són illegibles sense la vostra clau. No s' usa res per a entrenar sense opt- hi explícites.

Sí. Enganxa un enllaç des de qualsevol de 1.300+ plataformes acceptades per podcasts de podcasts de podcasts de podcasts de podcast, màquines de soCloudd, YouTube i més identificador i STT.ai recull directament l' àudio. No es poden transclar fonts d' àudio.

Sí. L' API REST accepta directament fitxers d' àudio, amb Python i Nodes.js SDKs i un corbata lliure de 100 minuts/ mesos. Per segon, s' aplica més enllà del òmbol.