Audio en texte en ligne gratuit
Convertissez l'audio en texte avec la transcription par IA. Téléchargez des fichiers audio, enregistrez depuis votre micro ou collez une URL. Plus de 100 langues, 10+ modèles, 98%+ de précision.
1. Téléchargez l'audio
Téléchargez MP3, WAV, M4A, FLAC, OGG ou tout format audio. Jusqu'à 2 Go.
2. L'IA traite l'audio
L'IA extrait la parole de votre audio avec détection des locuteurs et horodatages.
3. Obtenez votre transcription
Consultez, éditez, téléchargez ou partagez. Exportez en TXT, SRT, VTT, DOCX ou PDF.
Modèles audio vers texte
Choisissez le modèle d'IA adapté à vos besoins — ou laissez-nous choisir le meilleur.
Transcrire l'audio en plus de 100 langues
Cas d'utilisation audio vers texte
Prêt à convertir l'audio en texte ?
Commencer gratuitement →Questions fréquemment posées
Téléchargez votre fichier audio ou collez une URL, choisissez un modèle AI, et cliquez sur Transcribe. STT.ai retourne un texte modifiable avec des horodatages et des étiquettes de haut-parleur — la plupart des fichiers finissent en moins de cinq minutes.
MP3, WAV, M4A, FLAC, OGG, AAC, AMR et 10+ sont tous pris en charge. Vous n'avez pas besoin de convertir entre les formats d'abord — télécharger quelque soit votre enregistreur ou app produit.
Un peu. Les formats sans perte comme WAV et FLAC portent bit-perfect audio, donc la précision est limitée uniquement par le modèle et la clarté de l'enceinte. Les formats sans perte (MP3, M4A) à 128 kbps ou plus sont effectivement identiques; les bits très bas de moins de 64 kbps peuvent coûter quelques points.
Oui. STT.ai comprend 600 minutes gratuites pour commencer sans inscription pour votre premier dossier. Les plans payés à partir de 5 $/mois ajoutent des fichiers plus longs, des transcriptions privées et le traitement des priorités.
Sur un son propre, nos meilleurs modèles atteignent 95-97% de précision (3-5% de taux d'erreur Word). Le bruit de fond, les haut-parleurs recoupant et les accents forts sont les principaux facteurs qui réduisent la précision.
Oui. Les utilisateurs gratuits peuvent transcrire jusqu'à une heure par fichier; les plans payés s'étendent à 8 heures et plus, ce qui couvre les podcasts, les interviews et les livres audio en un seul passage.
Oui. La diarisation des haut-parleurs marque chaque voix (Parleur 1, Haut-parleur 2,...) et vous pouvez les renommer dans l'éditeur — fonctionne sur chaque format audio et modèle pris en charge.
Exporter vers les sous-titres TXT, DOCX, PDF, JSON ou SRT/VTT. JSON conserve les horodatages et les étiquettes de haut-parleur lisibles par machine; DOCX et PDF sont les meilleurs pour le partage et l'archivage.
Oui. 100+ langues avec détection automatique, plus l'option de configurer la langue manuellement. L'audio en langage mixte est géré en changeant le fichier intermédiaire, et vous pouvez traduire le résultat après.
Oui. L'audio est traité et supprimé par défaut, et les plans Pro ajoutent le chiffrement côté client de sorte que les transcriptions sont illisibles sans votre clé. Rien n'est utilisé pour la formation sans opt-in explicite.
Oui. Collez un lien de l'une des 1 300 plateformes supportées (hôtes podcast, SoundCloud, YouTube, etc.) et STT.ai récupèrez directement l'audio. Les sources protégées par DRM ne peuvent pas être transcrites.
Oui. L'API REST accepte directement les fichiers audio, avec les SDKs Python et Node.js et un niveau gratuit de 100 minutes/mois. La facturation par seconde s'applique au-delà du niveau gratuit.