AI gratuit Discours au texte

Tracez audio et vidéo au texte en plus de 100 langues. Modèles multiples de Whisper. Détection des haut-parleurs. Pas d'inscription requise.

12.1K
transcriptions
290.6K
minutes transcrites
100+
langues
70+
outils gratuits

Fonctionne avec audio et vidéo accessibles au public. Le contenu protégé par DRM n'est pas pris en charge.

Mise à niveau pour amélioration
Transcription privée
Dialogue avec la transcription
Débloquer avec Pro →
Déposer le fichier ici ou cliquer pour parcourir
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — jusqu'à 2 Go
Mise à niveau pour amélioration
Transcription privée
Dialogue avec la transcription
Débloquer avec Pro →
Mise à niveau pour amélioration
Enregistrement : 0:00
Temps réel Vosk (instantanément)
Amélioration Whisper (préciser)
Liens publics: 24h, texte seulement · Inscrivez-vous pour 7d + audio · Pour pour les liaisons privées

La parole en temps réel au texte. L'IA corrige automatiquement lorsque vous parlez — la précision s'améliore avec la parole plus longue.

Testez d'abord votre microphone
❤️ Aimez STT.ai? Dites à vos amis!
Vous avez utilisé vos transcriptions gratuites

Inscrivez-vous gratuitement pour obtenir 600 minutes, ou mise à jour à partir de 5 $/mois pour des milliers de plus.

10 min/jour gratuit 600 min sans inscription Pas de carte de crédit Chiffres
Inscrivez-vous gratuitement →
Stockage chiffré côté client — Vos transcriptions sont cryptées dans votre navigateur. Même nous ne pouvons pas les lire. Apprenez comment ça marche →

Comment STT.ai fonctionne

Trois étapes pour une transcription précise

1. Télécharger, enregistrer ou coller l'URL

Faites glisser et déposez tout fichier audio ou vidéo (formats MP3, WAV, MP4 et 20+). Enregistrez votre microphone en temps réel. Ou collez un lien à partir de YouTube, Vimeo, TikTok et 1.300+ plates-formes.

2. L'IA transcrit avec votre choix de modèle

Choisissez le modèle Whisper qui convient : Enhanced (large-v3, le plus précis), Turbo (rapide, le par défaut), Medium ou Small. Le langage de détection automatique à partir de 99 options. La diarisation des haut-parleurs identifie qui a dit quoi.

3. Exportation, part ou intégration

Téléchargez en tant que TXT, SRT, VTT, DOCX, JSON ou PDF. Partagez via un lien. Utilisez notre API pour intégrer la transcription dans votre application. Parfait pour les sous-titres, les notes de réunion, les podcasts, etc.

100+
Langues prises en charge
70+
Outils gratuits
1,300+
Plateformes prises en charge
7
Formats d'exportation

Développeur-Première API

Intégrez la parole au texte dans votre application en quelques minutes. RESTful API avec diffusion WebSocket en temps réel.

REST + WebSocket — Téléchargement de fichiers et diffusion en temps réel
Modèles multiples — Turbo à fouet, V3, moyen et petit
Diarisation des orateurs — Détectez automatiquement qui a dit quoi
Sortie flexible — JSON, TXT, SRT, VTT avec horodatage de mots
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Prêt à transcrire?

Téléchargez votre premier fichier gratuitement. Pas de carte de crédit, pas d'inscription. 600 minutes pour commencer sur le plan gratuit.

Commencer le tracking

Questions fréquemment posées

discours au texte fonctionne dans votre navigateur : collez une URL, téléchargez un fichier ou enregistrez depuis votre micro. STT.ai choisit le modèle AI et retourne la transcription en moins de 5 minutes. Exportez en TXT, SRT, VTT, DOCX, JSON ou PDF.

Oui — chaque visiteur obtient 600 minutes gratuites pour démarrer sur STT.ai, utilisable pour discours au texte la même chose que tout autre workflow. Plans payants à partir de 5 $/mois déverrouiller les fichiers plus longs, les transcriptions privées, et la file d'attente prioritaire.

discours au texte fonctionne sur les mêmes modèles d'IA que le reste de STT.ai — nos meilleurs modèles atteignent 95-97% de précision sur la parole propre (3-5% Word Error Rate sur les repères).

discours au texte peut fonctionner sur n'importe quel des modèles de Whisper STT.ai hôtes — STT.ai Enhanced (Whisper grand-v3, le plus précis, sur les régimes payés), Whisper grand V3, Whisper Turbo (fast), Whisper moyen et Whisper petit.

Oui. Chaque transcription exporte comme SRT ou VTT — fonctionne avec YouTube, Vimeo, TikTok, VLC, et chaque lecteur vidéo majeur. L'outil de sous-titres de gravure les superpose sur la vidéo comme des sous-titres durs.

Oui. La diarisation des haut-parleurs marque automatiquement chaque voix (Parleur 1, Haut-parleur 2,...) et vous pouvez les renommer dans l'éditeur intégré. Fonctionne dans tous les modèles et langues.

La plupart des tâches discours au texte finissent en moins de 5 minutes. Un fichier audio d'une heure complète généralement en 2-3 minutes avec nos modèles les plus rapides. La vitesse dépend du modèle choisi et de la charge GPU actuelle.

discours au texte accepte les formats 20+ — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, et plus. Sortie vers TXT, SRT, VTT, DOCX, JSON ou PDF.

Oui. Les fichiers audio soumis à discours au texte sont traités et supprimés par défaut. Les plans Pro ajoutent le chiffrement côté client — même si la base de données de STT.ai est violée, vos transcriptions sont illisibles sans votre clé. Les données ne sont jamais utilisées pour la formation du modèle sans opt-in explicite.

Oui. STT.ai offre une API REST avec des SDKs Python et Node.js, plus un serveur MCP pour Claude et Cursor — tous utilisables pour les workflows discours au texte. Le niveau d'API gratuit comprend 100 minutes/mois.

Oui. Chaque transcription s'ouvre dans l'éditeur intégré où vous pouvez corriger les mots, renommer les haut-parleurs, ajuster les horodatages et ajouter des notes. Tous les changements s'enregistrent automatiquement.

Chaque transcription reçoit une URL partagée unique. Exporter vers DOCX ou PDF pour l'email. Les plans pro ajoutent des liens permanents et protégés par mot de passe – utiles pour le travail du client.

STT.ai gère plus de 1300 plateformes dont YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast hosts, etc. La transcription des URL fonctionne avec du contenu accessible au public seulement — les sources protégées par DRM ne peuvent pas être transcrites.