IA gratuita Discorso al testo

Trascrivi audio e video a testo in 100+ lingue. Modelli multipli di Whisper. Rilevamento diffusori. Nessun segno richiesto.

12K
trascrizioni
290.3K
minuti trascritti
100+
lingue
70+
strumenti liberi

Funziona con audio e video pubblicamente disponibili. I contenuti protetti da DRM non sono supportati.

Aggiornamento per Enhanced
Trascrizione privata
Parlare con la trascrizione
Sblocca con Pro →
Rilascia il file qui o fai clic per navigare
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM fino a 2GB
Aggiornamento per Enhanced
Trascrizione privata
Parlare con la trascrizione
Sblocca con Pro →
Aggiornamento per Enhanced
Registrazione: 0:00
In tempo reale Vosk (istante)
Migliorato Sussurro (accurato)
Collegamenti pubblici: 24h, solo testo · Iscriviti per 7d + audio · Pro per collegamenti privati

Discorso in tempo reale al testo. AI auto-corregge mentre si parla di precisione di galattosio migliora con il discorso più lungo.

Prova prima il microfono
❤️ Love STT.ai? Dillo ai tuoi amici!
Hai usato le tue trascrizioni gratuite.

Iscriviti gratuitamente per ottenere 600 minuti, o l'aggiornamento da $5/mese per migliaia di più.

10 minuti/giorno gratuiti 600 min gratis con iscrizione Nessuna carta di credito Cifrato
Iscriviti gratis →
Archiviazione crittografata lato client — Le tue trascrizioni sono criptate nel tuo browser. Scopri come funziona →

Come funziona STT.ai

Tre passaggi per una trascrizione accurata

1. Caricare, registrare o incollare l'URL

Trascinare e rilasciare qualsiasi file audio o video (MP3, WAV, MP4, e 20+ formati). Registrare dal microfono in tempo reale. Oppure incollare un link da YouTube, Vimeo, TikTok, e 1.300+ piattaforme.

2. AI Trascrive con la tua scelta di modello

Scegli il modello Whisper che si adatta: Enhanced (large-v3, più preciso), Turbo (veloce, il predefinito), Medio o Piccolo. Auto-rilevare il linguaggio da 99 opzioni. Diarizzazione degli altoparlanti identifica chi ha detto cosa.

3. Esporta, condividi o integra

Scarica come TXT, SRT, VTT, DOCX, JSON o PDF. Condividi tramite link. Usa la nostra API per integrare la trascrizione nella tua app. Perfetto per sottotitoli, note di riunione, podcast e altro ancora.

100+
Lingue supportate
70+
Strumenti gratuiti
1,300+
Piattaforme supportate
7
Esporta formati

Sviluppatore-Prima API

Integra la parola al testo nell'app in pochi minuti. API RESTful con streaming WebSocket in tempo reale.

REST + WebSocket — Caricamento file e streaming in tempo reale
Modelli multipli — Turbo sussurrante, grande V3, medio e piccolo
Diarizzazione degli altoparlanti — Rilevamento automatico di chi ha detto cosa
Uscita flessibile — JSON, TXT, SRT, VTT con tasti orari
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Pronto a trascrivere?

Carica il tuo primo file gratis. Nessuna carta di credito, nessun segno. 600 minuti per iniziare il piano gratuito.

Inizia a trascrivere

Domande frequenti

discorso al testo viene eseguito nel browser: incolla un URL, carica un file o registra dal tuo mic. STT.ai seleziona il modello AI e restituisce la trascrizione in meno di 5 minuti. Esporta come TXT, SRT, VTT, DOCX, JSON o PDF.

Sì, ogni visitatore riceve 600 minuti gratuiti per iniziare su STT.ai, utilizzabile per discorso al testo lo stesso di qualsiasi altro flusso di lavoro. Piani pagati a partire da $5/mese sbloccare file più lunghi, trascrizioni private, e la coda di priorità.

discorso al testo funziona sugli stessi modelli AI come il resto di STT.ai.. I nostri migliori modelli raggiungono la precisione del 95-97% sulla parola pulita (3-5% Word Error Rate sui benchmark).

discorso al testo può funzionare su uno qualsiasi dei modelli Whisper STT.ai host.. STT.ai Enhanced (Whisper large-v3, più preciso, su piani a pagamento), Whisper Large V3, Whisper Turbo (veloce), Whisper Medium e Whisper Small.

Sì. Ogni trascrizione esporta come SRT o VTT Hoppenstedt funziona con YouTube, Vimeo, TikTok, VLC e ogni lettore video principale. Lo strumento di masterizzazione-sottotitoli li sovrasta su video come hardsub.

Sì. La diarizzazione dei diffusori etichetta automaticamente ogni voce (Speaker 1, Speaker 2,...) e puoi rinominarli nell'editor integrato. Funziona su tutti i modelli e linguaggi.

La maggior parte dei lavori discorso al testo termina in meno di 5 minuti. Un file audio di 1 ora di solito completa in 2-3 minuti con i nostri modelli più veloci. La velocità dipende dal modello scelto e dal carico GPU attuale.

discorso al testo accetta 20+ formati © © MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI e altro ancora. Uscita su TXT, SRT, VTT, DOCX, JSON o PDF.

Sì. I file audio inviati a discorso al testo vengono elaborati e cancellati per impostazione predefinita. Piani Pro aggiungono crittografia lato client ©Client anche se STT.ai database è violato, le trascrizioni sono illeggibili senza la chiave. I dati non vengono mai utilizzati per l'addestramento di modelli senza esplicito opt-in.

Sì. STT.ai offre un'API REST con SDK Python e Node.js, più un server MCP per Claude e Cursor ® tutti utilizzabili per discorso al testo flussi di lavoro. Il livello API gratuito include 100 minuti al mese.

Sì. Ogni trascrizione si apre nell'editor integrato dove è possibile correggere le parole, rinominare gli altoparlanti, regolare il timestamp e aggiungere note. Tutte le modifiche salvano automaticamente.

Ogni trascrizione ottiene un unico URL condivisibile. Esporta in DOCX o PDF per email. Piani Pro aggiungere link password-protetti e permanenti

STT.ai gestisce oltre 1.300 piattaforme tra cui YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, host podcast e altro ancora. La trascrizione URL funziona con contenuti pubblici solo © DRM-protected sources is not be transcribed.