AI liberă Discursul textului

Transcrie audio & video în text în 100 de limbi. Modele multiple de Whisper. Detecție de speaker. Nu este necesară înregistrarea.

12.2K
transcripții
292.9K
minute transcrise
100+
limbi
70+
instrumente libere

Funcționează cu audio și video disponibil public. Conținutul DRM-protectat nu este suportat.

Upgrade pentru îmbunătăţire
Transcription privată
Discutați cu transcripție
Deschide cu Pro →
Aruncă fișierul aici sau click pentru a naviga
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — până la 2GB
Upgrade pentru îmbunătăţire
Transcription privată
Discutați cu transcripție
Deschide cu Pro →
Upgrade pentru îmbunătăţire
Înregistrarea: 0:00
În timp real Vosk (instant)
Îmbunătățit Whisper (exact)
Legături publice: 24h, text doar · Înscrie-te pentru audio 7d + · Pro pentru legături private

Discursul în timp real la text. AI corectează automat în timp ce vorbiți — precizia îmbunătățește cu discursul mai lung.

Testează-ţi primul microfonul.
❤️ Love STT.ai? Tell your friends!
Ţi-ai folosit transcripţiile libere.

Inregistreaza-te gratis pentru a primi 600 de minute, sau upgrade de la 5$/luna pentru mii de minute.

10 min/zi gratis 600 min gratuit cu înscriere Nici o carte de credit Cifrat
Inscrie-te gratis →
Depozitul criptat al clientului — Transcripcionele tale sunt criptate în browser-ul tău, chiar şi noi nu le putem citi. Învaţă cum funcţionează →

Încrederea profesioniştilor din întreaga lume

Cum funcționează STT.ai

Trei pași până la o transcriere exactă

1. Încarcă, înregistrează sau înregistrează URL

Aruncă și aruncă orice fișier audio sau video (MP3, WAV, MP4, și 20+ formate). Înregistrează de la microfonul în timp real. Sau colează un link de la YouTube, Vimeo, TikTok și 1.300+ platforme.

2. AI Transcrie cu alegerea ta de model

Alege modelul Whisper care se potriveste: Înălțime (large-v3, cel mai precis), Turbo (fast, implicit), Medium sau Small. Detectare automată limbaj din 99 de opțiuni. Diarizarea speaker identifică cine a spus ce.

3. Export, Share sau Integrare

Descărcați ca TXT, SRT, VTT, DOCX, JSON sau PDF. Share via link. Folosește API-ul nostru pentru a integra transcripția în aplicația ta. Perfect pentru subtitrare, notițe de întâlnire, podcast-uri și mai multe.

100+
Limbi suportate
70+
Unelte gratuite
1,300+
Platforme susținute
7
Formate de export

Dezvoltator-Primă API

Integrați textul-de-voastră în minute. API RESTful cu streaming WebSocket în timp real.

REST + WebSocket — Încărcare fișier și streaming în timp real
Modele multiple — Whisper Turbo, V3, mediu & mic
Diarizarea speakerului — Auto-detectare care a spus ce
Ieșire flexibilă — JSON, TXT, SRT, VTT cu marca temporală a cuvântului
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Eşti gata să transcrii?

Încărcaţi primul fişier gratuit. Fără carte de credit, fără înscriere. 600 minute pentru a începe pe planul gratuit.

Începe traducerea

Întrebări frecvente

discursul în text rulează în browserul tău: încoace o URL, încarcă un fișier sau înregistrează de la microfonul tău STT.ai alege modelul IA și returnează transcriptionul în mai puțin de 5 minute. Exportă ca TXT, SRT, VTT, DOCX, JSON sau PDF.

Da — fiecare vizitator are 600 de minute libere pentru a începe pe STT.ai, utilizabil pentru discursul în text la fel ca orice alt flux de lucru. Planurile platite începând cu 5$/luna deblocare fișiere mai lungi, transcripții private și coada prioritară.

discursul în text se execută pe aceleași modele de IA ca restul STT.ai – cele mai bune modele ajung la precizia 95-97% pe discurs curat (3-5% Rata de eroare Word pe benchmarks).

discursul în text poate rula pe oricare dintre modelele Whisper STT.ai gazde — STT.ai Enhanced (Whisper mare-v3, cel mai precis, pe planurile plătite), Whisper mare V3, Whisper Turbo (fata), Whisper mediu și Whisper small.

Da. Fiecare transcriere exportă ca SRT sau VTT - lucrează cu YouTube, Vimeo, TikTok, VLC, și fiecare video player major. Instrumentul de ardere-subtitles le suprapune pe video ca hardsubs.

Da. Diarizarea speakerului etichetă automat fiecare voce (Speaker 1, Speaker 2,...) și le puteți renomi în editorul integrat. Lucrează în toate modelele și limbile.

Cele mai multe discursul în text de locuri de muncă se termină în mai puţin de 5 minute. Un fișier audio de 1 oră se completează în 2-3 minute cu cele mai rapide modele noastre. Viteza depinde de modelul ales și încărcare curentă GPU.

discursul în text acceptă 20+ formate — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, și mai multe. Produsă la TXT, SRT, VTT, DOCX, JSON sau PDF.

Da. Fişierele audio transmise la discursul în text sunt prelucrate şi șterse prin defect. Pro planuri adaugă criptarea de la client - chiar dacă baza de date STT.ai este încălcată, transcripţiile sunt nelegibile fără cheia ta. Datele nu sunt folosite niciodată pentru formarea modelului fără opti-in explicit.

Da. STT.ai oferă o API REST cu Python și Node.js SDKs, plus un server MCP pentru Claude și Cursor — toate utilizabile pentru discursul în text fluxuri de lucru. Nivel API gratuit include 100 minute/luna.

Da. Fiecare transcriptare se deschide în editorul integrat unde puteți corecta cuvintele, renomați speakers, ajustați timelor orare și adaugă notițe. Toate modificările salvează automat.

Fiecare transcriere obține o URL unică împărțibilă. Exportă în DOCX sau PDF pentru e-mail. Pro planuri adaugă legăturile protejate cu parola și permanente — utile pentru munca clientului.

STT.ai se ocupă de 1.300 platforme, inclusiv YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, găzduitoare de podcast, și mai multe. Transcription URL funcționează doar cu conținut disponibil public — surse protejate de DRM nu pot fi transcrise.