Laisva AI Kalba tekstui
Atsekti garso ir vaizdo įrašą į tekstą 100+ kalbomis. Keli Whisper modeliai. Garsiakalbio aptikimas. Nėra užregistravimo.
Pasitiki specialistai visame pasaulyje
Kalba tekstinių modelių kalba
Pasirinkite geriausią variklį garsui
Kaip veikia STT.ai
Trys žingsniai siekiant tikslaus transkripcijos
1. Įkelkite, įrašykite, arba įdėti URL
Vilkite ir numeskite bet kokį garso ar vaizdo failą (MP3, WAV, MP4 ir 20+ formatai). Įrašykite iš savo mikrofono realiu laiku. Arba įdėkite nuorodą iš "YouTube", "Vimeo", "TikTok", ir 1300+ platformų.
2. AIS perrašinėja su Jūsų pasirinktu modeliu
Pasirinkite Whisper modelį, kuris tinka: Padidintas (didelė V3, tiksliausias), Turbo (greitas, numatytasis), Vidutinis arba mažas. Auto-detektorius kalba iš 99 parinkčių. Garsiakalbis diarizacija nustato, kas sakė, ką.
3. Eksportuoti, Share, arba integruoti
Atsisiųskite kaip TXT, SRT, VTT, DOCX, JSON arba PDF. Pasidalinkite per nuorodą. Naudokite mūsų API, kad integruotų transkripciją į savo app. Puikiai tinka subtitrams, posėdžio užrašams, podcast, ir daugiau.
Viskas, ko jums reikia garso ir vaizdo įrašų
70+ nemokamai įrankiai, maitinami AI
Programuotojas- pirmasis API
Integruokite kalbą-į-tekstą į savo app minutės. RESTful API su realiu laiku WebSocket srautų.
import requests
response = requests.post(
"https://api.stt.ai/v1/transcribe",
headers={"Authorization": f"Bearer {API_KEY}"},
files={"file": open("meeting.mp3", "rb")},
data={
"model": "large-v3-turbo",
"language": "auto",
"diarize": "true",
"response_format": "json",
},
)
result = response.json()
for seg in result["segments"]:
print(f"{seg['speaker']}: {seg['text']}")
Perėjimas nuo kitos kalbos prie teksto tarnybos?
Paprastas, skaidrus kainų nustatymas
Pradėti nemokamai. Mastelis, kai jūs augate.
Pasiruošę transliuoti?
Išsiuntkite pirmąjį failą nemokamai. Nėra kredito kortelės, nėra registracijos. 600 minučių pradėti nuo nemokamo plano.
Pradėti transkripciją