Free AI Гузаштан ба матн
Тасвири аудио ва видео ба матн дар 100+ забонҳо. Бисёр моделҳои Whisper. Муайянкунии сухангӯ. Бақайдгирӣ лозим нест.
Боэътимоди мутахассисони ҷаҳонӣ
Модулҳои гуфтугӯ ба матнName
Интихоби беҳтарин хидматрасон барои аудиои шумо
Чӣ тавр STT.ai кор мекунад
Се қадам барои дуруст навиштан
1. Боркунӣ, сабткунӣ ё гузоштани URL
Ҳар як файли аудиоӣ ё видеоиро кашола кунед ва партоед (MP3, WAV, MP4 ва 20+ форматҳо). Аз микрофон дар вақти воқеӣ сабт кунед. Ё пайвандро аз YouTube, Vimeo, TikTok ва 1300+ платформаҳо часпонед.
2. AI бо интихоби шумои модел нусхабардорӣ мекунад
Интихоби намуди Whisper, ки мувофиқ аст: Барқароршуда (v3- и калон, дақиқтарин), Турбо (суръатнок, пешфарз), Миёна ё хурд. Муайянкунии худкори забон аз 99 вариантҳо. Диарризатсияи сухангӯ муайян мекунад, ки кӣ чӣ гуфт.
3. Содирот, Мубодила ё Якҷоякунӣ
Боргирӣ ҳамчун TXT, SRT, VTT, DOCX, JSON ё PDF. Мубодила тавассути пайванд. Барои ҳамроҳ кардани транскрипсия ба барномаи худ API-и моро истифода баред. Барои зерсарлавҳаҳо, ёддоштҳои вохӯрӣ, подкастҳо ва ғайра комил аст.
Ҳама чизе, ки шумо барои аудио ва видео лозим аст
70+ асбобҳои ройгон бо AI
Барномасозон
Дар як дақиқа ба барномаи худ гуфтугӯи матнӣ дохил кунед. RESTful API бо WebSocket-и вақти воқеӣ.
import requests
response = requests.post(
"https://api.stt.ai/v1/transcribe",
headers={"Authorization": f"Bearer {API_KEY}"},
files={"file": open("meeting.mp3", "rb")},
data={
"model": "large-v3-turbo",
"language": "auto",
"diarize": "true",
"response_format": "json",
},
)
result = response.json()
for seg in result["segments"]:
print(f"{seg['speaker']}: {seg['text']}")
Гузариш аз дигар хидмати гуфтугӯ ба хидмати матнӣ?
Содда, нархгузории шаффоф
Аз озодӣ оғоз кунед. Бо афзоиш андоза кунед.
Ба гузарондан омода ҳастед?
Файли якуми худро ройгон бор кунед. Бе корти кредитӣ, бе қайд. 600 дақиқа барои оғози нақшаи ройгон.
Оғози нусхабардорӣ