Àwọn Àmì-ìwé

Klọ́nọ̀ọ̀kan àwọn ìrànwọ́ láti inú àwọn àyọkà ìsàlẹ̀-ilà ìpẹ̀lú. Fi àwọn ìsàlẹ̀-ilà 3-10 sekúndù láti sọ, tẹ̀ àkọlé rẹ̀, àti kọ̀ọ̀kan ìsàlẹ̀-ilà nínú ìrànwọ́ náà.

Klọ́ọ̀nì: fi àwọn àyọkà ìṣàfihàn 3-10s pamọ́. Àtòjọ-ẹ̀yàn: yan láti inú àwọn ìsàlẹ̀-ilà àwọn ìtàn-àti-ìtàn.
Fi àwòrán àkọlé pamọ́
MP3, WAV, M4A, FLAC
Àwọn ààtòjọ-ẹ̀yàn VibeVoice tí a fi pamọ́ sí ìtàn Ing̀íẹ̀lì, Jamani, Fẹ́rẹ̀sì, Jàpán, Korea, Pọ́tìgìnì, Pọ́tìgìnì, Sẹ́faanì, Italì, Dùpẹ̀lì.
Àwọn àyọkà 500 to pọ́jú
0/500
Ló àwọn ìṣàmúlò-ètò 1 fún ìṣàfihàn kan
Àwọn àwòrán tí a ṣẹ̀dà
Bií O ṣe N ṣiṣẹ́
1
Fi àkọlé pamọ́

Fi àwọn ìsàlẹ̀-ilà 3-10 sékuǹdì̀ kan pamọ́ láti inú ìsàlẹ̀-ilà tí o fẹ́ láti kọ́lọ́nù.

2
Àwọn Àmì-ìwé

F5-TTS gba àwọn àbùdá àwọn ìrànwọ́: àwọn ìṣàfarawé, àwọn ìṣàfarawé, àwọn ìṣàfarawé, àwọn ìṣàfarawé.

3
Ṣẹ̀dà Àwọn Àkọlé

Àkọ́lé rẹ̀ tí a sọ nínú ìrànwọ́ ìṣàmúlò-ètò. Gbá ìṣàmúlò-ètò náà láti inú WAV.

Àwọn ìṣàfarawe àwọn àwòrán ní fún ìlòòrò àti ìlòòrò. Kò fi àwòrán àwọn àwòrán pamọ́ láti àwọn àwòrán.

Ǹtí o fẹ́ ìṣàfarawé àwọn àkọ́lé, kò jẹ́ àtòjọ-ẹ̀yàn?

Fi àwòrán àti àwòrán pamọ́, tàbí fi líǹkì pàtó — Ìṣàfilọ́lẹ̀ AI nínú àwọn ìtàn 100+ nípa ìṣàfilọ́lẹ̀ àwọn awáròyìn. Àwọn iṣẹ́jú 10 tí a fi pamọ́ lórí ọjọ́, àti àwọn

Àwọn Àtòjọ-ẹ̀yàn

Ìṣàmúlò-ètò àwọn àmì-ìwé n bọ nínú àwá-ìwé rẹ: pa URL kan, gbé fáìlì lọ́wọ́lọ́wọ́, tàbí kọ́pà láti inú míkòòdù rẹ̀. STT.ai gba àwọn àwọn móòdù AÌ láti pà àwọn àkọ́lé padà sípò nínú àwọn àkókò 5. Fi pamọ́ lórí TXT, SRT, VTT, DOCX, JSON, tàbí PDF.

Yes — every visitor gets 600 free minutes/month on STT.ai, usable for Ìṣàmúlò-ètò àwọn àmì-ìwé the same as any other workflow. Paid plans starting at $5/month unlock longer files, private transcripts, and priority queueing.

Ìṣàmúlò-ètò àwọn àmì-ìwé runs on the same AI models as the rest of STT.ai — our best models reach 95-97% accuracy on clean speech (3-5% Word Error Rate on benchmarks). Switch models on the fly if the first pass is below your target.

Ìṣàmúlò-ètò àwọn àmì-ìwé lè rọ́ọ̀nù lórí àwọn móòdù 10+ STT.ai - STT.ai Enhanced (ó ní ìmọ́ jú lọ), Whisper Large V3 (99 àwòrán), NVIDIA Canary (#1 WER lórí àwọn ààyè tí a gbọ́dọ̀, Whisper Turbo (ìfárá), Moonshine (ìfárá).

Ya. Gbogbo àwọn ìṣàmúlò-ètò náà náà láti inú SRT tàbí VTT - lò nípa YouTube, Vimeo, TikTok, VLC, àti gbogbo àwọn awáròyìn àwòrán nla. Àtòjọ-ẹ̀yàn àwọn àkọlé-ìdákọ́ náà náà sí àwòrán bí àwọn àkọlé-ìdákọ́.

Ya. Ìṣàfihàn àwọn àkọlé àìdálẹ̀ àwọn àkọlé àìdálẹ̀

Most Ìṣàmúlò-ètò àwọn àmì-ìwé jobs finish in under 5 minutes. A 1-hour audio file typically completes in 2-3 minutes with our fastest models. Speed depends on chosen model and current GPU load.

Ìṣàmúlò-ètò àwọn àmì-ìwé gba àwọn ìrísí-lẹ́tà 20+ - MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, àti àwọn mìíràn. Àwọn ìṣàfilọ́lẹ̀ sí TXT, SRT, VTT, DOCX, JSON, tàbí PDF.

Yes. Audio files submitted to Ìṣàmúlò-ètò àwọn àmì-ìwé are processed and deleted by default. Pro plans add client-side encryption — even if STT.ai's database is breached, your transcripts are unreadable without your key. Data is never used for model training without explicit opt-in.

Ya. STT.ai nfun REST API pẹlu Python ati Node.js SDKs, nínú àwọn sáà MCP fún Claude ati Cursor — gbogbo àwọn tí a lè lò fún Ìṣàmúlò-ètò àwọn àmì-ìwé àwọn ìṣàmúlò-ètò iṣẹ́. Àwọn ààyè API àìfẹ́ ní 100 àkókò/óṣù.

Ya. Àwọn ìṣàmúlò-ètò gbogbò tí a ṣì nínú àwọn àkọ́lé ààyè-iṣẹ́ tí a fi pamọ́ nínú àwọn àwọn àmì-ìwé, àwọn àkọ́lé àwọn àkọ́lé, àwọn à

Àwọn àkọ́lé gbogbó ní gba URL tí a lè gbọ́dọ̀ kọ̀ọ̀kan. Ṣàfikún sí DOCX tàbí PDF fún àìwé-ìwé. Àwọn àwọn à

STT.ai n ṣetọju awọn oju-iwe ayelujara 1,300+ pẹlu YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, awọn ile-iṣẹ podcast, ati diẹ sii. Iyipada URL n ṣiṣẹ pẹlu awọn ohun ti o wa ni gbangba nikan - awọn orisun ti a daabobo nipasẹ DRM ko le ṣe atunṣe.