Sgwrs Am Ddim i Destun Ar-leinName
Trosi siarad i destun gyda throsglwyddiad a bwerir gan AI. Llwytho ffeiliau sain, recordio o'ch meicroffon, neu gludo URL. 100+ iaith, 10+ model, 98%+ o gywirdeb.
1. Lanlwytho Recordiad Lleferydd
Llwytho ffeil sain neu fideo, gludo URL, neu recordio siarad o'ch meicroffon.
2. AI yn Trosi Lleferydd i Destun
Dewis o 10+ modelau AI. Canfod siaradwr a chanfod iaith yn awtomatig yn cynnwys.
3. Allforio' ch Trawssgrifiad
Lawrlwytho mewn 6 fformat. Rhannu cysylltiadau trosysgrif gyda chwarae sain.
Modelau Lleferydd i DestunName
Dewiswch y model AI sy'n gweddu i'ch anghenion - neu gadewch i ni ddewis yr un gorau.
Speech-to-Text mewn 100+ o ieithoedd
Cyflwyniad i' r Cynllun
& Gwaredu Iaith
Cychwyn Rhydd →Cwestiynau a Ofynnir yn Aml
Mae Speech to text (a elwir hefyd yn adnabyddiaeth siarad neu ASR) yn trosi sain a lefarwyd yn ymysgogol i eiriau ysgrifenedig. Mae STT.ai yn rhedeg eich recordiad drwy ddull AI sy'n gwrando ar yr sain ac yn allbwn testun golygus gyda stampiau amser a labelau siaradwr - nid oes angen teipio.
Mae model sain yn mapio'r ffurf tonnau sain i fonemau, ac yna mae model iaith yn eu gosod i mewn i'r geiriau a'r atalnodi mwyaf tebygol. Mae STT.ai yn gwneud hyn ar GPU gyda modelau fel Whisper Large V3 a NVIDIA Canary, felly mae recordiad awr yn cael ei wneud yn aml mewn 2-3 munud.
Ie. Mae gan bob ymwelydd 600 munud am ddim i ddechrau heb angen cofrestru ar gyfer eich ffeil gyntaf. Mae cynlluniau talu yn dechrau ar $5/mis ac yn ychwanegu ffeiliau hirach, traethodau preifat, a phrosesu blaenoriaeth.
Ar siarad clir, mae ein modelau gorau yn cyrraedd cywirdeb o 95-97% (Cyfradd Gwallau Geiriau o 3-5% ar feini prawf). Mae cywirdeb yn gostwng gyda sŵn cefndir, caneuon trwm, croes-sgwrsio, neu sain bit-rate isel - mae defnyddio meicroffon da a ystafell llym yn gwneud y gwahaniaeth mwyaf.
Ie. Meddyliwch i'ch microffon a bydd STT.ai yn ffrydio'r trosglwyddiad yn fyw drwy'r offeryn trosglwyddo byw. Gallwch hefyd lwytho recordiad wedi'i gwblhau i lawr ar gyfer trosglwyddo batch os nad ydych ei angen gair wrth air wrth siarad.
Mae STT.ai yn adnabod 100+ o ieithoedd ac yn darganfod yr iaith a lefarwyd yn awtomatig ar gyfer y rhan fwyaf o sain. Gallwch hefyd osod yr iaith â llaw er mwyn gwella cywirdeb ychydig, a thrinir recordiadau ieithoedd cymysg drwy newid yn y canol-clip.
Ydy. Mae diareiddio siaradwyr yn labelu pob llais (Sgwrsydd 1, Sgwrsydd 2,...) a gallwch eu hail-enwi yn y golygydd. Mae hyn yn gweithio ar draws pob model ac iaith a gynhelir.
Mae STT.ai yn derbyn 20+ fformatau gan gynnwys MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, ac AVI. Allbwn i TXT, SRT, VTT, DOCX, JSON, neu PDF.
Mae'r cyfieithiad i destun yn trosysgrifo'r hyn a ddywedir i'r geiriau; mae adnabyddiaeth llais (dysgadwyedd siaradwr) yn penderfynu PWY a ddywedodd hynny. Mae STT.ai yn gwneud y ddau - trosysgrifo ynghyd â diareiddio siaradwr - ond mae'r termau'n disgrifio tasgau gwahanol.
Ydy. Mae sain yn cael ei brosesu a'i ddileu yn rhagosodedig. Mae cynlluniau Pro yn ychwanegu cêl- ysgrifennu ochr y cleient felly mae trosysgrifau yn anlofnodadwy heb eich allwedd, hyd yn oed i STT.ai, a ni ddefnyddir eich data erioed ar gyfer hyfforddi modelau heb optio i mewn yn glir.
Ydy. Mae gan STT.ai API REST gyda SDKs Python a Node.js yn ogystal â gweinydd MCP ar gyfer Claude a Cursor. Mae'r lefel API am ddim yn cynnwys 100 munud/mis, gyda biliau fesul eiliad ar ôl hynny.
Ydy. Mae pob trosysgrif yn agor mewn golygydd mewnol lle gallwch chi drwsio geiriau a glywyd yn anghywir, ail- enwi siaradwyr, addasu stampiau amser, ac ychwanegu nodiadau. Mae' r golygu' n parhau ar draws pob fformat allforio.