AI آواز جو کلونر
ڪنھن به آواز کي ھڪ مختصر آڊيو ڪلپ مان ڪلون ڪريو. 3-10 سيڪنڊن جي ڳالھائڻ کي اپ لوڊ ڪريو، پنھنجي متن کي لکو ۽ ھڪ آواز ۾ آڊيو پيدا ڪريو.
کلون: 3-10s حوالو ڪلپ مهيا ڪريو. اڳيون ٺاھيو: گڏيل ڪيترن ٻولين وارن آوازن مان چونڊيو.
آواز جي حوالي آڊيو اپ لوڊ ڪريو
MP3, WAV, M4A, FLAC
ويبي واءِس جا اڳيون ترتيب ڏنل ترتيبون انگريزي، جرمني، فرانسيسي، جاپاني، ڪوريائي، پولش، پورٽوگالي، اسپينش، اٽليائي، ڊچ.
500 کان وڌيڪ نشان
0/500
1 ڪريڊٽ استعمال ڪندو آھي
ڪيئن ڪم ڪري ٿو
1
حوالو اپ لوڊ ڪريو
3-10 سيڪنڊن جي صاف ڳالھائڻ جي اجازت ڏيو ان آواز مان جيڪو توهان کلون ڪرڻ چاهيو ٿا.
2
AI آواز جو جائزو وٺندو آھي
F5-TTS آواز جون خاصيتون ڪڍي ٿو: ٽون، پيچ، ڳالهائڻ جو انداز، ڌيان.
3
ڳالھائڻ پيدا ڪريو
پنھنجو متن کلون ٿيل آواز ۾ چئبو. نتيجو WAV جي صورت ۾ ڊائون لوڊ ڪريو.
آوازن جو کلون ڪرڻ صرف ذاتي ۽ اجازت ڏنل استعمال لاءِ آھي. ڳالهائيندڙ جي رضامندي کانسواءِ آوازن جو کلون نه ڪريو.
پورو ترنسڪريٽ جي ضرورت آهي، نه رڳو هڪ اوزار؟
آڊيو يا وڊيو اپ لوڊ ڪريو، يا رابطو لڳايو — AI 100+ ٻولين ۾ ترجمو ڪندڙ ڳالهائيندڙ جي ڳولا سان. 10 مفت منٽ ڏينهن، ڪو به رجسٽريشن.
گھڻا پڇيل سوال
آواز جو کلون توھان جي برائوزر ۾ هلندو آھي: URL کي چٽيو، فائل اپ لوڊ ڪريو، يا توھان جي مائڪ کان رڪارڊ ڪريو. STT.ai AI ماڊل چونڊيندو آھي ۽ 5 منٽن ۾ ترانسڪريپٽ موٽائيندو آھي. TXT، SRT، VTT، DOCX، JSON يا PDF طور برآمد ڪريو.
ھائو - هر هڪ مهمان STT.ai تي شروع ڪرڻ لاءِ 600 مفت منٽ حاصل ڪري ٿو، آواز جو کلون لاءِ استعمال ڪري سگهجي ٿو جيئن ڪنهن به ٻئي ڪم جي وهڪري وانگر. ادا ڪيل منصوبا $5 / مهيني ۾ شروع ٿيندڙ ڊگهي فائلن، ذاتي ترڪيبون ۽ ترجيح واري قطار کي کولڻ.
آواز جو کلون STT.ai جي باقي حصي وانگر AI ماڊل تي هلندو آهي - اسان جا بهترين ماڊل صاف ڳالهائڻ تي 95-97٪ درستگي تائين پهچي ٿو (3-5٪ لفظ غلطي جي شرح تي بينڪ مارڪ). جيڪڏهن پهريون پاسو توهان جي مقصد جي هيٺان آهي ته ماڊل کي تبديل ڪريو.
آواز جو کلون STT.ai جي 10+ ماڊل جي ڪنهن به تي هلائي سگھي ٿو - STT.ai وڌايل (سڀ کان وڌيڪ صحيح)، ويسپر وڏي V3 (99 ٻوليون)، NVIDIA ڪينري (#1 WER مدد ڪيل langs تي)، ويسپر ٽوربو (فائيئر)، مونشاين (ھلڪو وزن) ۽ وڌيڪ.
ھائو. سڀ ترنسڪريٽ SRT يا VTT طور برآمد ڪري ٿو — يوٽيوب، ويميو، ٽڪ ٽاڪ، وي ايل سي ۽ سڀ وڊيو پليئر سان ڪم ڪري ٿو. برائون-سوٽائيٽس ٽولز انهن کي وڊيو تي هارڊ سبس وانگر مٿاڇري ڪري ٿو.
ھائو. اسپيڪر جي ڊيائريزيشن پاڻمرادو هر آواز کي نشان لڳائيندو آھي (Speaker 1, Speaker 2,...) ۽ توھان انھن جو نالو داخل ٿيل ايڊيٽر ۾ مٽائي سگھوٿا. سڀ ماڊل ۽ ٻوليون ڪم ڪن ٿيون.
آواز جو کلون جا وڏا ڪم 5 منٽن کان گھٽ ۾ پورا ٿيندا آھن. ھڪ ڪلاڪ جي آڊيو فائل عام طور اسان جي تيز ماڊلن سان 2-3 منٽن ۾ مڪمل ٿيندي آھي. رفتار چونڊيل ماڊل ۽ موجوده GPU لوڊ تي منحصر آھي.
آواز جو کلون 20+ فارميٽ قبول ڪري ٿو - MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, ۽ وڌيڪ. TXT, SRT, VTT, DOCX, JSON, يا PDF ۾ نڪتو.
ھائو. آڊيو فائلون جيڪي آواز جو کلون کي موڪليون ويون آھن سي عمل ۾ آيون آھن ۽ اڻ سڌو سنئون ختم ڪيون ويون آھن. پرو پلان ڪلائنٽ پاسي جي ڪوڊنگ شامل ڪندا آھن - جيتوڻيڪ جيڪڏھن STT.ai جي ڊيٽابيس ۾ ڀڃڪڙي ٿئي ٿي، توھان جون ترانسڪريپشن توھان جي ڪوڊ کانسواءِ پڙھڻ ۾ نه اينديون. ڊيٽا ڪڏهن به ماڊل جي تربيت لاءِ استعمال نه ٿيندو آھي بغير واضح طور تي داخل ٿيڻ جي.
ھائو. STT.ai Python ۽ Node.js SDKs سان REST API پيش ڪري ٿو، ۽ Claude ۽ Cursor لاءِ MCP سرور — سڀ آواز جو کلون ڪم جي وهڪري لاءِ استعمال ڪري سگهجي ٿو. مفت API ٽائر ۾ 100 منٽ / مهينو شامل آهي.
ھائو. سڀئي ترانسڪريٽ اندروني ايڊيٽر ۾ کولبا جتي توھان لفظ درست ڪري سگھوٿا، ڳالهائيندڙن جو نالو مٽائي سگھوٿا، وقت جي نشانين کي ترتيب ڏئي سگھوٿا ۽ نوٽس شامل ڪري سگھوٿا. سڀ تبديليون پاڻمرادو محفوظ ڪيون وينديون.
هر transcript هڪ منفرد شيئر ڪري سگھجي ٿو URL حاصل ڪري ٿو. DOCX يا PDF اي ميل لاء برآمد. پرو منصوبن پاسورڊ-محفوظ ۽ دائمي لنڪ شامل ڪريو - گراهڪ جي ڪم لاء فائديمند.
STT.ai يوٽيوب ، ويميو ، ٽڪ ٽاڪ ، ساؤنڊ ڪلوڊ ، زووم ، گوگل ميٽ ، پوڊ ڪاسٽ هوسٽس ۽ وڌيڪ سميت 1,300+ پليٽ فارمن کي هلائي ٿو. URL ترميم صرف عوامي رسائي واري مواد سان ڪم ڪري ٿي - DRM-محفوظ ذريعن کي ترميم نه ڪري سگهجي ٿو.