الذكاء الاصطناعي المجاني تحويل الكلام إلى نص

نسخ الصوت والفيديو إلى النص في 100 + لغات. نماذج متعددة خفقان. الكشف عن المتحدث. لا تسجيل مطلوب.

12K
محاضر
290.3K
محاضر تم تدوينها
100+
اللغات
70+
الأدوات الحرة

يعمل مع الصوت والفيديو المتاحين للجمهور. لا يدعم المحتوى المحمي بـ DRM.

تحسين نظام الإدارة المتكاملة
محضر خاص
الدردشة مع النص
فكّ قفل الـ Pro →
اسقط الملف هنا أو انقر للتصفح
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM - حتى ٢ غيغابايت
تحسين نظام الإدارة المتكاملة
محضر خاص
الدردشة مع النص
فكّ قفل الـ Pro →
تحسين نظام الإدارة المتكاملة
التسجيل: 0:00
الزمن الحقيقي الشمع (الفوري)
معززة )دقة(
وصلات عامة: 24 ساعة، نص فقط · انضم 7د + سمعية · المؤيدون للوصلات الخاصة

تحويل الكلام إلى نص في الوقت الحقيقي. يقوم الذكاء الاصطناعي بالتصحيح التلقائي بينما تتحدث - تتحسن الدقة مع طول الكلام.

اختبار ميكروفونك أولاً
❤️ أحببت STT.ai؟ أخبر أصدقائك!
لقد استخدمت نسخك المجانية

انضم مجاناً للحصول على 600 دقيقة، أو رفع من $5/شهر لآلاف أكثر.

10 دقائق حرة/يوم 600 دقيقة مجانية مع التسجيل لا توجد بطاقة ائتمان مشفرة
انضم مجاناً →
التخزين المشفر من جانب العميل — نسختك مشفرة في متصفحك حتى نحن لا نستطيع قراءتها تعلم كيف يعمل →

كيف تعمل STT.ai

ثلاث خطوات نحو النصوص المستنسخة الدقيقة

1 - تحميل أو تسجيل أو لصق عنوان URL

اسحب وأسقط أي ملف صوت أو فيديو (MP3، WAV، MP4، وأكثر من 20 صيغة). اسجل من ميكروفونك في الوقت الحقيقي. أو لصق رابط من يوتيوب، فيميو، تيك توك، وأكثر من 1300 منصة.

2 - منظمة العفو الدولية تنقل الوثائق باختيارك للنموذج

اختار نموذج Whisper الذي يناسب: معزز (الحجم الكبير-v3، الأكثر دقة)، توربو (سريع، الافتراضي)، متوسط أو صغير. الكشف الآلي عن اللغة من 99 خيارات. المتحدث دياريزايون يحدد من قال ماذا.

3- التصدير أو التقاسم أو الإدماج

تحميل في TXT، SRT، VTT، DOCX، JSON، أو PDF. المشاركة من خلال رابط. استخدام API لدينا لإدماج النصوص في تطبيقك. مثالية للشريط النصي، ومذكرات الاجتماع، والبث، وأكثر.

100+
اللغات المدعومة
70+
الأدوات المجانية
1,300+
المنصات المدعومة
7
أشكال التصدير

واجهة برمجة التطبيقات التي تركز على المطورين

دمج الكلام إلى النص في تطبيقك في دقائق. RESTful API مع WebSocket الوقت الحقيقي تدفق.

REST + WebSocket — تحميل الملفات والتدفق في الوقت الحقيقي
نماذج متعددة — صوت توربو، كبير V3، متوسط وصغير
1 - تحليل المتحدث — الكشف التلقائي عن من قال ماذا
ناتج مرن — JSON، TXT، SRT، VTT مع ختم زمني للكلمة
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

هل تتحول من خطاب آخر إلى خدمة النصوص؟

جاهز للنسخ؟

تحميل ملفك الأول مجانا لا بطاقة ائتمان، لا تسجيل 600 دقيقة للبدء في الخطة المجانية

بدء النسخ

الأسئلة الشائعة

تحويل الكلام إلى نص يجري في متصفحك: لصق URL، تحميل ملف، أو تسجيل من ميكروفونك. STT.ai يختار نموذج AI ويعيد النص في أقل من 5 دقائق. تصدير ك TXT، SRT، VTT، DOCX، JSON، أو PDF.

نعم — كل زائر يحصل على 600 دقيقة مجانية للبدء على STT.ai، ويمكن استخدامها ل تحويل الكلام إلى نص مثل أي تدفق عمل آخر. الخطط المدفوعة التي تبدأ من $5/شهر تفتح الملفات الأطول، والنسخ الخاصة، وقائمة الانتظار ذات الأولوية.

تحويل الكلام إلى نص يعمل على نفس نماذج الذكاء الاصطناعي مثل بقية STT.ai - أفضل نماذجنا تصل إلى 95-97% دقة على الكلام النظيف (3-5% معدل خطأ الكلمات على المعايير المرجعية). تغيير النماذج في الهواء مباشرة إذا كانت المرة الأولى أقل من هدفك.

تحويل الكلام إلى نص يمكن أن يعمل على أي من نماذج Whisper STT.ai المضيفين - STT.ai المعززة (Whisper large-v3، أكثر دقة، على خطط مدفوعة)، Whisper Large V3، Whisper Turbo (سريع)، Whisper Medium و Whisper Small.

نعم، كل نسخة مصدرة في شكل SRT أو VTT - يعمل مع يوتيوب، فيميو، تيك توك، VLC، وكل مشغل الفيديو الرئيسي. أداة تسجيل النصوص الفرعية تغطيهم على الفيديو كترجمات شفوية.

نعم، تقوم خدمة تسجيل المتحدثين تلقائياً بوضع علامات على كل صوت (المتحدث 1، المتحدث 2،...) ويمكنك إعادة تسميتها في المحرر المتكامل، وهي تعمل عبر جميع النماذج واللغات.

معظم تحويل الكلام إلى نص الأعمال تنتهي في أقل من 5 دقائق. ملف صوت لمدة ساعة واحدة عادة ما ينتهي في 2-3 دقائق مع أسرع نماذجنا. السرعة تعتمد على النموذج المختار وحمل وحدة المعالجة الرسومية الحالية.

تحويل الكلام إلى نص يقبل أكثر من 20 صيغة — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, وغيرها. الخرج إلى TXT, SRT, VTT, DOCX, JSON, أو PDF.

نعم. الملفات الصوتية المقدمة إلى تحويل الكلام إلى نص يتم معالجتها وحذفها بشكل افتراضي. الخطط المهنية تضيف تشفير جانب العميل - حتى لو تم اختراق قاعدة بيانات STT.ai، نسختك غير قابلة للقراءة بدون مفتاحك. البيانات لا تستخدم أبدا لتدريب النموذج دون اختيار صريح.

نعم. STT.ai يقدم REST API مع Python و Node.js SDKs، بالإضافة إلى خادم MCP لـ Claude و Cursor - كلها قابلة للاستخدام لـ تحويل الكلام إلى نص تدفقات العمل.

نعم، كل نسخة من النص تفتح في محرر متكامل حيث يمكنك تصحيح الكلمات، وإعادة تسمية المتكلمين، وتعديل الختم الزمني، وإضافة ملاحظات. جميع التغييرات يتم حفظها تلقائياً.

تصدير إلى DOCX أو PDF للبريد الإلكتروني. خطط Pro تضاف كلمة المرور المحمية والروابط الدائمة - مفيدة لعمل العميل.

STT.ai يتعامل مع 1300+ منصات بما في ذلك يوتيوب، فيميو، تيك توك، SoundCloud، Zoom، Google Meet، مضيفي البث، وأكثر.