Free Audio to Text Online مشارکت‌کنندگان ویکی‌پدیا.

تبدیل صدا به متن با رونویسی هوش مصنوعی. پرونده‌های صوتی را بارگذاری کنید، از میکروفون خود ضبط کنید یا یک نشانی وب را بچسبانید. بیش از ۱۰۰ زبان، مدل‌های باز، دقت بیش از ۹۸٪.

با صوت و ویدئوهای در دسترس عمومی کار می‌کند. محتوای محافظت شده با DRM پشتیبانی نمی‌شود.

ارتقا برای بهبودیافته
رونوشت خصوصی
گپ زدن با رونوشت
باز کردن قفل با Pro →
پروندۀ را اینجا بگذارید یا برای مرور کلیک کنید
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — تا ۲ گیگابایت
ارتقا برای بهبودیافته
رونوشت خصوصی
گپ زدن با رونوشت
باز کردن قفل با Pro →
ارتقا برای بهبودیافته
ضبط: 0:00
زمان واقعی موم (موقت)
بهبودیافته زمزمه (دقت)
وبگاه رسمی 24hours.com · ثبت نام برای 7d + صدا · حرفه اي برای پیوندهای خصوصی

گفتار به متن در زمان واقعی. هوش مصنوعی خودکاراً در حین صحبت کردن شما را اصلاح می‌کند - دقت با صحبت طولانی تر بهبود می‌یابد.

ابتدا میکروفون خود را امتحان کنید
❤️ دوست STT.ai رو به دوستانت بگو
تو از رونوشت هاي مجانيت استفاده کردي

برای دریافت ۶۰۰ دقیقه رایگان ثبت نام کنید یا از ۹ دلار در ماه برای هزاران دلار بیشتر ارتقاء دهید.

۱۰ دقیقه آزاد در روز 600 دقیقه رایگان با ثبت نام کارت اعتباري ندارم رمزگذاری شده
ثبت نام مجانی →

بارگذاری صوتی

بارگذاری MP3, WAV, M4A, FLAC, OGG, یا هر قالب صوتی. تا ۲ گیگابایت.

2. AI Processes Audio

هوش مصنوعی با تشخیص گوینده و نشان زمان، گفتار را از صدای شما استخراج می‌کند.

3. رونوشت رو بگير

نمایش، ویرایش، بارگیری یا اشتراک‌گذاری. صادرات به عنوان TXT، SRT، VTT، DOCX یا PDF.

قالبهای صوتی پشتیبانی‌شده

مدل‌های صوت به متن

مدل هوش مصنوعی را که با نیازهای شما سازگار است انتخاب کنید یا اجازه دهید ما بهترین را انتخاب کنیم.

رونوشت صدا در بیش از ۱۰۰ زبان

استفاده از موارد صوت به متن

آماده تبدیل صدا به متن هستید؟

شروع آزاد →

پرسشهای متداول

فایل صوتی خود را بارگذاری کنید یا URL را کپی کنید، یک مدل AI را انتخاب کنید و روی رونوشت کلیک کنید. STT.ai متن قابل ویرایش را با مهرهای زمانی و برچسب‌های سخنران باز می‌گرداند - بیشتر فایل‌ها در کمتر از پنج دقیقه تمام می‌شوند.

MP3, WAV, M4A, FLAC, OGG, AAC, AMR, و ۱۰+ فرمت دیگر همگی پشتیبانی می‌شوند. نیازی نیست که ابتدا بین فرمت‌ها تبدیل کنید - هر چیزی را که ضبط‌کننده یا برنامه شما تولید می‌کند بارگذاری کنید.

کمی. قالب‌های بدون از دست دادن مانند WAV و FLAC صدای بیتی کامل را حمل می‌کنند، بنابراین دقت تنها توسط مدل و شفافیت بلندگو محدود می‌شود. قالب‌های با از دست دادن (MP3، M4A) در ۱۲۸ kbps یا بالاتر در واقع مشابه هستند؛ نرخ بیت بسیار پایین زیر ۶۴ kbps ممکن است چند امتیاز هزینه داشته باشد.

بله. STT.ai شامل ۶۰۰ دقیقه رایگان در ماه بدون ثبت نام برای اولین فایل شما است. برنامه‌های پرداختی که از ۹ دلار در ماه شروع می‌شوند فایل‌های طولانی‌تر، رونوشت خصوصی و پردازش اولویت را اضافه می‌کنند.

در صدای تمیز بهترین مدل‌های ما به دقت ۹۵-۹۷٪ می‌رسند (۳-۵٪ نرخ خطای کلمه). نویز پس زمینه، بلندگوهای همپوشانی و لهجه‌های قوی عوامل اصلی کاهش دقت هستند.

کاربران رایگان می‌توانند تا یک ساعت در هر فایل رونوشت کنند؛ برنامه‌های پرداختی این کار را تا ۸ ساعت افزایش می‌دهند، که شامل پادکست‌های تمام مدت، مصاحبه‌ها و کتاب‌های صوتی در یک گذر است.

بله. دیاریزاسیون سخنران هر صدا را برچسب می‌زند (گفتگوکننده ۱، سخنران ۲،...) و می‌توانید آن‌ها را در ویرایشگر تغییر نام دهید — بر روی هر قالب و مدل صوتی پشتیبانی شده کار می‌کند.

صادرات به TXT، DOCX، PDF، JSON، یا زیرنویس‌های SRT/VTT. JSON زمان‌بندی قابل خواندن توسط ماشین و برچسب‌های سخنران را حفظ می‌کند؛ DOCX و PDF برای اشتراک‌گذاری و آرشیو کردن بهترین هستند.

بله. بیش از ۱۰۰ زبان با تشخیص خودکار، به علاوه گزینه تنظیم دستی زبان. صدای زبان‌های مخلوط با تغییر میان پرونده‌ها مدیریت می‌شود و می‌توانید نتیجه را بعداً ترجمه کنید.

بله. صدا به صورت پیش‌فرض پردازش و حذف می‌شود ، و برنامه‌های Pro رمزگذاری سمت کارگزار را اضافه می‌کنند ، بنابراین رونوشت‌ها بدون کلید شما قابل خواندن نیستند. هیچ چیز بدون انتخاب صریح برای آموزش استفاده نمی‌شود.

بله. یک لینک از هر یک از ۱۳۰۰ پلت فرم پشتیبانی شده را کپی کنید — میزبان‌های پادکست، ساوندکلود، یوتیوب و بیشتر — و STT.ai مستقیماً صدا را دریافت می‌کند. منابع DRM-protected نمی‌توانند رونوشت شوند.

بله. API REST مستقیماً فایل‌های صوتی را با Python و Node.js SDKs و یک لایه رایگان ۱۰۰ دقیقه/ماه پذیرش می‌کند.