تبدیل MP3 به متن
بارگيري mp3 100 زبان، تشخیص سخنران، مهر زمان شامل میشه
در مورد MP3
MP3 گستردهترین قالب صوتی استفادهشده است. قالب فشرده با از دست دادن برای موسیقی و سخن گفتن ایدهآل است. STT.ai پروندههای MP3 را با هر نرخ بیت و نرخ نمونه پذیرش میکند.
صادرات رونوشت به عنوان
.TXT
متن ساده
.SRT
زیرنویس
.VTT
وبگاه
.DOCX
سند واژۀ
.JSON
ساختاری
.PDF
سند
پرسشهای متداول
پروندۀ صوتی MP3 خود را (.mp3) به STT.ai بارگذاری کنید یا زنده ضبط کنید. مدل AI مورد علاقه خود را انتخاب کنید و بر روی رونوشت کلیک کنید — بیشتر پروندهها در کمتر از ۵ دقیقه تکمیل میشوند. قالبهای خروجی شامل TXT، SRT، VTT، DOCX، JSON و PDF هستند.
بله. STT.ai به هر بازدیدکننده ۶۰۰ دقیقه رایگان برای شروع رونویسی MP3 میدهد. برای اولین پرونده شما نیازی به ثبت نام نیست. برنامههای پرداختی که از ۹ دلار در ماه شروع میشوند، پروندههای طولانیتر، دقیقههای بیشتر و رونویسی خصوصی را بلاک میکنند.
MP3 is a lossy compressed format, so very-low-bitrate files (under 64 kbps) can cost a few percentage points of accuracy compared to lossless WAV or FLAC. At 128 kbps or higher, the difference is negligible and our best models reach 93-95% accuracy.
برای بیشتر پروندههای MP3 ، STT.ai بهبودیافته (Whisper large-v3) بهترین دقت را میدهد ، در حالی که Whisper Turbo در کلیپهای کوتاهتر سریعتر است. میتوانید نتایج مدلهای متعدد را در یک پروندۀ مشابه در ابزار compare-stt مقایسه کنید.
بله. رونوشت صوتی MP3 از بیش از ۱۰۰ زبان پشتیبانی میکند. تشخیص خودکار برای بیشتر کلیپها کار میکند، یا میتوانید زبان منبع را برای افزایش دقت کوچک به صورت دستی مشخص کنید.
بله. فهرستبندی بلندگوها بر روی هر قالب پشتیبانیشده ، از جمله MP3 ، کار میکند. هر بلندگو برچسبگذاری میشود) بلندگو ۱ ، بلندگو ۲ ،... (و میتوانید بعداً در ویرایشگر نامگذاری مجدد آنها را انجام دهید.
کاربران رایگان تا یک ساعت برای هر فایل دریافت میکنند؛ برنامههای پرداختی این را به ۸+ ساعت گسترش میدهند، که بیشتر پادکستهای طولانی و سخنرانیها را پوشش میدهد.
بله. پروندههای MP3 به صورت پیشفرض پردازش و حذف میشوند. برنامههای حرفهای رمزگذاری سمت کارگزار را اضافه میکنند — حتی اگر پایگاه داده ما نقض شود، رونوشتهای شما بدون کلید شما قابل خواندن نیستند. دادهها هرگز بدون انتخاب صریح برای آموزش مدل استفاده نمیشوند.
Yes. The REST API accepts MP3 files directly via the /v1/transcribe endpoint. Python and Node.js SDKs include MP3 examples. Free tier includes 100 minutes/month of API usage.
بله. پس از رونویسی یک پرونده MP3 میتوانید نتیجه را به عنوان زیرنویس SRT یا VTT صادر کنید — اگر قصد دارید صدا را بعداً با ویدئو جفت کنید یا برای دسترسی به صفحات پادکست تنها صدا مفید است.
بله. هر رونوشت در ویرایشگر داخلی ما باز می شود جایی که می توانید کلمات را تصحیح کنید، نام گویندگان را تغییر دهید، مهرهای زمانی را تنظیم کنید و یادداشت ها را اضافه کنید. ویرایش ها در صادرات باقی می مانند.
هر رونوشت یک نشانی وب مشترک منحصربهفرد دریافت میکند. برای ارسال ایمیل به DOCX یا PDF صادر کنید، یا پیوند را مستقیماً به اشتراک بگذارید. برنامههای حرفهای محافظت از گذرواژه و پیوندهای دائمی را اضافه میکنند - اگر محتوای MP3 شما کار مشتري را در حال اجرا هدایت کند مفید است.
STT.ai از آپلود نشانیهای وب از بیش از ۱۳۰۰ پلتفرم (Youtube، Vimeo، SoundCloud، میزبانهای پادکست و غیره) پشتیبانی میکند. اگر منبع MP3 یا هر چیزی که قابل تبدیل به MP3 باشد را برگرداند، میتوانیم آن را رونوشت کنیم. منابع محافظت شده با DRM نمیتوانند رونوشت شوند؛ برای آنها، به صورت دستی دانلود کرده و پرونده MP3 را مستقیماً آپلود کنید.