تبدیل WAV به متن
بارگيري wav 100 زبان، تشخیص سخنران، مهر زمان شامل میشه
در مورد WAV
WAV یک قالب صوتی فشرده نشده است که کیفیت صوتی کامل را حفظ میکند. برای رونویسی با دقت بالا ایدهآل است که در آن اندازه پرونده اهمیتی ندارد.
صادرات رونوشت به عنوان
.TXT
متن ساده
.SRT
زیرنویس
.VTT
وبگاه
.DOCX
سند واژۀ
.JSON
ساختاری
.PDF
سند
پرسشهای متداول
پروندۀ صوتی WAV خود را (.wav) به STT.ai بارگذاری کنید یا زنده ضبط کنید. مدل AI مورد علاقه خود را انتخاب کنید و بر روی رونوشت کلیک کنید — بیشتر پروندهها در کمتر از ۵ دقیقه تکمیل میشوند. قالبهای خروجی شامل TXT، SRT، VTT، DOCX، JSON و PDF هستند.
بله. STT.ai به هر بازدیدکننده ۶۰۰ دقیقه رایگان برای شروع رونویسی WAV میدهد. برای اولین پرونده شما نیازی به ثبت نام نیست. برنامههای پرداختی که از ۹ دلار در ماه شروع میشوند، پروندههای طولانیتر، دقیقههای بیشتر و رونویسی خصوصی را بلاک میکنند.
WAV is a lossless format — the audio reaching our models is bit-perfect, so accuracy is bounded only by the model and speaker clarity, not by codec artifacts. Our best models reach 93-97% accuracy on clean WAV input.
برای بیشتر پروندههای WAV ، STT.ai بهبودیافته (Whisper large-v3) بهترین دقت را میدهد ، در حالی که Whisper Turbo در کلیپهای کوتاهتر سریعتر است. میتوانید نتایج مدلهای متعدد را در یک پروندۀ مشابه در ابزار compare-stt مقایسه کنید.
بله. رونوشت صوتی WAV از بیش از ۱۰۰ زبان پشتیبانی میکند. تشخیص خودکار برای بیشتر کلیپها کار میکند، یا میتوانید زبان منبع را برای افزایش دقت کوچک به صورت دستی مشخص کنید.
بله. فهرستبندی بلندگوها بر روی هر قالب پشتیبانیشده ، از جمله WAV ، کار میکند. هر بلندگو برچسبگذاری میشود) بلندگو ۱ ، بلندگو ۲ ،... (و میتوانید بعداً در ویرایشگر نامگذاری مجدد آنها را انجام دهید.
کاربران رایگان تا یک ساعت برای هر فایل دریافت میکنند؛ برنامههای پرداختی این را به ۸+ ساعت گسترش میدهند، که بیشتر پادکستهای طولانی و سخنرانیها را پوشش میدهد.
بله. پروندههای WAV به صورت پیشفرض پردازش و حذف میشوند. برنامههای حرفهای رمزگذاری سمت کارگزار را اضافه میکنند — حتی اگر پایگاه داده ما نقض شود، رونوشتهای شما بدون کلید شما قابل خواندن نیستند. دادهها هرگز بدون انتخاب صریح برای آموزش مدل استفاده نمیشوند.
Yes. The REST API accepts WAV files directly via the /v1/transcribe endpoint. Python and Node.js SDKs include WAV examples. Free tier includes 100 minutes/month of API usage.
بله. پس از رونویسی یک پرونده WAV میتوانید نتیجه را به عنوان زیرنویس SRT یا VTT صادر کنید — اگر قصد دارید صدا را بعداً با ویدئو جفت کنید یا برای دسترسی به صفحات پادکست تنها صدا مفید است.
بله. هر رونوشت در ویرایشگر داخلی ما باز می شود جایی که می توانید کلمات را تصحیح کنید، نام گویندگان را تغییر دهید، مهرهای زمانی را تنظیم کنید و یادداشت ها را اضافه کنید. ویرایش ها در صادرات باقی می مانند.
از آنجا که WAV فرمتی است که در استودیوهای حرفهای بدون از دست دادن کیفیت ضبط میشود، رونوشتهای جفتشده معمولاً در آرشیو، پخش و جریانهای کاری پزشکی قانونی استفاده میشوند - صادرات PDF با تایمر یک فرمت محبوب برای آن است.
STT.ai از آپلود نشانیهای وب از بیش از ۱۳۰۰ پلتفرم (Youtube، Vimeo، SoundCloud، میزبانهای پادکست و غیره) پشتیبانی میکند. اگر منبع WAV یا هر چیزی که قابل تبدیل به WAV باشد را برگرداند، میتوانیم آن را رونوشت کنیم. منابع محافظت شده با DRM نمیتوانند رونوشت شوند؛ برای آنها، به صورت دستی دانلود کرده و پرونده WAV را مستقیماً آپلود کنید.