Free Audio to Text Online مشارکتکنندگان ویکیپدیا.
تبدیل صدا به متن با رونویسی هوش مصنوعی. پروندههای صوتی را بارگذاری کنید، از میکروفون خود ضبط کنید یا یک نشانی وب را بچسبانید. بیش از ۱۰۰ زبان، مدلهای باز، دقت بیش از ۹۸٪.
بارگذاری صوتی
بارگذاری MP3, WAV, M4A, FLAC, OGG, یا هر قالب صوتی. تا ۲ گیگابایت.
2. AI Processes Audio
هوش مصنوعی با تشخیص گوینده و نشان زمان، گفتار را از صدای شما استخراج میکند.
3. رونوشت رو بگير
نمایش، ویرایش، بارگیری یا اشتراکگذاری. صادرات به عنوان TXT، SRT، VTT، DOCX یا PDF.
مدلهای صوت به متن
مدل هوش مصنوعی را که با نیازهای شما سازگار است انتخاب کنید یا اجازه دهید ما بهترین را انتخاب کنیم.
رونوشت صدا در بیش از ۱۰۰ زبان
آماده تبدیل صدا به متن هستید؟
شروع آزاد →پرسشهای متداول
فایل صوتی خود را بارگذاری کنید یا URL را کپی کنید، یک مدل AI را انتخاب کنید و روی رونوشت کلیک کنید. STT.ai متن قابل ویرایش را با مهرهای زمانی و برچسبهای سخنران باز میگرداند - بیشتر فایلها در کمتر از پنج دقیقه تمام میشوند.
MP3, WAV, M4A, FLAC, OGG, AAC, AMR, و ۱۰+ فرمت دیگر همگی پشتیبانی میشوند. نیازی نیست که ابتدا بین فرمتها تبدیل کنید - هر چیزی را که ضبطکننده یا برنامه شما تولید میکند بارگذاری کنید.
کمی. قالبهای بدون از دست دادن مانند WAV و FLAC صدای بیتی کامل را حمل میکنند، بنابراین دقت تنها توسط مدل و شفافیت بلندگو محدود میشود. قالبهای با از دست دادن (MP3، M4A) در ۱۲۸ kbps یا بالاتر در واقع مشابه هستند؛ نرخ بیت بسیار پایین زیر ۶۴ kbps ممکن است چند امتیاز هزینه داشته باشد.
بله. STT.ai شامل ۶۰۰ دقیقه رایگان در ماه بدون ثبت نام برای اولین فایل شما است. برنامههای پرداختی که از ۹ دلار در ماه شروع میشوند فایلهای طولانیتر، رونوشت خصوصی و پردازش اولویت را اضافه میکنند.
در صدای تمیز بهترین مدلهای ما به دقت ۹۵-۹۷٪ میرسند (۳-۵٪ نرخ خطای کلمه). نویز پس زمینه، بلندگوهای همپوشانی و لهجههای قوی عوامل اصلی کاهش دقت هستند.
کاربران رایگان میتوانند تا یک ساعت در هر فایل رونوشت کنند؛ برنامههای پرداختی این کار را تا ۸ ساعت افزایش میدهند، که شامل پادکستهای تمام مدت، مصاحبهها و کتابهای صوتی در یک گذر است.
بله. دیاریزاسیون سخنران هر صدا را برچسب میزند (گفتگوکننده ۱، سخنران ۲،...) و میتوانید آنها را در ویرایشگر تغییر نام دهید — بر روی هر قالب و مدل صوتی پشتیبانی شده کار میکند.
صادرات به TXT، DOCX، PDF، JSON، یا زیرنویسهای SRT/VTT. JSON زمانبندی قابل خواندن توسط ماشین و برچسبهای سخنران را حفظ میکند؛ DOCX و PDF برای اشتراکگذاری و آرشیو کردن بهترین هستند.
بله. بیش از ۱۰۰ زبان با تشخیص خودکار، به علاوه گزینه تنظیم دستی زبان. صدای زبانهای مخلوط با تغییر میان پروندهها مدیریت میشود و میتوانید نتیجه را بعداً ترجمه کنید.
بله. صدا به صورت پیشفرض پردازش و حذف میشود ، و برنامههای Pro رمزگذاری سمت کارگزار را اضافه میکنند ، بنابراین رونوشتها بدون کلید شما قابل خواندن نیستند. هیچ چیز بدون انتخاب صریح برای آموزش استفاده نمیشود.
بله. یک لینک از هر یک از ۱۳۰۰ پلت فرم پشتیبانی شده را کپی کنید — میزبانهای پادکست، ساوندکلود، یوتیوب و بیشتر — و STT.ai مستقیماً صدا را دریافت میکند. منابع DRM-protected نمیتوانند رونوشت شوند.
بله. API REST مستقیماً فایلهای صوتی را با Python و Node.js SDKs و یک لایه رایگان ۱۰۰ دقیقه/ماه پذیرش میکند.