Free Audio to Text Online مشارکتکنندگان ویکیپدیا.
تبدیل صدا به متن با رونویسی هوش مصنوعی. پروندههای صوتی را بارگذاری کنید، از میکروفون خود ضبط کنید، یا یک نشانی وب را بچسبانید. بیش از ۱۰۰ زبان، ۱۰ مدل، دقت ۹۸٪+.
بارگذاری صوتی
بارگذاری MP3, WAV, M4A, FLAC, OGG, یا هر قالب صوتی. تا ۲ گیگابایت.
2. AI Processes Audio
هوش مصنوعی با تشخیص گوینده و نشان زمان، گفتار را از صدای شما استخراج میکند.
3. رونوشت رو بگير
نمایش، ویرایش، بارگیری یا اشتراکگذاری. صادرات به عنوان TXT، SRT، VTT، DOCX یا PDF.
مدلهای صوت به متن
مدل هوش مصنوعی را که با نیازهای شما سازگار است انتخاب کنید یا اجازه دهید ما بهترین را انتخاب کنیم.
رونوشت صدا در بیش از ۱۰۰ زبان
آماده تبدیل صدا به متن هستید؟
شروع آزاد →پرسشهای متداول
Upload your audio file or paste a URL, pick an AI model, and click Transcribe. STT.ai returns editable text with timestamps and speaker labels — most files finish in under five minutes.
MP3, WAV, M4A, FLAC, OGG, AAC, AMR, و ۱۰+ فرمت دیگر همگی پشتیبانی میشوند. نیازی نیست که ابتدا بین فرمتها تبدیل کنید - هر چیزی را که ضبطکننده یا برنامه شما تولید میکند بارگذاری کنید.
کمی. قالبهای بدون از دست دادن مانند WAV و FLAC صدای بیتی کامل را حمل میکنند، بنابراین دقت تنها توسط مدل و شفافیت بلندگو محدود میشود. قالبهای با از دست دادن (MP3، M4A) در ۱۲۸ kbps یا بالاتر در واقع مشابه هستند؛ نرخ بیت بسیار پایین زیر ۶۴ kbps ممکن است چند امتیاز هزینه داشته باشد.
بله. STT.ai شامل 600 دقيقه آزاد براي شروع بدون ثبت نام براي اولين پرونده شما ميشه. برنامه هاي پرداختي که از 5 دلار در ماه شروع ميشه شامل پرونده هاي طولاني تر، رونوشت هاي خصوصي و پردازش اوليت ها ميشه.
در صدای تمیز بهترین مدلهای ما به دقت ۹۵-۹۷٪ میرسند (۳-۵٪ نرخ خطای کلمه). نویز پس زمینه، بلندگوهای همپوشانی و لهجههای قوی عوامل اصلی کاهش دقت هستند.
کاربران رایگان میتوانند تا یک ساعت در هر فایل رونوشت کنند؛ برنامههای پرداختی این کار را تا ۸ ساعت افزایش میدهند، که شامل پادکستهای تمام مدت، مصاحبهها و کتابهای صوتی در یک گذر است.
بله. دیاریزاسیون سخنران هر صدا را برچسب میزند (گفتگوکننده ۱، سخنران ۲،...) و میتوانید آنها را در ویرایشگر تغییر نام دهید — بر روی هر قالب و مدل صوتی پشتیبانی شده کار میکند.
صادرات به TXT، DOCX، PDF، JSON، یا زیرنویسهای SRT/VTT. JSON زمانبندی قابل خواندن توسط ماشین و برچسبهای سخنران را حفظ میکند؛ DOCX و PDF برای اشتراکگذاری و آرشیو کردن بهترین هستند.
بله. بیش از ۱۰۰ زبان با تشخیص خودکار، به علاوه گزینه تنظیم دستی زبان. صدای زبانهای مخلوط با تغییر میان پروندهها مدیریت میشود و میتوانید نتیجه را بعداً ترجمه کنید.
بله. صدا به صورت پیشفرض پردازش و حذف میشود ، و برنامههای Pro رمزگذاری سمت کارگزار را اضافه میکنند ، بنابراین رونوشتها بدون کلید شما قابل خواندن نیستند. هیچ چیز بدون انتخاب صریح برای آموزش استفاده نمیشود.
Yes. Paste a link from any of 1,300+ supported platforms — podcast hosts, SoundCloud, YouTube, and more — and STT.ai fetches the audio directly. DRM-protected sources can't be transcribed.
بله. API REST مستقیماً فایلهای صوتی را با Python و Node.js SDKs و یک لایه رایگان ۱۰۰ دقیقه/ماه پذیرش میکند.