Free speech to text online مشارکتکنندگان ویکیپدیا.
تبدیل گفتار به متن با رونویسی هوش مصنوعی. پروندههای صوتی را بارگذاری کنید، از میکروفون خود ضبط کنید، یا یک نشانی وب را بچسبانید. بیش از ۱۰۰ زبان، ۱۰ مدل، دقت ۹۸٪+.
۱. بارگذاری ضبط گفتار
بارگذاری یک پرونده صوتی یا ویدئویی، چسباندن یک نشانی وب، یا ضبط گفتار از میکروفون خود.
2. هوش مصنوعی گفتار را به متن تبدیل میکند
از ۱۰ مدل هوش مصنوعی انتخاب کنید. تشخیص گوینده و تشخیص خودکار زبان شامل میشود.
3. صادرات رونوشت خود
دانلود در 6 قالب. اشتراک لینک های رونوشت با پخش صدا.
مدلهای گفتار به متنName
مدل هوش مصنوعی را که با نیازهای شما سازگار است انتخاب کنید یا اجازه دهید ما بهترین را انتخاب کنیم.
تبدیل گفتار به متن در بیش از ۱۰۰ زبان
آماده تبدیل گفتار به متن هستید ؟
شروع آزاد →پرسشهای متداول
STT.ai ضبط شما را از طریق یک مدل هوش مصنوعی اجرا میکند که به صدا گوش میدهد و متن قابل ویرایش با مهر زمان و برچسبهای سخنران را تولید میکند - تایپ کردن نیازی نیست.
An acoustic model maps the sound waveform to phonemes, then a language model assembles those into the most likely words and punctuation. STT.ai does this on GPU with models like Whisper Large V3 and NVIDIA Canary, so a one-hour recording is usually done in 2-3 minutes.
بله. هر بازدیدکننده ۶۰۰ دقیقه رایگان برای شروع بدون نیاز به ثبت نام برای اولین پرونده شما دریافت میکند. برنامههای پرداختی از ۵ دلار در ماه شروع میشود و پروندههای طولانیتر، رونوشتهای خصوصی و پردازش اولویت را اضافه میکند.
در گفتار واضح بهترین مدلهای ما به دقت ۹۵-۹۷٪ میرسند (۳-۵٪ نرخ خطای کلمه در معیارها). دقت با نویز پس زمینه، لهجه سنگین، گفتار متقاطع یا صدای با نرخ بیت پایین کاهش مییابد - استفاده از یک میکروفون مناسب و یک اتاق ساکت بزرگترین تفاوت را ایجاد میکند.
بله. به میکروفون خود صحبت کنید و STT.ai رونوشت را به صورت زنده از طریق ابزار رونوشت زنده پخش میکند. همچنین میتوانید یک ضبط تمام شده را برای رونوشت دسته جمعی بارگذاری کنید اگر در حین صحبت کردن به آن کلمه به کلمه نیاز ندارید.
STT.ai recognizes 100+ languages and auto-detects the spoken language for most audio. You can also set the language manually for a small accuracy lift, and mixed-language recordings are handled by switching mid-clip.
بله. فهرستبندی بلندگو هر صدا را برچسب میزند) بلندگو ۱ ، بلندگو ۲ ،... ( و میتوانید آنها را در ویرایشگر تغییر نام دهید. این در هر مدل و زبان پشتیبانیشده کار میکند.
STT.ai بیش از ۲۰ فرمت را از جمله MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM و AVI پشتیبانی میکند.
STT.ai هر دو را انجام میدهد - رونویسی و دیاریزاسیون گوینده - اما این دو اصطلاح وظایف متفاوتی را توصیف میکنند.
Yes. Audio is processed and deleted by default. Pro plans add client-side encryption so transcripts are unreadable without your key, even to STT.ai, and your data is never used for model training without explicit opt-in.
Yes. STT.ai has a REST API with Python and Node.js SDKs plus an MCP server for Claude and Cursor. The free API tier includes 100 minutes/month, with per-second billing beyond that.
بله. هر رونوشت در یک ویرایشگر درونی باز میشود که در آن میتوانید کلمات اشتباه شنیده شده را تصحیح کنید ، بلندگوها را تغییر نام دهید ، مهرهای زمانی را تنظیم کنید ، و یادداشتها را اضافه کنید. ویرایشها در هر قالب صادراتی باقی میمانند.