وبگاه رسمی Free Video to Text Online
تبدیل ویدئو به متن با رونویسی هوش مصنوعی. پروندههای صوتی را بارگذاری کنید، از میکروفون خود ضبط کنید، یا یک نشانی وب را بچسبانید. بیش از ۱۰۰ زبان، ۱۰ مدل، دقت ۹۸٪+.
بارگذاری ویدئو
بارگذاری MP4، MKV، MOV، WebM، یا AVI. صدا بهطور خودکار استخراج میشود.
2. AI ویدئو را رونوشت میکند
هوش مصنوعی آهنگ صوتی را با برچسبهای بلندگو و مهرهای زمانی استخراج و رونویسی میکند.
3. صادرات & عنوان
بارگیری زیرنویسها به عنوان SRT/VTT برای زیرنویسگذاری. یا صادرات رونوشت به عنوان TXT، DOCX، PDF.
مدلهای ویدئو به متن
مدل هوش مصنوعی را که با نیازهای شما سازگار است انتخاب کنید یا اجازه دهید ما بهترین را انتخاب کنیم.
رونوشت ویدئویی در بیش از ۱۰۰ زبان
آماده تبدیل ویدئو به متن هستید؟
شروع آزاد →پرسشهای متداول
STT.ai به صورت خودکار آهنگ صوتی را استخراج میکند - بدون هیچ مرحله جداگانه demux - آن را از طریق مدل AI انتخاب شده اجرا میکند و رونوشت را به همراه زیرنویس SRT / VTT باز میگرداند.
MP4، MKV، MOV، WebM، AVI و دیگر کانتینرهای رایج همگی پشتیبانی میشوند. نیازی نیست که خودتان صدا را استخراج کنید — ویدئو را همانطور که هست بارگذاری کنید.
بله. رونوشت را به صورت SRT یا VTT برای بارگذاری به یوتیوب، ویمو یا هر پخشکنندهای صادر کنید، و ابزار زیرنویس سوزاندن میتواند زیرنویسها را مستقیماً به ویدئو کدگذاری کند. MKV و MP4 همچنین از پیوند شیارهای زیرنویس نرم بدون کدگذاری مجدد پشتیبانی میکنند.
بله. STT.ai شامل 600 دقیقه رایگان برای شروع - حدود ده ساعت ویدئوی. برنامههای پرداختی از $5 / ماه اضافه فایلهای بزرگتر، ویدئوهای طولانیتر و رونوشت خصوصی.
دقت بستگی به آهنگ صوتی درون ویدئو دارد - آهنگ با بیتریت بالاتر (256 kbps+) بهتر از آهنگهای صوتی بسیار فشرده رونوشت میکند. بهترین مدلهای ما در گفتگوی تمیز به ۹۳-۹۵٪ میرسند.
فایلهای تا ۲ گیگابایت در هر برنامه پشتیبانی میشوند. کاربران رایگان تا یک ساعت ویدئوی هر فایل را دریافت میکنند؛ برنامههای پرداخت شده آن را به ۸+ ساعت گسترش میدهند. برای فایلهای بزرگ دوربین خام، به H.264 / AAC فشرده سازی کنید یا از یک URL بارگذاری استفاده کنید.
Yes. Paste a public video URL from any of 1,300+ supported platforms and STT.ai fetches the video and extracts its audio automatically. DRM-protected or private videos must be downloaded manually first.
بله. دیاریزاسیون سخنران هر صدا را برچسب میزند (گوینده ۱، سخنران ۲،...) و شما آنها را در ویرایشگر تغییر نام میدهید — برای مصاحبهها، پانلها و ویدئوی چند میزبان مفید است.
بله. بیش از ۱۰۰ زبان با تشخیص خودکار. همچنین میتوانید رونوشت یا زیرنویسهای تمام شده را با ابزار مترجم زیرنویس برای مخاطبان گستردهتر به زبانهای دیگر ترجمه کنید.
صادرات به SRT یا VTT برای زیرنویسها، به علاوه TXT، DOCX، PDF، یا JSON برای مقالات، یادداشتهای نمایش و آرشیو. JSON نشانههای زمان قابل خواندن ماشین و برچسبهای سخنران را حفظ میکند.
بله. ویدئو و صدای استخراج شده به صورت پیشفرض پردازش و حذف میشوند، و برنامههای حرفهای رمزگذاری سمت کارگزار را اضافه میکنند ، بنابراین رونوشتها بدون کلید شما قابل خواندن نیستند. هیچچیز بدون انتخاب صریح برای آموزش استفاده نمیشود.
اکثر ویدئوها در چند دقیقه تمام میشوند؛ یک ویدئو یک ساعته معمولاً ۳ تا ۵ دقیقه به طول میانجامد، بسته به مدل و بار GPU فعلی.