وبگاه رسمی Free Video to Text Online
تبدیل ویدئو به متن با رونویسی هوش مصنوعی. پروندههای صوتی را بارگذاری کنید، از میکروفون خود ضبط کنید یا یک نشانی وب را بچسبانید. بیش از ۱۰۰ زبان، مدلهای باز، دقت ۹۸٪ +.
بارگذاری ویدئو
بارگذاری MP4، MKV، MOV، WebM، یا AVI. صدا بهطور خودکار استخراج میشود.
2. AI ویدئو را رونوشت میکند
هوش مصنوعی آهنگ صوتی را با برچسبهای بلندگو و مهرهای زمانی استخراج و رونویسی میکند.
3. صادرات & عنوان
بارگیری زیرنویسها به عنوان SRT/VTT برای زیرنویسگذاری. یا صادرات رونوشت به عنوان TXT، DOCX، PDF.
مدلهای ویدئو به متن
مدل هوش مصنوعی را که با نیازهای شما سازگار است انتخاب کنید یا اجازه دهید ما بهترین را انتخاب کنیم.
رونوشت ویدئویی در بیش از ۱۰۰ زبان
آماده تبدیل ویدئو به متن هستید؟
شروع آزاد →پرسشهای متداول
STT.ai به صورت خودکار آهنگ صوتی را استخراج میکند - بدون هیچ مرحله جداگانه demux - آن را از طریق مدل AI انتخاب شده اجرا میکند و رونوشت را به همراه زیرنویس SRT / VTT باز میگرداند.
MP4، MKV، MOV، WebM، AVI و دیگر کانتینرهای رایج همگی پشتیبانی میشوند. نیازی نیست که خودتان صدا را استخراج کنید — ویدئو را همانطور که هست بارگذاری کنید.
بله. رونوشت را به صورت SRT یا VTT برای بارگذاری به یوتیوب، ویمو یا هر پخشکنندهای صادر کنید، و ابزار زیرنویس سوزاندن میتواند زیرنویسها را مستقیماً به ویدئو کدگذاری کند. MKV و MP4 همچنین از پیوند شیارهای زیرنویس نرم بدون کدگذاری مجدد پشتیبانی میکنند.
بله. STT.ai شامل ۶۰۰ دقیقه رایگان در ماه است - حدود ۱۰ ساعت ویدئوی. برنامههای پرداختی که از ۹ دلار در ماه شروع میشود فایلهای بزرگتر، ویدئوی طولانیتر و رونوشتهای خصوصی را اضافه میکند.
دقت بستگی به آهنگ صوتی درون ویدئو دارد - آهنگ با بیتریت بالاتر (256 kbps+) بهتر از آهنگهای صوتی بسیار فشرده رونوشت میکند. بهترین مدلهای ما در گفتگوی تمیز به ۹۳-۹۵٪ میرسند.
فایلهای تا ۲ گیگابایت در هر برنامه پشتیبانی میشوند. کاربران رایگان تا یک ساعت ویدئوی هر فایل را دریافت میکنند؛ برنامههای پرداخت شده آن را به ۸+ ساعت گسترش میدهند. برای فایلهای بزرگ دوربین خام، به H.264 / AAC فشرده سازی کنید یا از یک URL بارگذاری استفاده کنید.
بله. یک URL ویدئو عمومی را از هر یک از ۱۳۰۰ پلت فرم پشتیبانی شده کپی کنید و STT.ai ویدئو را دریافت میکند و صدای آن را به طور خودکار استخراج میکند. ویدئوهای DRM-protected یا خصوصی باید ابتدا به صورت دستی بارگیری شوند.
بله. دیاریزاسیون سخنران هر صدا را برچسب میزند (گوینده ۱، سخنران ۲،...) و شما آنها را در ویرایشگر تغییر نام میدهید — برای مصاحبهها، پانلها و ویدئوی چند میزبان مفید است.
بله. بیش از ۱۰۰ زبان با تشخیص خودکار. همچنین میتوانید رونوشت یا زیرنویسهای تمام شده را با ابزار مترجم زیرنویس برای مخاطبان گستردهتر به زبانهای دیگر ترجمه کنید.
صادرات به SRT یا VTT برای زیرنویسها، به علاوه TXT، DOCX، PDF، یا JSON برای مقالات، یادداشتهای نمایش و آرشیو. JSON نشانههای زمان قابل خواندن ماشین و برچسبهای سخنران را حفظ میکند.
بله. ویدئو و صدای استخراج شده به صورت پیشفرض پردازش و حذف میشوند، و برنامههای حرفهای رمزگذاری سمت کارگزار را اضافه میکنند ، بنابراین رونوشتها بدون کلید شما قابل خواندن نیستند. هیچچیز بدون انتخاب صریح برای آموزش استفاده نمیشود.
اکثر ویدئوها در چند دقیقه تمام میشوند؛ یک ویدئو یک ساعته معمولاً ۳ تا ۵ دقیقه به طول میانجامد، بسته به مدل و بار GPU فعلی.