Свободный IA Выступление с текстом

Переписать аудио и видео на 100 языках. Множественные модели Whisper. Выявление спикера. Не требуется записи.

12K
стенограммы
290.5K
минуты транскрибирования
100+
языков
70+
Свободные инструменты

Работа с общедоступным аудио- и видеозаписями не поддерживается.

Модернизация в целях повышения квалификации
Частный стенограмма
Говорить с стенограммой
Разблокировать с Про →
Сбрасывать файл здесь или щёлкнуть для просмотра
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — до 2GB
Модернизация в целях повышения квалификации
Частный стенограмма
Говорить с стенограммой
Разблокировать с Про →
Модернизация в целях повышения квалификации
Запись: 0:00
В реальном масштабе времени Воск (мгновенно)
Усовершенствованные Шепот (с точностью)
Ссылка для общественности: 24 ч., только текст · Подписывайся. для 7d + аудио · Про для частных связей

В реальном времени речь в текст. AI автоматически корректирует, как вы говорите — точность улучшается с помощью более длинной речи.

Сначала проверьте микрофон.
❤️ Скажи своим друзьям!
Вы использовали свои бесплатные стенограммы.

Запишитесь бесплатно, чтобы получить 600 минут, или повысить с 5 долл. США в месяц на тысячи других.

10 мин./сутки 600 мин. без регистрации Нет кредитной карты Зашифровано
Запишитесь бесплатно. →
Зашифрованное хранилище на стороне клиента — Ваши записи зашифрованы в вашем браузере. Узнай, как это работает. →

Выступление с текстовыми моделями

Выберите лучший двигатель для вашего звука

Просмотреть все модели →

Как работает STT.ai

Три шага к точной транскрипции

1. Загрузка, запись или вставка URL

Перетащите и опустите любой аудио- или видео файл (MP3, WAV, MP4 и 20+ форматов). Запись с вашего микрофона в реальном времени. Или вставьте ссылку с YouTube, Vimeo, TikTok и 1300+ платформ.

2. АИ транскрипция с вашим выбором модели

Выберите модель Whisper, которая подходит: усовершенствована (крупно-в3, наиболее точная), Turbo (быстро, по умолчанию), Simed или Small. Автообнаружив язык из 99 вариантов. Диаризационирование спикера определяет, кто что сказал.

3. Экспорт, доля или интеграция

Загрузка как TXT, SRT, VTT, DOCX, JSON или PDF. Делитесь через ссылку. Используйте API для интегрирования транскрипции в ваше приложение. Идеально для субтитров, записей встреч, подкастов и т.д.

100+
Поддерживаемые языки
70+
Свободные инструменты
1,300+
Поддержанные платформы
7
Экспортировать форматы

Разработчик - первый API

Включите слова в текст в ваше приложение за несколько минут.

REST + WebSocket — Загрузка файлов и трансляция в режиме реального времени
Множественные модели — Шепчущая турбо, большая V3, средняя и малая
Диарея спикера — Автоопределение того, кто что сказал
Гибкий выход — JSON, TXT, SRT, VTT с штемпелями слов
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Переключиться с другой речи на текстовую службу?

Готовы к транскрипции?

Загрузить первый файл бесплатно, без кредитной карты, без регистрации, 600 минут, чтобы начать с бесплатного плана.

Начать транскрипцию

Часто задаваемые вопросы

в тексте работает в вашем браузере: вставьте URL, загружайте файл или записывайте из микрофона. STT.ai выбирает модель АИ и возвращает стенограмму за 5 минут. Экспортирует как TXT, SRT, VTT, DOCX, JSON или PDF.

Да, каждый посетитель получает 600 минут, чтобы начать с STT.ai, и используется для в тексте того же, что и любой другой рабочий процесс.

в тексте работает на тех же моделях АИ, что и остальные STT.ai — наши лучшие модели достигают 95-97% точности чистой речи (3-5% от скорости ошибок в Word на контрольных показателях). Переключите модели на муха, если первый пропуск ниже вашей цели.

в тексте может работать на любой из моделей Wherper STT.ai хостов — STT.ai усовершенствованных (Whper major-v3, наиболее точный, на платных планах), Whisper Крупный V3, Wherper Turbo (быстрый), Whphper Smedium и Whisper Small.

Да. Каждый транскриптор экспортирует как SRT или VTT — работает с YouTube, Vimeo, TikTok, VLC и каждым крупным видеоплеером. Инструмент для сожжения субтитров перекладывает их на видео как жёстких субтитров.

Да, диааризация спикера автоматически обозначает каждый голос (пикер 1, спикер 2,...) и вы можете переименовать его в встроенный редактор. Работает по всем моделям и языкам.

Большинство рабочих мест в тексте заканчиваются за 5 минут. 1-часовой аудио файл обычно заполняется за 2-3 минуты с нашими самыми быстрыми моделями. Скорость зависит от выбранной модели и текущей нагрузки GPU.

в тексте принимает форматы 20+ — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI и более.

Да. Аудиофайлы, представленные в тексте обрабатываются и удаляются по умолчанию. Пропланы добавляют шифрование в сторону клиента — даже если база данных STT.ai нарушена, ваши стенограммы не могут быть считываны без ключа. Данные никогда не используются для подготовки модели без прямого согласия.

Да. STT.ai предлагает REST API с Python и Node.js SDKs, плюс сервер MCP для Cload and Cursor — все это используется для рабочих процессов в тексте. Свободный API-ядр включает 100 минут в месяц.

Да. Каждая запись открывается в встроенном редакторе, где вы можете исправить слова, переименовать колонки, скорректировать время и добавить заметки. Все изменения сохраняются автоматически.

Каждая запись получает уникальный разделимый URL. Экспорт в DOCX или PDF для электронной почты. Пропланы добавляют защищенные паролем и постоянные ссылки — полезные для работы с клиентами.

STT.ai рулит 1300+ платформ, включая YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, подкастовые носители и более. URL транскрибция работает только с общедоступным контентом — защищенные DRM источники не могут быть транскрибированы.