Безплатен интеллектуален интелект Изказване към текст

Преписване на аудио и видео на текст на 100+ езици. Многократни шептане модели. Откриване на звука. Няма нужда от регистрация.

12K
транскрипции
290.5K
минути, преписвани
100+
езици
70+
безплатни инструменти

Работи с публично достъпни аудио & видео. DRM защитено съдържание не е подкрепено.

Повишаване за подобрени
Частен запис
Разговор с транскрипт
Отключване с профсъюз →
Пропускане на файла тук или кликнете за да прегледате
MP3, WAV, M4A, FLAC, MP4, MKV, Движение, WebM — до 2GB
Повишаване за подобрени
Частен запис
Разговор с транскрипт
Отключване с профсъюз →
Повишаване за подобрени
Запис: 0:00
Реално време Воск (Instant)
Подобрени Шепне (точно)
Публични връзки: 24h, само текст · Запиши се. за 7d + аудио · Професионален за лични връзки

Речта в реално време към текст. AI автоматично корекции, докато говорите – точността се подобрява с по-дълга реч.

Тествайте микрофона си първо
❤️ Кажи на приятелите си STT.ai?
Използвал си безплатните си транскрипции.

Регистрирайте се безплатно да получите 600 минути, или ъпгрейд от $5 на месец за хиляди повече.

10 безплатни мин/ден 600 мин безплатно с регистрация Без кредитна карта Шифрирано
Запишете се безплатно. →
Шифрирано съхранение на страницата на клиента — Твоите записи са криптирани в браузъра ти, дори и ние не можем да ги прочетем. Научете как работи. →

Как работи STT.ai

Три стъпки за точна транскрипция

1. Качване, записване или вливане URL

Влачете и пуснете всички аудио или видео файлове (MP3, WAV, MP4, и 20+ формати). Запишете от микрофона си в реално време. Или поставете връзка от YouTube, Vimeo, TikTok и 1.300+ платформи.

2. AI Преписвачи с вашия избор на модел

Изберете Whisper модел, който пасва: Подобрено (голямо-v3, най-точно), Turbo (бързо, по подразбиране), Средно или Малко. Автоматично откриване на езика от 99 опции. Speaker diarization идентифицира кой е казал какво.

3. Износ, споделяне или интегриране

Изтеглете като TXT, SRT, VTT, DOCX, JSON или PDF. Споделете чрез линк. Използвайте нашия API, за да интегрирате транскрипция в приложението си. Перфектно за субтитри, бележки, подкасти и др.

100+
Поддържани езици
70+
Безплатни инструменти
1,300+
Подкрепени платформи
7
Експортиране на формати

Разработчик- първи API

Интегрирайте реч-то-текст в приложението си за минути. RESTful API с реално време WebSocket streaming.

РЕЗЮМЕ + Уеб сенч — Качване на файл и излъчване в реално време
Множество модели — Шепнеш Turbo, Големи V3, Средни и малки
Диагностика на спикера — Самоустановяване кой каза какво
Гъвкав изход — JSON, TXT, SRT, VTT с часове за думи
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Преминаване от друга реч към текстови услуги?

Готов ли си за транскрипция?

Вкарайте първия си файл безплатно. Без кредитна карта, няма регистрация. 600 минути да започнете с безплатния план.

Стартиране на транскриптиране

Често задавани въпроси

реч към текст работи във вашия браузър: вмъкнете URL, качвате файл или записвате от вашия микрофон. STT.ai избира AI модела и връща транскрипта в под 5 минути. Изнасяне като TXT, SRT, VTT, DOCX, JSON или PDF.

Да — всеки посетител получава 600 безплатни минути за да започне на STT.ai, използван за реч към текст същото като всеки друг работен поток. Плащани планове започващи с $5/месечно отключване на по-дългото файлове, частни записи и приоритет редовна.

реч към текст работи по същите модели на AI като останалите STT.ai — най-добрите ни модели достигат 95-97% точност на чистата реч (3-5% Word Error Rate на бенчмарковете). Превключете модели на летене, ако първият проход е под вашата цел.

реч към текст може да се проведе на всеки от модели Whisper STT.ai домакини — STT.ai Подобрени (Whisper голям v3, най-точни, по платени планове), Whisper голям V3, Whisper Turbo (бързо), Whisper Medium и Whisper Small.

Да. Всеки транскриптен износ като SRT или VTT — работи с YouTube, Vimeo, TikTok, VLC и всеки голям видео плеър. Инструментът за изгаряне на субтитри ги облага на видео като твърди суббис.

Да. Диагностика на оратора автоматично етикетира всеки глас (Glascher 1, Speaker 2,...) и можете да ги преименувате в вграден редактор. Работи във всички модели и езици.

Повечето реч към текст задания завършват в под 5 минути. 1-часов аудио файл обикновено завършва в 2-3 минути с нашите най-бързи модели. Скоростта зависи от избрания модел и текущата GPU натоварване.

реч към текст приема 20+ формата — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOVI, WebM, AVI и др. Изход към TXT, SRT, VTT, DOCX, JSON или PDF.

Да. Аудио файлове, представени на реч към текст, се обработват и изтриват по подразбиране. Про планове добавят енкрипция на клиента настрана — дори ако STT.ai-те данни са нарушени, вашите транскрипти са нечетливи без вашия ключ. Дани никога не се използват за моделно обучение без изрично опти-ин.

STT.ai предлага REST API с Python и Node.js SDKs, плюс MCP сървър за Claude и Курсор — всички използвани за реч към текст работни потоки. Свободен API низ включва 100 минути/месечно.

Да. Всеки транскрипт се отваря в вградения редактор, където можете да коригираш думите, да преименуваш говорителите, да настройваш часовите осигуровки и да добавяш бележки. Всички промени да се запазят автоматично.

Всеки транскрипт получава уникален общ адрес. Експорт до DOCX или PDF за имейл. Про планове добавяне на парола защитни и постоянни връзки — полезни за клиентската работа.

STT.ai управляват 1300+ платформи, включително YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, Podcast домакини и др. Преписване на URL работи само с публично достъпно съдържание — DRM защитени източници не могат да бъдат транскрибирани.