Darmowe narzędzie transcription
Wyślij plik, nagraj z mikrofonu lub wklej URL. AI transkryptuje w sekundach.
100+ Języki
Automatyczne wykrywanie lub wybór. Wszystkie główne języki obsługiwane.
Wykrywanie głośnika
Identyfikuje, kto to powiedział automatycznie.
Szyfrowanie ze strony klienta
Zaszyfruj transkrypty w swojej przeglądarce.
6 Formaty eksportu
TXT, SRT, VTT, DOCX, JSON, PDF.
Jak działa
1
Wyślij lub nagrywaj
Wyślij plik audio/wideo, wklej URL z YouTube lub dowolnej platformy lub nagraj z mikrofonu.
2
Przepisy AI
Wybierz z wielu modeli AI. Język wykryty automatycznie. Diaryzacja głośnika identyfikuje, kto co powiedział.
3
Eksportuj & Udostępnianie
Pobierz jako TXT, SRT, VTT, DOCX, JSON lub PDF. Podziel się linkiem. Poprawa z AI dla większej dokładności.
Często zadawane pytania
transkrypcja działa w przeglądarce: wklej URL, prześlij plik lub nagraj z mikrofonu. STT.ai wybiera model AI i zwraca transkrypcję w ciągu poniżej 5 minut. Eksportuj jako TXT, SRT, VTT, DOCX, JSON lub PDF.
Tak — każdy gościn otrzyma 600 bezpłatnych minut na start na STT.ai, przydatny do użytku dla transkrypcja tak samo jak każdy inny przepływ pracy. Płacone plany rozpoczynające się o $5/miesiąc odblokować dłuższe pliki, prywatne transkrypty i priorytetowe kolejowanie.
transkrypcja działa na tych samych modelach AI, co reszta STT.ai — nasze najlepsze modele osiągają 95-97% dokładności w zakresie czystego wypowiedzi (3-5% Błąd słowa w odniesieniu do poziomów odniesienia). Przełącz modele w czasie lotu, jeśli pierwszy przejazd jest poniżej celu.
transkrypcja może działać na dowolnym z modeli Whisper STT.ai hostów — STT.ai Advanced (Whisper big-v3, najdokładniej, na planach płatnych), Whisper Large V3, Whisper Turbo (szybko), Whisper Medium i Whisper Small.
Tak. Każdy transkryptyczny eksport jako SRT lub VTT – pracuje z YouTube, Vimeo, TikTok, VLC i każdym głównym odtwarzaczem wideo. Narzędzie wypalenia podtytułuje je na wideo jako twarde subsubsy.
Tak. Dializacja głośnika automatycznie etykietuje każdy głos (Głośnik 1, Głośnik 2,...) i można je nazwać w wbudowanym edytorze. Pracuje w każdym modelu i języku.
Większość transkrypcja zakończy się w ciągu nie mniej niż 5 minut. 1-godzinny plik audio zazwyczaj zakończa się w 2-3 minuty z naszymi najszybszymi modelami. Prędkość zależy od wybranego modelu i bieżącego obciążenia GPU.
transkrypcja akceptuje formaty 20+ — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI i więcej. Wyjście do TXT, SRT, VTT, DOCX, JSON lub PDF.
Tak. Pliki audio przekazane do transkrypcja są przetwarzane i usuwane domyślnie. Plany Pro dodają szyfrowanie klienta – nawet jeśli naruszono STT.ai danych, Twoje transkrypty są nieczytelne bez klucza. Dane nigdy nie są wykorzystywane do treningu modelu bez wyraźnego opt-in.
Tak. STT.ai oferuje REST API z Python i Node.js SDKs, plus MCP serwer dla Claude i Cursor — wszystko przydatne do użytku dla transkrypcja przepływów pracy. Darmowy API poziom obejmuje 100 minut/miesięczny.
Tak. Każdy transkript otwiera się w wbudowanym edytorze, gdzie można poprawić słowa, nazwę głośników, dostosować czas i dodać notatki. Wszystkie zmiany zachowują automatycznie.
Każdy transkrypt otrzymuje unikalny dzielony URL. Eksport do DOCX lub PDF do e-mailu. Pro plany dodaje hasło ochrona i stałe linki – przydatne dla pracy klienta.
STT.ai obsługuje 1300+ platformy, w tym YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast hosts i więcej. Transkrypcja URL działa tylko z publicznie dostępnymi treściami — źródła ochrony DRM nie mogą być transkrybowane.