Polityka i przejrzystość AI

Co używamy CI, gdzie działa i w jaki sposób spełniamy wymogi dotyczące ujawniania informacji (art. 50 ustawy UE AI, skuteczna z 2026-08-02).

TL;DR

  • Wszystkie transkrypty są generowane przez AI.
  • Wszystkie AI działają na własny GPU. NIE wysyłamy Twojego dźwięku lub tekstu do OpenAI, Antropic, Google, ani dowolnej strony trzeciej LLM API.
  • NIE trenujemy modeli bazowych na Twoich transkryptach. Tylko opt-in-tone używa poprawek, które wyraźnie robisz.
  • Klony głosowe syntetyczne (TTS) są wyraźnie oznaczone jako AI generowane w nazwie pliku, metadanych i na stronie.

Modele, których używamy

WzórUżywane doLicencja/Przebiega
Whisper large-v3-turbo (faster-whisper)Transcription (domyślnie)MITNasz GPU
STT.ai Enhanced (custom fine-tune)Przepisy (plany płatne)MIT (base) / Proprietary (fine-tune weights)Nasz GPU
VoskPrzepływ słów w czasie rzeczywistymApache 2.0Nasz GPU
SpeechBrain ECAPA-TDNNDiarizacja głośnikaApache 2.0Nasz GPU
MadLAD-400 3BTłumaczenie (450+ języków)Apache 2.0Nasz GPU
Qwen2.5-1.5B (llama.cpp)Podsumowanie, analiza, generowanie treści, czat RAGApache 2.0Nasz GPU
F5-TTSKlonowanie głosu / klonowanie tekstu do językaMITNasz GPU
all-MiniLM-L6-v2Wbudowane elementy wyszukiwania RAGApache 2.0Nasz GPU

Nie nazywamy OpenAI, Antropic, Google Cloud, ani żadnej strony trzeciej LLM API. Każdy model powyżej działa na sprzętu, który posiadamy i obsługujemy. Jedynym zewnętrznym usługą AI, którą używamy, jest translateapi.ai (także Muddy Holdings) do tłumaczenia struny UI – to nigdy nie dotyka Twojej transkrybowanej treści.

Jak ujawniamy pokolenie AI

  • Stronami HTML transkripta: zawierają < meta name=\
  • Eksport tekstu (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): wpisuje się w wiersz „AI generowany transkrypty” na szczycie każdego pliku.
  • Wynik syntetyczny / TTS: Pliki WAV zawierają teg'syntetyczne-głosy' w metadanych i czyste zawiadomienie na stronie pobierania. Słyszalne odmowy odmowy są w planie działania.
  • Odpowiedzi API: zawiera _ai_generowane: prawdziwe pole w każdej odpowiedzi JSON, która zawiera transkrybowaną zawartość.

Dane dotyczące szkolenia

  • Modele bazowe (Whisper, MadLAD, Qwen itp.) pochodzą z ich odpowiednich wydawców wstępnie wyszkolone.
  • Twoje transkrypty nie są używane do szkolenia modeli bazowych.
  • Jeśli poprawisz segment transkrypcji (ikonę ołówka) lub zaznaczysz go niewłaściwym (ikonkę flagi), I wybierzesz go w / ustawieniach prywatności / (\
  • Odrębnie, korekty Conprivate plus audio do Voice Lab przełącza (także w /privacy-settings /, również domyślnie wyłącza) optymalizuje Cię do wnoszenia dźwięku segmentów poprawnie, w połączeniu z poprawionym tekstem, do naszego zestawu danych Voice Lab w ramach CC-BY-SA-4.0. Dwa przełączniki są niezależne — możesz udzielić zarówno jedno, jak i drugie.
  • Audio, który wyślesz jest usunięty w ciągu 24 godzin przez czyszczenie_uploads cron — NIE WYZWIEDZI, że zdecydowałeś się \

Dokładność i błędy

Transkrypcja AI nie jest idealna. Wskaźniki błędów słowa różnią się przez akcent głośnik, jakość dźwięku, język i słownictwo domenowe. Do krytycznego użytku (legalne, medyczne, regulowane przemysły) sprawdzają w stosunku do oryginalnego audio. Nasze publiczne wskaźniki WER na model są na /models/.

Kwestie zgodności

W odniesieniu do unijnego aktu o zakłóceniu konkurencji, GDPR lub innych pytań dotyczących zgodności: hello@stt.ai lub stosować formularz kontaktowy.

Ostatnia aktualizacja: 2026-04-26.