Polityka i przejrzystość AI
Co używamy CI, gdzie działa i w jaki sposób spełniamy wymogi dotyczące ujawniania informacji (art. 50 ustawy UE AI, skuteczna z 2026-08-02).
TL;DR
- Wszystkie transkrypty są generowane przez AI.
- Wszystkie AI działają na własny GPU. NIE wysyłamy Twojego dźwięku lub tekstu do OpenAI, Antropic, Google, ani dowolnej strony trzeciej LLM API.
- NIE trenujemy modeli bazowych na Twoich transkryptach. Tylko opt-in-tone używa poprawek, które wyraźnie robisz.
- Klony głosowe syntetyczne (TTS) są wyraźnie oznaczone jako AI generowane w nazwie pliku, metadanych i na stronie.
Modele, których używamy
| Wzór | Używane do | Licencja | /Przebiega |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transcription (domyślnie) | MIT | Nasz GPU |
| STT.ai Enhanced (custom fine-tune) | Przepisy (plany płatne) | MIT (base) / Proprietary (fine-tune weights) | Nasz GPU |
| Vosk | Przepływ słów w czasie rzeczywistym | Apache 2.0 | Nasz GPU |
| SpeechBrain ECAPA-TDNN | Diarizacja głośnika | Apache 2.0 | Nasz GPU |
| MadLAD-400 3B | Tłumaczenie (450+ języków) | Apache 2.0 | Nasz GPU |
| Qwen2.5-1.5B (llama.cpp) | Podsumowanie, analiza, generowanie treści, czat RAG | Apache 2.0 | Nasz GPU |
| F5-TTS | Klonowanie głosu / klonowanie tekstu do języka | MIT | Nasz GPU |
| all-MiniLM-L6-v2 | Wbudowane elementy wyszukiwania RAG | Apache 2.0 | Nasz GPU |
Nie nazywamy OpenAI, Antropic, Google Cloud, ani żadnej strony trzeciej LLM API. Każdy model powyżej działa na sprzętu, który posiadamy i obsługujemy. Jedynym zewnętrznym usługą AI, którą używamy, jest translateapi.ai (także Muddy Holdings) do tłumaczenia struny UI – to nigdy nie dotyka Twojej transkrybowanej treści.
Jak ujawniamy pokolenie AI
- Stronami HTML transkripta: zawierają < meta name=\
- Eksport tekstu (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): wpisuje się w wiersz „AI generowany transkrypty” na szczycie każdego pliku.
- Wynik syntetyczny / TTS: Pliki WAV zawierają teg'syntetyczne-głosy' w metadanych i czyste zawiadomienie na stronie pobierania. Słyszalne odmowy odmowy są w planie działania.
- Odpowiedzi API: zawiera _ai_generowane: prawdziwe pole w każdej odpowiedzi JSON, która zawiera transkrybowaną zawartość.
Dane dotyczące szkolenia
- Modele bazowe (Whisper, MadLAD, Qwen itp.) pochodzą z ich odpowiednich wydawców wstępnie wyszkolone.
- Twoje transkrypty nie są używane do szkolenia modeli bazowych.
- Jeśli poprawisz segment transkrypcji (ikonę ołówka) lub zaznaczysz go niewłaściwym (ikonkę flagi), I wybierzesz go w / ustawieniach prywatności / (\
- Odrębnie, korekty Conprivate plus audio do Voice Lab przełącza (także w /privacy-settings /, również domyślnie wyłącza) optymalizuje Cię do wnoszenia dźwięku segmentów poprawnie, w połączeniu z poprawionym tekstem, do naszego zestawu danych Voice Lab w ramach CC-BY-SA-4.0. Dwa przełączniki są niezależne — możesz udzielić zarówno jedno, jak i drugie.
- Audio, który wyślesz jest usunięty w ciągu 24 godzin przez czyszczenie_uploads cron — NIE WYZWIEDZI, że zdecydowałeś się \
Dokładność i błędy
Transkrypcja AI nie jest idealna. Wskaźniki błędów słowa różnią się przez akcent głośnik, jakość dźwięku, język i słownictwo domenowe. Do krytycznego użytku (legalne, medyczne, regulowane przemysły) sprawdzają w stosunku do oryginalnego audio. Nasze publiczne wskaźniki WER na model są na /models/.
Kwestie zgodności
W odniesieniu do unijnego aktu o zakłóceniu konkurencji, GDPR lub innych pytań dotyczących zgodności: hello@stt.ai lub stosować formularz kontaktowy.
Ostatnia aktualizacja: 2026-04-26.