Politique et transparence en matière d'IA
Ce que nous utilisons, où il fonctionne et comment nous nous conformons aux exigences de divulgation (article 50 de la Loi sur l'IA de l'UE, en vigueur au 2026-08-02).
TL;DR
- Toutes les transcriptions sont générées par l'IA. Chaque sortie est lisible par machine.
- Nous n'envoyons PAS votre audio ou votre texte à OpenAI, Anthropic, Google ou à toute API LLM tierce.
- Nous ne formons PAS les modèles de base sur vos transcriptions. Seul un opt-in fine-tune utilise les corrections que vous faites explicitement.
- Les clones vocaux synthétiques (TTS) sont clairement étiquetés comme étant générés par l'IA dans le nom de fichier, les métadonnées et sur la page.
Modèles que nous utilisons
| Modèle | Utilisé pour | Licence | Coure |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transcription (par défaut) | MIT | Notre GPU |
| STT.ai Enhanced (custom fine-tune) | Transcription (régimes payés) | MIT (base) / Proprietary (fine-tune weights) | Notre GPU |
| Vosk | Diffusion de mots en temps réel | Apache 2.0 | Notre GPU |
| SpeechBrain ECAPA-TDNN | Diarisation des orateurs | Apache 2.0 | Notre GPU |
| MadLAD-400 3B | Traduction (450+ langues) | Apache 2.0 | Notre GPU |
| Qwen2.5-1.5B (llama.cpp) | Résumé, analyse, génération de contenu, chat RAG | Apache 2.0 | Notre GPU |
| F5-TTS | Closonnage vocal / texte à la parole | MIT | Notre GPU |
| all-MiniLM-L6-v2 | Inscriptions pour la recherche RAG | Apache 2.0 | Notre GPU |
Nous n'appelons pas OpenAI, Anthropic, Google Cloud, ou n'importe quelle API LLM tierce pour n'importe quelle fonctionnalité. Chaque modèle ci-dessus fonctionne sur le matériel que nous possédons et exploitons. Le seul service d'IA externe que nous utilisons est translateapi.ai (également Muddy Holdings) pour traduire les chaînes d'interface utilisateur — cela ne touche jamais votre contenu transcrit.
Comment nous divulguons la génération d'IA
- Transcription des pages HTML: inclure <meta name=\
- Exportations de texte (TXT, TTS, TTT, JSON, CSV, DOCX, PDF): inclure une ligne d'en-tête « AI-générée transcription » en haut de chaque fichier.
- Sortie vocale synthétique / TTS: Les fichiers WAV comprennent une étiquette «synthétique-voix» dans les métadonnées et un avis clair sur la page de téléchargement.
- Réponses de l'API: inclure un _ai_généré: true field dans chaque réponse JSON qui contient du contenu transcrit.
Données sur la formation
- Les modèles de base (Whishper, MadLAD, Qwen, etc.) sont pré-formés par leurs éditeurs respectifs.
- Vos relevés de notes ne sont PAS utilisés pour former des modèles de base.
- Si vous corrigez un segment de transcription (l'icône du crayon) ou que vous le marquez incorrectement (l'icône du drapeau), ET que vous avez opté pour /privacy-settings/ (\
- Séparément, les corrections de Contribut plus audio to Voice Lab toggle (également à /privacy-settings/, également par défaut off) vous opte pour la contribution de l'audio des segments que vous corrigez, jumelés au texte corrigé, à notre jeu de données de Voice Lab sous CC-BY-SA-4.0. Les deux toggles sont indépendants — vous pouvez accorder soit, les deux, ou pas.
- L'audio que vous téléchargez est supprimé dans les 24 heures via le cron cron cleanup_uploads — UNLESS vous avez opté pour \
Précision et erreurs
Les taux d'erreur de mots varient selon l'accent du haut-parleur, la qualité audio, la langue et le vocabulaire de domaine. Pour une utilisation critique (industries juridiques, médicales, réglementées) vérifier par rapport à l'audio original. /models/.
Questions relatives au respect des dispositions
Pour les questions relatives à la loi de l'UE sur l'IA, au RGPD ou à d'autres questions relatives à la conformité: hello@stt.ai ou utiliser les Formulaire de contact.
Dernière mise à jour: 2026-04-26.