Introduction
L'émergence des intelligences artificielles génératives pose des défis inédits au Règlement Général sur la Protection des Données (RGPD). Comment concilier l'aspiration massive de données nécessaire à l'entraînement de ces modèles avec les principes de minimisation et de finalité ?
Le principe de minimisation à l'épreuve
Le RGPD impose que seules les données strictement nécessaires soient collectées. Or, les LLM fonctionnent sur le principe inverse : l'ingestion de corpus gigantesques de données hétérogènes.
Les droits des personnes concernées
L'exercice du droit d'accès, de rectification et surtout d'effacement (droit à l'oubli) s'avère particulièrement complexe sur un modèle entraîné où la donnée ne peut être simplement « supprimée ».