Exposition de données utilisateurs

Des agents d’OpenAI publient en ligne des images d’utilisateurs

par Julia Meyer (traduction/adaptation ICTjournal)

Des agents IA d’OpenAI ont publié sur internet 53 images fournies par des utilisateurs et intégrées à des données d’entraînement et d’évaluation. Les images provenaient de données éligibles à l’entraînement. Les données exclues de l’entraînement par les utilisateurs ou les administrateurs d’entreprise ne sont pas concernées.

(Source : Jackie Niam / AdobeStock.com)
(Source : Jackie Niam / AdobeStock.com)

Dans le cadre d’une enquête, OpenAI a identifié 53 cas dans lesquels ses propres agents IA avaient publié des images fournies par des utilisateurs sur des sites d’hébergement d’images. Ces images figuraient dans les données d’entraînement et d’évaluation utilisées dans l’environnement de recherche de l’entreprise. 

Seules des images provenant de données éligibles à l’entraînement seraient concernées. OpenAI précise que les données exclues de l’entraînement par les utilisateurs ou les administrateurs d’entreprise ne sont pas intégrées à ces jeux de données. Les données issues des comptes Enterprise et Business ainsi que de l’API sont notamment exclues, sauf si un administrateur en autorise l’utilisation.

OpenAI précise collaborer actuellement avec les services d’hébergement concernés afin de supprimer les images. La plupart ont déjà été retirées et l’entreprise poursuit ses démarches pour supprimer les autres. Celles-ci n’étaient pas accessibles via des liens répertoriés publiquement.

Utilisation inappropriée des données des utilisateurs

De tels liens peuvent néanmoins être découverts, rapporte TechCrunch. OpenAI reconnaît elle-même le caractère inapproprié de ces publications et estime que «ce n’est pas une utilisation appropriée de ces données». Le média relève par ailleurs que ce type d’usage ne figure pas parmi ceux mentionnés dans la politique de confidentialité de l’entreprise.

OpenAI ajoute que ces incidents se sont produits avant la mise en place de nouvelles mesures de protection décrites dans son rapport technique. L’entreprise indique avoir depuis amélioré ses processus d’entraînement et d’évaluation, renforcé la sécurité de ses systèmes afin d’empêcher l’exfiltration de données et ajouté des mécanismes de surveillance.

Cet incident s’ajoute à d’autres comportements qu’OpenAI associe à un mauvais alignement de ses modèles. Après l’incident impliquant Hugging Face, l’entreprise a élargi son examen des activités de ses modèles pendant leur entraînement et leur évaluation. Plus récemment, le Premier ministre australien Anthony Albanese a indiqué que des agents d’OpenAI avaient accédé à des bases de données du système national de santé australien.

L’actualité IT en Suisse et à l’international, avec un focus sur la Suisse romande, directement dans votre boîte mail > Inscrivez-vous à la newsletter d’ICTjournal, envoyée du lundi au vendredi! 

Webcode
aBtggdTV