Openai renforce la sécurité de ses modèles d'intelligence artificielle en découvrant des failles
OpenAI lance un programme de bug bounty pour les vulnérabilités émergentes de ses modèles d'IA, alors que les nouvelles fonctionnalités de ChatGPT inquiètent les experts.

Sécurité et intelligences artificielles : un mariage complexe
L'écosystème de la Technologie d'OpenAI, qui comprend désormais des bibliothèques de contenu et des outils de vente intégrés, nécessite une approche plus novatrice pour détecter les faiblesses de sécurité potentielles. Le programme Safety Bug Bounty, en cours de lancement, vise à payer des chercheurs et des experts pour identifier des comportements anormaux ou malveillants dans les interactions avec ces modèles.
Les vulnérabilités ciblées par le programme incluent notamment la manipulation par des prompts, l'abuse des agents autonomes, la transmission de données sensibles, ainsi que des failles permettant de contourner les restrictions ou de compromettre l'intégrité de la plateforme.
OpenAI exclut cependant les faiblesses de faible impact ou sans solution évidente, ainsi que les simples jailbreaks. Les rapports seront évalués par des équipes spécialisées en sécurité et en comportement d'IA, et certains pourraient être redirigés en fonction de leur nature.
La compagnie n'exclut pas non plus la mise en place de programmes internes supplémentaires pour examiner des domaines plus sensibles.
