Openai récompense les hackers éthiques pour sécuriser ses ia

OpenAI renforce la sécurité de ses modèles d'intelligence artificielle en lançant un programme de primes à la découverte de failles, baptisé Safety Bug Bounty. L'initiative, qui rémunère des chercheurs et experts pour identifier des vulnérabilités, cible des menaces émergentes comme la manipulation par prompts ou l'abus d'agents autonomes. Une approche novatrice pour contrer les risques qui se présentent dans des scénarios réels.

Openai mise sur la communauté pour débusquer les failles

Openai mise sur la communauté pour débusquer les failles

Contrairement aux programmes de cybersécurité traditionnels, Safety Bug Bounty se concentre sur la conduite des IA, considérées comme une nouvelle surface d'attaque. L'objectif : détecter des problèmes potentiels, comme l'injection d'instructions malveillantes, la fuite de données ou les actions nuisibles des systèmes automatisés. Ce dispositif intervient alors que ChatGPT s'enrichit de nouvelles fonctionnalités – bibliothèques de contenu, outils d'achat intégrés – ouvrant de nouvelles perspectives, mais aussi de nouveaux risques.

Pour qu'une faille soit considérée comme valide, les chercheurs doivent prouver sa reproductibilité, avec un taux de succès d'environ 50%. OpenAI accepte les rapports concernant la divulgation d'informations sensibles, y compris le fonctionnement interne des modèles et leurs schémas de raisonnement. Sont également concernés les failles permettant de contourner les restrictions ou de compromettre l'intégrité de la plateforme.

Toutefois, certains types de découvertes ne sont pas éligibles, notamment les simples