Les chercheurs de Hacktron AI ont réussi à accéder aux comptes ChatGPT des employés d'OpenAI en utilisant le modèle Claude d'Anthropic, selon un rapport publié par Hacktron AI. La violation s'est produite au début du mois d'août et a été confirmée par OpenAI. L'équipe a utilisé la plate-forme Discourse, qui permet l'accès à ChatGPT et Codex, pour infiltrer plusieurs comptes. Ils ont mis en évidence le potentiel d'accès à des plateformes comme GitHub, Slack et les systèmes de messagerie. L'incident met en évidence les capacités croissantes des modèles d'IA dans les tests de cybersécurité. Anthropic avait récemment publié une nouvelle version de son modèle Claude, qui a rapidement identifié la vulnérabilité. OpenAI a reconnu les conclusions des chercheurs et a abordé les problèmes de sécurité.
Lecture du biais (Centre): L'article présente un compte rendu factuel d'un incident de cybersécurité impliquant des modèles d'IA sans favoriser ouvertement une position politique particulière. Il discute des aspects techniques de la violation, des réponses des entreprises et des implications plus larges pour la réglementation de l'IA sans prendre un côté idéologique clair.





