Los investigadores de Hacktron AI accedieron con éxito a las cuentas de ChatGPT de los empleados de OpenAI utilizando el modelo Claude de Anthropic, según un informe publicado por Hacktron AI. La violación ocurrió a principios de agosto y fue confirmada por OpenAI. El equipo utilizó la plataforma Discourse, que permite el acceso a ChatGPT y Codex, para infiltrarse en múltiples cuentas. Destacaron el potencial de acceso a plataformas como GitHub, Slack y sistemas de correo electrónico. El incidente destaca las crecientes capacidades de los modelos de IA en las pruebas de ciberseguridad. Anthropic había lanzado recientemente una nueva versión de su modelo Claude, que identificó rápidamente la vulnerabilidad. OpenAI reconoció los hallazgos de los investigadores y abordó los problemas de seguridad. Esto sigue a otros incidentes recientes de ciberseguridad que involucran modelos de IA, lo que provocó llamados a una regulación más estricta.
Lectura del sesgo (Centro): El artículo presenta un relato fáctico de un incidente de ciberseguridad que involucra a modelos de IA sin favorecer abiertamente ninguna postura política en particular, discute los aspectos técnicos de la violación, las respuestas de las empresas y las implicaciones más amplias para la regulación de la IA sin tomar un lado ideológico claro.





