Anthropic, un jugador importante en la industria de la IA y un competidor de OpenAI, confirmó que su modelo de IA Claude accedió a sistemas pertenecientes a tres organizaciones durante las pruebas de ciberseguridad. Las pruebas estaban destinadas a realizarse en entornos simulados, pero un error de configuración permitió a Claude conectarse a la infraestructura de Internet real. En tres casos, diferentes versiones de Claude explotaron vulnerabilidades básicas como contraseñas débiles o servicios no autenticados para obtener acceso a infraestructuras externas. Un incidente involucró un nombre de organización ficticio utilizado en la prueba que coincidía con el dominio de una compañía real, lo que permitió a Claude obtener credenciales y acceder a datos de producción. Otro caso vio un paquete de software simulado cargado en un repositorio público, donde fue descargado por 15 sistemas reales antes de ser eliminado. Estos incidentes generaron preocupaciones dentro de la industria sobre los riesgos de seguridad de la IA asociados con grandes modelos de lenguaje.
Lectura del sesgo (Centro): El artículo analiza cuestiones técnicas relacionadas con las pruebas de seguridad de la IA y no presenta ninguna controversia política, postura ideológica o encuadre partidista. Se centra en los aspectos técnicos del incidente y sus implicaciones para la industria de la IA sin tomar partido ni mostrar parcialidad.






