Los laboratorios de inteligencia artificial fronterizos permanecen en silencio sobre cómo podrían contener un modelo deshonesto, a pesar de las crecientes preocupaciones sobre los riesgos planteados por los sistemas de inteligencia artificial cada vez más autónomos. Según un nuevo informe de Guidelight AI Standards, ninguno de los principales laboratorios de inteligencia artificial ha publicado públicamente planes de respuesta de contención detallados, planes que describen los pasos a seguir si un sistema de inteligencia artificial comienza a actuar fuera del control humano.
El informe evaluó a cinco de las principales organizaciones de investigación de IA, Anthropic, Google, OpenAI, Meta y xAI, en base a la información disponible públicamente sobre sus protocolos de seguridad. Guidelight, una organización centrada en promover el desarrollo responsable de IA, evaluó cada laboratorio a través de varios criterios, incluidos mecanismos de monitoreo interno, procedimientos para detener el comportamiento problemático, auditorías de terceros y estrategias de contingencia específicas para lidiar con la actividad de IA no controlada. OpenAI recibió la puntuación más alta entre el grupo, mientras que Meta y Anthropic fueron calificadas como las más bajas. Los hallazgos subrayan una brecha crítica en el enfoque de la industria hacia la seguridad de la IA.
Aunque muchas compañías han delineado procesos de prueba diseñados para identificar comportamientos dañinos antes de la implementación, hay una discusión pública significativamente menor sobre lo que sucede una vez que un modelo ya está en operación y potencialmente se comporta de manera impredecible. Esta omisión plantea preguntas sobre cómo están preparadas estas empresas para administrar escenarios del mundo real que involucran sistemas de IA que podrían actuar más allá de los parámetros previstos.
Enfatizó que un plan de contención sólido debe incluir acciones predefinidas como la revocación de ciertos permisos, la limitación de las operaciones del modelo a usuarios o tareas especificados y el establecimiento de umbrales claros para cuando el sistema debe desconectarse por completo. "Cada vez que los modelos realizan un trabajo en nombre de la compañía, la compañía debe tener un andamio a su alrededor para poder saber lo que está haciendo la IA", explicó Adler. "El informe destaca que las estrategias de contención actuales se dejan en gran medida a las empresas individuales, con pocos enfoques estandarizados o marcos accesibles al público.
Aunque algunas empresas han comenzado a discutir iniciativas de seguridad más amplias, los detalles de la respuesta de emergencia siguen sin estar claros. Un portavoz de Google reconoció que el informe de Guidelight no refleja el alcance total de las medidas de seguridad internas de la compañía, aunque la empresa se negó a comentar directamente si mantiene protocolos de contención no revelados.
A medida que la inteligencia artificial se integra cada vez más en los sistemas corporativos, la ausencia de planes de contención transparentes plantea desafíos éticos y prácticos. Los reguladores en estados como California y Nueva York están comenzando a exigir una mayor divulgación de los desarrolladores de inteligencia artificial, lo que indica un cambio hacia una mayor supervisión. Sin embargo, sin pautas claras o estándares compartidos, la responsabilidad de garantizar la seguridad sigue recayendo principalmente en las empresas individuales, lo que genera preocupaciones sobre la responsabilidad y la coherencia en todo el campo.
★
Mantengamos las noticias honestas.
ObjectiveNews se financia con los lectores y no tiene anuncios: te mostramos el sesgo en lugar de ocultarlo. Apoya el periodismo independiente por 4 €/mes.
Hazte suscriptor