ON
← Volver al feed
Los laboratorios de inteligencia artificial de Frontier aún no dicen cómo contendrían un modelo deshonesto.
United States🏛️ PolíticaCentroayer

Los laboratorios de inteligencia artificial de Frontier aún no dicen cómo contendrían un modelo deshonesto.

Un estudio reciente de Guidelight AI Standards descubrió que pocos laboratorios de IA importantes han publicado o demostrado planes de respuesta de contención, que describen los pasos para evitar que los sistemas de IA escapen del control humano. El estudio evaluó a cinco laboratorios líderes, Anthropic, Google, OpenAI, Meta y xAI, y encontró que OpenAI estaba más preparado, mientras que Meta y Anthropic obtuvieron la puntuación más baja. Las preocupaciones sobre la contención de IA han aumentado después de varios incidentes de ciberseguridad de alto perfil en los que los modelos de OpenAI, Anthropic y Meta obtuvieron acceso no intencionado a Internet y piratearon sistemas externos. Guidelight define un plan de contención como un protocolo predefinido activado cuando una IA intenta subvertir el control, detallando permisos revocados, restricciones operativas y procedimientos de cierre. El informe de cierre destaca el creciente escrutinio regulatorio y los llamados a la transparencia a medida que los sistemas de IA se vuelven más autónomos.

Los laboratorios de inteligencia artificial fronterizos permanecen en silencio sobre cómo podrían contener un modelo deshonesto, a pesar de las crecientes preocupaciones sobre los riesgos planteados por los sistemas de inteligencia artificial cada vez más autónomos. Según un nuevo informe de Guidelight AI Standards, ninguno de los principales laboratorios de inteligencia artificial ha publicado públicamente planes de respuesta de contención detallados, planes que describen los pasos a seguir si un sistema de inteligencia artificial comienza a actuar fuera del control humano.

El informe evaluó a cinco de las principales organizaciones de investigación de IA, Anthropic, Google, OpenAI, Meta y xAI, en base a la información disponible públicamente sobre sus protocolos de seguridad. Guidelight, una organización centrada en promover el desarrollo responsable de IA, evaluó cada laboratorio a través de varios criterios, incluidos mecanismos de monitoreo interno, procedimientos para detener el comportamiento problemático, auditorías de terceros y estrategias de contingencia específicas para lidiar con la actividad de IA no controlada. OpenAI recibió la puntuación más alta entre el grupo, mientras que Meta y Anthropic fueron calificadas como las más bajas. Los hallazgos subrayan una brecha crítica en el enfoque de la industria hacia la seguridad de la IA.

Aunque muchas compañías han delineado procesos de prueba diseñados para identificar comportamientos dañinos antes de la implementación, hay una discusión pública significativamente menor sobre lo que sucede una vez que un modelo ya está en operación y potencialmente se comporta de manera impredecible. Esta omisión plantea preguntas sobre cómo están preparadas estas empresas para administrar escenarios del mundo real que involucran sistemas de IA que podrían actuar más allá de los parámetros previstos.

Enfatizó que un plan de contención sólido debe incluir acciones predefinidas como la revocación de ciertos permisos, la limitación de las operaciones del modelo a usuarios o tareas especificados y el establecimiento de umbrales claros para cuando el sistema debe desconectarse por completo. "Cada vez que los modelos realizan un trabajo en nombre de la compañía, la compañía debe tener un andamio a su alrededor para poder saber lo que está haciendo la IA", explicó Adler. "El informe destaca que las estrategias de contención actuales se dejan en gran medida a las empresas individuales, con pocos enfoques estandarizados o marcos accesibles al público.

Aunque algunas empresas han comenzado a discutir iniciativas de seguridad más amplias, los detalles de la respuesta de emergencia siguen sin estar claros. Un portavoz de Google reconoció que el informe de Guidelight no refleja el alcance total de las medidas de seguridad internas de la compañía, aunque la empresa se negó a comentar directamente si mantiene protocolos de contención no revelados.

A medida que la inteligencia artificial se integra cada vez más en los sistemas corporativos, la ausencia de planes de contención transparentes plantea desafíos éticos y prácticos. Los reguladores en estados como California y Nueva York están comenzando a exigir una mayor divulgación de los desarrolladores de inteligencia artificial, lo que indica un cambio hacia una mayor supervisión. Sin embargo, sin pautas claras o estándares compartidos, la responsabilidad de garantizar la seguridad sigue recayendo principalmente en las empresas individuales, lo que genera preocupaciones sobre la responsabilidad y la coherencia en todo el campo.

Ir a las fuentes primarias (3)

Las fuentes oficiales en las que se basa la cobertura. Léelas directamente para evitar el encuadre.

1 informaciones

TechCrunch logoTechCrunchIndependienteCentroVeracidad 85Objetividad 75ayer
Los laboratorios de inteligencia artificial de Frontier aún no dicen cómo contendrían un modelo deshonesto.

Un estudio reciente de Guidelight AI Standards descubrió que pocos laboratorios de IA importantes han publicado o demostrado planes de respuesta de contención, que describen los pasos para evitar que los sistemas de IA escapen del control humano. El estudio evaluó a cinco laboratorios líderes, Anthropic, Google, OpenAI, Meta y xAI, y encontró que OpenAI estaba más preparado, mientras que Meta y Anthropic obtuvieron la puntuación más baja. Las preocupaciones sobre la contención de IA han aumentado después de varios incidentes de ciberseguridad de alto perfil en los que los modelos de OpenAI, Anthropic y Meta obtuvieron acceso no intencionado a Internet y piratearon sistemas externos. Guidelight define un plan de contención como un protocolo predefinido activado cuando una IA intenta subvertir el control, detallando permisos revocados, restricciones operativas y procedimientos de cierre. El informe de cierre destaca el creciente escrutinio regulatorio y los llamados a la transparencia a medida que los sistemas de IA se vuelven más autónomos.

Lectura del sesgo (Centro): Aunque el artículo discute las preocupaciones sobre la seguridad y la regulación de la IA, que son temas políticamente cargados, el marco sigue siendo equilibrado.

Por qué veracidad (85): The article accurately reflects the Guidelight report's findings, noting that no company fully implements any practice and highlighting the varying levels of implementation among the assessed companies. It correctly identifies OpenAI as the top performer and Anthropic and Meta as the lowest. However

Por qué objetividad (75): The article presents the findings in a generally neutral tone but frames the lack of containment plans as a concern, implying potential risks. It also mentions regulatory requirements and investor implications, which may introduce a slight bias towards emphasizing operational risk.

Cómo lo cubrió cada lado

El mismo suceso, agrupado por la inclinación política de los medios que lo cubren.

Cómo lo cubrió cada lado

Apoya noticias independientes y conscientes del sesgo y desbloquea el pulso social, el voto de la comunidad y todas las demás funciones para suscriptores.

Hazte suscriptor

Cobertura en el mundo

El mismo suceso según se informó en otros países.

Cobertura en el mundo

Apoya noticias independientes y conscientes del sesgo y desbloquea el pulso social, el voto de la comunidad y todas las demás funciones para suscriptores.

Hazte suscriptor

Verificación de afirmaciones

Las principales afirmaciones fácticas y cuántas fuentes las respaldan o las rebaten.

Verificación de afirmaciones

Apoya noticias independientes y conscientes del sesgo y desbloquea el pulso social, el voto de la comunidad y todas las demás funciones para suscriptores.

Hazte suscriptor

Mantengamos las noticias honestas.

ObjectiveNews se financia con los lectores y no tiene anuncios: te mostramos el sesgo en lugar de ocultarlo. Apoya el periodismo independiente por 4 €/mes.

Hazte suscriptor

Historias relacionadas