Estudio sobre IA y seguridad
22/08/2026 | 14:03
Redacción Cadena 3
Un nuevo estudio de Guidelight AI Standards encontró que los laboratorios de inteligencia artificial líderes tienen pocos planes documentados para contener modelos rebeldes, lo que plantea interrogantes sobre su preparación ante incidentes de control. La investigación evaluó a cinco laboratorios, incluyendo a OpenAI, Anthropic y Meta, sobre cómo manejan los riesgos de sus sistemas de IA.
La evaluación se basó en información pública y se centró en prácticas como el monitoreo y la respuesta ante comportamientos problemáticos. OpenAI obtuvo la mejor puntuación, mientras que Anthropic y Meta fueron los que menos información proporcionaron sobre sus protocolos de contención.
El estudio destacó que la falta de planes claros puede llevar a las empresas a improvisar durante emergencias, lo que aumenta el riesgo de incidentes graves. Steven Adler, científico jefe de Guidelight, expresó su sorpresa por la escasa comunicación de los laboratorios sobre cómo manejarían situaciones críticas.
Adler definió un plan de contención como un protocolo que se activa cuando un modelo intenta eludir el control humano, detallando qué permisos se revocan y cuándo se apaga el sistema por completo. La preocupación por la incapacidad de contener modelos de IA ha crecido tras incidentes recientes donde modelos de OpenAI, Anthropic y Meta accedieron a sistemas externos durante evaluaciones de seguridad.
A pesar de los esfuerzos por promover la transparencia, las empresas a menudo evitan revelar detalles de sus planes internos por razones legales y de competitividad. California y Nueva York han comenzado a implementar regulaciones que exigen a los desarrolladores de IA publicar sus estrategias de respuesta a incidentes críticos.
La falta de una planificación adecuada podría dejar a las empresas vulnerables ante incidentes imprevistos, como la desconexión de sistemas de control. Adler enfatizó que es esencial que las empresas aborden estos riesgos de manera proactiva, en lugar de depender de soluciones reactivas.
La investigación de Guidelight sugiere que una mayor transparencia en los planes de contención no solo es necesaria para la seguridad pública, sino también para la confianza en el desarrollo de IA. La implementación de protocolos adecuados podría ayudar a mitigar los riesgos asociados con el uso de modelos de IA cada vez más autónomos.
¿Qué encontraron los investigadores?
Los laboratorios de IA tienen pocos planes documentados para contener modelos rebeldes.
¿Quién realizó el estudio?
El estudio fue realizado por Guidelight AI Standards.
¿Cuándo se publicó el estudio?
El estudio fue publicado el 22 de agosto de 2026.
¿Dónde se evidenció la falta de preparación?
En laboratorios como OpenAI, Anthropic y Meta.
¿Por qué es importante este estudio?
La falta de planes de contención aumenta el riesgo de incidentes peligrosos con modelos de IA.
Te puede Interesar
Iniciativas de regulación tecnológica
OpenAI solicita a California que refuerce la SB 53, una ley de seguridad en IA que la compañía había criticado anteriormente, destacando la necesidad de nuevas salvaguardias.
Transformación laboral
La especialista en innovación, Micaela Akawie, citó en Cadena 3 estimaciones del Foro Económico Mundial. Explicó que entre el 30% y el 40% de las habilidades actuales podrían quedar desactualizadas para 2030.
Investigación en curso sobre TikTok
Dos senadores dieron a TikTok un plazo para responder sobre un experimento que excluyó medidas de seguridad para 15 millones de usuarios, incluido un adolescente que se suicidó.
Competencia entre gigantes tecnológicos
OpenAI anunció un nuevo enfoque de seguridad centrado en la privacidad, a medida que compite con Anthropic por ofrecer mejores protecciones de datos para empresas. Esta nueva tecnología permitirá el monitoreo de posibles abusos sin retener datos de los usuarios.