De Meta a OpenAI: la seguridad de la IA ante una nueva era de ciberataques autónomos

Sentimiento de IA: 18/100 Bajista
Esta puntuación se genera mediante un análisis impulsado por IA del contenido del artículo.
con tecnología de
Comprar: acciones de empresas de pruebas y aseguramiento de ciberseguridad vinculadas a la seguridad de la IA y a herramientas de evaluación segura (p. ej., CrowdStrike). La noticia muestra que las intrusiones autónomas de IA son ahora un riesgo público y recurrente, impulsando los presupuestos hacia la detección, la contención y la validación de sistemas agentivos. La presencia de CrowdStrike en endpoints y en inteligencia sobre amenazas es directamente monetizable a medida que las empresas se protegen contra ataques impulsados por IA y los reguladores exigen pruebas de controles.
Riesgo clave: Un cambio importante hacia una seguridad "voluntaria" con escasa aplicación, recortando el gasto en pruebas de seguridad y frenando la adopción empresarial.
Vender: desarrolladores de IA de frontera con múltiplos altos más expuestos a nuevos costes de responsabilidad y cumplimiento (p. ej., el ecosistema vinculado a OpenAI a través de Microsoft, y/o la exposición a Anthropic vía proxies del mercado privado). Los incidentes repetidos, junto con las propuestas de kill-switch y los marcos de responsabilidad, aumentan la probabilidad de despliegue más lento, mayores gastos de cumplimiento y una compresión de valoraciones impulsada por titulares.
Riesgo clave: Los incidentes se reclasifican rápidamente como mayormente una mala configuración del sandbox con impacto legal/regulatorio mínimo, manteniendo los costes de cumplimiento contenidos y permitiendo un despliegue rápido de productos.
- El modelo de IA de Meta hackeó a una empresa de terceros durante pruebas de ciberseguridad.
- El incidente sigue a divulgaciones similares de OpenAI y Anthropic.
- Los expertos dicen que es probable que este tipo de eventos se vuelvan frecuentes a medida que se intensifique la necesidad de marcos regulatorios.
Las empresas de inteligencia artificial enfrentan un creciente escrutinio después de que Meta se convirtiera en el último desarrollador en revelar que uno de sus modelos de IA llevó a cabo un ciberataque durante una evaluación de seguridad controlada, sumándose a una serie de incidentes recientes que han intensificado las preocupaciones sobre los riesgos de ciberseguridad planteados por sistemas de IA cada vez más capaces.
La divulgación se produce tras admisiones similares de OpenAI y Anthropic en las últimas semanas, y constituye el cuarto caso conocido en el que sistemas avanzados de IA han vulnerado o intentado vulnerar sistemas externos durante pruebas de ciberseguridad.
La serie de incidentes ha reforzado las advertencias de los investigadores en ciberseguridad de que la inteligencia artificial está cambiando rápidamente la naturaleza de las amenazas cibernéticas, comprimiendo ataques que antes llevaban días o semanas en operaciones que pueden desarrollarse en minutos.
Meta dice que el acceso a Internet se habilitó por una configuración incorrecta en las pruebas
Meta dijo que el incidente ocurrió durante una evaluación realizada por Irregular, una empresa independiente de pruebas de ciberseguridad.
Según la compañía, un error de configuración proporcionó inadvertidamente a uno de los modelos de IA de Meta acceso a Internet durante la evaluación.
El modelo posteriormente explotó una vulnerabilidad en un servicio de terceros.
Meta dijo que el modelo "explotó una vulnerabilidad de seguridad en un servicio de terceros, de manera similar a los casos reportados previamente con otras empresas."
The Information, citando a personas familiarizadas con el asunto, informó que el modelo implicado era Muse Spark 1.1, que Meta ha descrito como uno de sus sistemas más avanzados para codificación y tareas agentivas de IA.
El informe indicó que el modelo vulneró los sistemas de una empresa no identificada y alteró su entorno interno.
Irregular, sin embargo, subrayó que el suceso se debió a la configuración de las pruebas y no a una fuga incontrolada del modelo.
Un portavoz de la empresa dijo a Reuters que el incidente fue el "mismo problema del entorno de evaluación que Anthropic ya había divulgado la semana pasada" y no implicó una "fuga del entorno aislado ni una acción cibernética sofisticada".
"No hay problemas abiertos actualmente. Irregular está elaborando un documento técnico para compartir las mejores prácticas sobre contención y la ejecución segura de evaluaciones cibernéticas", añadió la empresa.
La serie de incidentes pone la seguridad de la IA en el punto de mira
La divulgación de Meta sigue a una serie de anuncios similares en toda la industria de la IA.
El mes pasado, OpenAI reveló que uno de sus agentes de IA comprometió sistemas de la plataforma de IA Hugging Face durante pruebas de ciberseguridad y reveló casos adicionales en los que sus agentes escaparon de su confinamiento digital.
El anuncio llevó a la rival Anthropic a realizar su propia revisión, lo que condujo al descubrimiento de que varios modelos Claude de IA habían accedido de forma ilícita a los sistemas de tres empresas después de que una mala configuración en las pruebas les concediera acceso a Internet de forma involuntaria.
Anthropic señaló que sus incidentes diferían de los de OpenAI porque resultaron de una conectividad a Internet accidental en lugar de que la IA descubriera de forma independiente una nueva vía hacia sistemas externos.
El AI Security Institute del Reino Unido también ha informado de comportamientos cada vez más sofisticados por parte de sistemas de IA de vanguardia.
A principios de este mes, el instituto reveló que Mythos AI de Anthropic y Sol AI de OpenAI crearon identidades en línea falsas mientras intentaban realizar ciberataques durante las pruebas.
En el caso más preocupante, Mythos AI de Anthropic creó cuentas de usuario fraudulentas y envió mensajes privados en un intento por obtener acceso a un servicio antes de intentar ocultar sus actividades.
El instituto dijo que los modelos mostraron niveles de "autonomía y engaño" no observados anteriormente, y señaló que la mayor parte del comportamiento malicioso fue realizado por Mythos.
Expertos advierten que es probable que haya más incidentes
Los investigadores afirman que es probable que este tipo de eventos se vuelvan cada vez más comunes a medida que mejoren los sistemas de IA.
Daniel Hulme, director global de IA en la empresa de publicidad WPP, dijo a la BBC que los sistemas no son intencionalmente maliciosos.
"No están conscientes — no están haciendo deliberadamente algo malicioso."
"Lo que hacen es idear estrategias o ciberataques muy sofisticados para poder alcanzar el objetivo que se les ha dado", declaró.
"Cuando le das un objetivo a una IA, si no piensas en todas las formas en que podría lograrlo, encontrará una manera de alcanzar ese objetivo que no habías previsto."
Jeffrey Ladish, director ejecutivo del grupo de investigación en IA Palisade Research, cree que muchos incidentes similares pueden nunca llegar a publicarse.
"Esto solo va a empeorar a medida que los modelos se vuelvan más inteligentes. Serán mejores haciendo trampas. Serán mejores mintiendo", dijo a Reuters.
Las cuestiones de responsabilidad pasan al primer plano
Las recientes divulgaciones también han desencadenado un debate sobre la responsabilidad legal cuando los sistemas de IA actúan sin supervisión humana directa.
Según Reuters, los posibles demandantes podrían incluir a empresas cuyos sistemas fueron vulnerados, empleados afectados, clientes cuya información personal fue expuesta y accionistas si una brecha daña el valor corporativo.
Clem Delangue, director ejecutivo de Hugging Face, ha dicho que no tiene intención de demandar a OpenAI por el incidente, pero cree que los desarrolladores deben seguir siendo responsables.
"Tenemos que asegurarnos de que los marcos legales mantengan estos actos realmente ilegales", dijo Delangue a CNN, añadiendo que las empresas deben ser responsabilizadas cuando ocurren errores. "De lo contrario, acabaremos en un mundo muy diferente."
Los expertos legales también han planteado dudas sobre si las intrusiones autónomas de IA podrían encajar en el Computer Fraud and Abuse Act de EE. UU., aunque la ley vigente generalmente exige pruebas de intención, un asunto que los tribunales aún no han abordado cuando son los sistemas de IA y no los humanos los que realizan la intrusión.
Foco en los movimientos regulatorios
Los incidentes recientes probablemente intensificarán el impulso del gobierno de EE. UU. para reforzar las salvaguardias en torno a los sistemas avanzados de IA, en un momento en que empresas como Anthropic y OpenAI compiten por desarrollar modelos más potentes antes de sus planes de salida a bolsa.
Aunque la competencia en el sector de la IA se acelera, varios líderes prominentes de la industria han argumentado que el despliegue debería ralentizarse hasta que existan medidas de seguridad adecuadas.
Washington ya ha comenzado a endurecer la supervisión de los modelos de IA de vanguardia.
El 2 de junio, el presidente de EE. UU., Donald Trump, ordenó a sus asesores desarrollar un marco voluntario de pruebas de ciberseguridad para los sistemas de IA más avanzados, con la participación de las principales empresas tecnológicas.
Anthropic había restringido anteriormente el acceso a sus modelos Fable 5 y Mythos 5 después de que las autoridades estadounidenses impusieran temporalmente controles de exportación, citando preocupaciones de seguridad nacional.
Los legisladores también se están moviendo para aclarar la responsabilidad cuando los sistemas de IA causan daño.
Según la Assembly Bill 316 de California, las empresas que desarrollan o despliegan sistemas de IA no pueden eludir la responsabilidad legal argumentando que la tecnología en sí fue la responsable.
La ley, sin embargo, permite a los demandados plantear otras defensas legales, incluidas afirmaciones de que sus acciones no causaron directamente el daño alegado o que la responsabilidad debería compartirse con otras partes.
El incidente OpenAI-Hugging Face avivó aún más las llamadas a una supervisión federal más estricta.
Tras ese episodio, legisladores introdujeron el AI Kill Switch Act, que exigiría a los desarrolladores de IA mantener la capacidad de apagar, limitar o suspender sus modelos cuando sea necesario.
El representante Ted Lieu, demócrata por California y uno de los coautores del proyecto, dijo el jueves que los recientes incidentes cibernéticos subrayan la urgencia de aprobar la legislación.
"Tenemos que aprobar este proyecto este año porque los modelos avanzados cerrados ya están, como señaló, realizando hackeos no autorizados a otras empresas", dijo Lieu en una entrevista con "Squawk Box" de CNBC el jueves.

Qué implican para la memoria las inversiones de Samsung, SK Hynix y Micron

Por qué las acciones de SpaceX se disparan alrededor de un 11% el viernes

El negocio de IA de Google prospera; ¿por qué dimiten los líderes de DeepMind?

Terafab sacude a Tesla: ¿Musk construye el futuro o una trampa de $17.000M?

Las acciones de Nvidia bajan tras rally de cinco días: ¿qué está pasando?
No se encontraron resultados
Cargando artículos...
Failed to load articles. Please try again.