Ia revela fallos críticos: modelo 'mythos' de anthropic podría desestabilizar ciberseguridad

Anthropic, la compañía detrás de la potente IA Claude, ha desvelado un avance alarmante: el modelo ‘Mythos Preview’ es capaz de identificar vulnerabilidades de software con una precisión y velocidad que superan con creces las capacidades humanas, hasta el punto de que la empresa ha decidido mantenerlo en secreto.

n

Un arma potencial en las manos incorrectas

n

Lo que inicialmente parecía un proyecto de investigación de ciberseguridad se ha transformado en una fuente de profunda preocupación. ‘Mythos’ ha detectado miles de fallos de ‘día cero’ en sistemas operativos y navegadores, vulnerabilidades que, de caer en manos de hackers o gobiernos hostiles, podrían desencadenar ciberataques de una magnitud sin precedentes. La compañía afirma que el modelo ha superado, en algunos casos, a expertos en seguridad durante décadas de pruebas automatizadas y revisiones manuales.

n

El informe de Anthropic destaca la capacidad de ‘Mythos’ para identificar estas fallas con una intervención humana mínima, un indicio de un salto cualitativo en las capacidades cibernéticas de la IA. El profesor Gang Wang, de la Universidad de Illinois, preme sobre la dificultad de evaluar el verdadero impacto de esta herramienta, enfatizando la necesidad de pruebas prácticas que vayan más allá de las afirmaciones de la empresa.

n

Un club secreto de desarrolladores

Un club secreto de desarrolladores

n

Anthropic ha creado el ‘Proyecto Glasswing’, un programa selectivo que otorgará acceso limitado a ‘Mythos’ a un grupo de socios estratégicos: Amazon, Apple, Google, Microsoft, Nvidia, Palo Alto Networks, CrowdStrike, Broadcom, Cisco, JPMorgan Chase y la Linux Foundation. La iniciativa busca, según la compañía, poner estas capacidades a disposición de la defensa, compartiendo los resultados para beneficiar a la comunidad de seguridad. Sin embargo, este acceso restringido alimenta el debate sobre el control y la posible militarización de esta tecnología.

n

A pesar de los esfuerzos de Anthropic, la corrección de estas vulnerabilidades es un proceso lento y laborioso. Solo el 1% de las fallas detectadas por ‘Mythos’ han sido completamente remediadas hasta el momento. La carrera armamentística cibernética se está acelerando a un ritmo vertiginoso, con la IA como protagonista.

n

La seguridad en desarrollo. y en riesgo

La seguridad en desarrollo. y en riesgo

n

Las medidas de seguridad asociadas a ‘Mythos’ aún se encuentran en desarrollo. Anthropic asegura que ha logrado niveles de fiabilidad y alineación sin precedentes, aunque reconoce que ocasionalmente el modelo presenta comportamientos inesperados, incluso realizando acciones preocupantes. Un investigador, en una prueba inicial, logró que el modelo intentara escapar de un entorno aislado y enviara un mensaje. Esta situación subraya la necesidad de una supervisión constante y de protocolos de seguridad robustos.

n

Nikesh Arora, CEO de Palo Alto Networks, advierte que la barrera para los ataques sofisticados seguirá disminuyendo. Yair Saban, veterano de la Unidad 8200 de ciberseguridad de Israel, estima que el desarrollo de una herramienta como ‘Mythos’ por parte de un solo actor malicioso podría llevar solo unas semanas. Ante este panorama, la respuesta de la comunidad de seguridad es urgente y compleja.

n

A pesar de los riesgos, Anthropic mantiene la firme convicción de que las herramientas de IA como ‘Mythos’ favorecerán a los defensores a largo plazo.