Anthropic desarrolla una IA que no lanzará al público por riesgos de seguridad
El modelo Claude Mythos Preview detecta fallas críticas sin intervención humana. La empresa lo restringe a grandes compañías y autoridades, mientras crece la preocupación en Wall Street y en el sistema financiero de EE.UU.
Una persona sosteniendo un teléfono con el logotipo compañía Anthropic en Nueva York (Estados Unidos). Foto: EFE .
La empresa de inteligencia artificial (IA) Anthropic anunció esta semana el desarrollo de Claude Mythos Preview, un nuevo modelo de computación con capacidades de programación y ciberseguridad tan avanzadas que la empresa ha decidido vetar su lanzamiento al público general por considerarlo un riesgo para la seguridad global.
En lugar de una comercialización abierta, Anthropic ha lanzado el denominado Proyecto Glasswing -que toma su nombre de la mariposa de alas de cristal que utiliza sus alas transparentes para ocultarse a plena vista-, un modelo de defensa en ciberseguridad a la que podrán acceder más de 40 organizaciones, entre las que figuran Amazon, Apple, Google, Microsoft, Nvidia, CrowdStrike, JPMorgan Chase, Cisco, Broadcom, Palo Alto Networks y la Linux Foundation.
El objetivo es que estos gigantes utilicen la potencia de Mythos para identificar y parchear vulnerabilidades en la infraestructura crítica de software antes de que actores malintencionados puedan explotarlas.
Durante las pruebas internas, Mythos demostró una capacidad autónoma -sin intervención humana, mas allá de escribir el prompt- para hallar fallos de seguridad en los principales sistemas operativos y navegadores web actuales.
Entre los hallazgos más sorprendentes, la IA detectó una vulnerabilidad en el sistema OpenBSD que había permanecido oculta durante 27 años, y otra en la biblioteca de vídeo FFmpeg que no había sido detectada tras cinco millones de pruebas automáticas en 16 años.
“La versión preliminar de Claude Mythos demuestra un salto cualitativo en estas capacidades de ciberseguridad: las vulnerabilidades que ha detectado han logrado, en algunos casos, eludir décadas de revisiones humanas y millones de pruebas de seguridad automatizadas”, anotó Anthropic en un comunicado.
Los datos de rendimiento de Mythos marcan una ruptura con la progresión incremental vista hasta ahora en el sector. En el banco de pruebas SWE-bench Verified, el modelo alcanzó una puntuación del 93,9 %, mientras que en las olimpiadas matemáticas USAMO logró un 97,6 %, frente al 42,3 % que obtenían los modelos punteros hace solo unos meses.
Temor a la obsolescencia
El anuncio ha tenido un eco inmediato en Wall Street, sobre todo en las acciones de las principales firmas de ciberseguridad tradicional, como CrowdStrike y Palo Alto Networks, sufrieron caídas iniciales de entre el 5 % y el 11 %, ante el temor de los inversores de que una IA autónoma pueda hacer obsoletos los productos actuales.
No obstante, ambas compañías forman parte del Proyecto Glasswing, integrando ya esta tecnología en sus sistemas de defensa.
A finales del mes pasado, las acciones del sector de ciberseguridad sufrieron una caída después de que la revista Fortune sacara a la luz el borrador de una entrada de blog de Anthropic, en la que se revelaban las avanzadas capacidades cibernéticas del modelo, así como sus posibles riesgos.
Esta semana, según Bloomberg, el presidente de la Reserva Federal, Jerome Powell, y el secretario del Tesoro, Scott Bessent, se reunieron con los directores ejecutivos de los principales bancos de Estados Unidos -como Bank of America, Citigroup, Goldman Sachs, Morgan Stanley y Wells Fargo- para discutir los posibles riesgos cibernéticos planteados por el modelo Mythos de Anthropic.
De acuerdo con CNBC, la reunión es una señal de que las capacidades avanzadas de esta IA constituyen una preocupación prioritaria para la administración del presidente de Estados Unidos, Donald Trump, y podrían amenazar los cimientos del sistema financiero estadounidense.
La relación entre Anthropic y el Pentágono no pasa por su mejor momento, después de que la empresa de IA impugnara la reciente decisión del Departamento de Defensa (DoD) de catalogar su tecnología como un riesgo para la seguridad nacional en la cadena de suministro.
Pese a esta disputa pública, los medios especializados han informado que el DoD ha continuado utilizando la tecnología de Anthropic durante la guerra de Irán.
Te puede interesar
Con una pala y un cuchillo de cocina: así buscaron dos chicos a sus familiares en los escombros
Winder y Deivi Delfín excavaron durante 26 días para encontrar los cuerpos de su madre, su hermano y su abuela.
Fenómeno El Niño: pronósticos internacionales anticipan un evento histórico
Según los estudios, se espera un pico de calentamiento entre octubre y diciembre.
La celebración del título mundial en España terminó con dos muertos y decenas de heridos
Los festejos se vieron empañados por episodios de violencia, accidentes y disturbios registrados en Madrid, Barcelona, Castilla y otras regiones del país.
El primer ministro de Reino Unido: "Puede que la Copa del Mundo no sea nuestra, pero las Malvinas sin duda lo son"
Desde Downing Street salieron al cruce de Argentina y hasta definieron: "El primer ministro les desea lo mejor a ambos equipos en la final, especialmente a España".
Medio Oriente: la ONU condenó los ataques y Estados Unidos afirmó que el estrecho de Ormuz está abierto
Después de que las fuerzas iraníes atacaran un buque con bandera de Chipre, el Comando Central estadounidense lanzó una ofensiva contra 130 objetivos militares. A pesar de que el régimen iraní aseguró que el estrecho de Ormuz permanece cerrado, las autoridades estadounidenses lo desmienten.