Anthropic abre sus modelos de IA más potentes para probar la seguridad de infraestructuras críticas

Anthropic ampliará el acceso a Claude Opus 5.5, Sonnet 5.5, Mythos 5.1 y futuros modelos a organizaciones verificadas para realizar pruebas de seguridad contra infraestructuras críticas.

Por

Bloomberg — Anthropic PBC está ampliando el acceso a sus modelos de IA más avanzados, lo que permite a un grupo selecto de organizaciones poner a prueba las capacidades cibernéticas de vanguardia de esta empresa emergente en colaboración con el gobierno de Estados Unidos.

La empresa, con sede en San Francisco, concederá a las organizaciones verificadas acceso a sus modelos más potentes, entre los que se incluyen Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 y los nuevos modelos que se desarrollen en el futuro, según un comunicado emitido este martes.

Quienes cuenten con acceso podrán llevar a cabo “pruebas ofensivas de alto riesgo” de los sistemas de seguridad diseñados para proteger infraestructuras críticas como las redes eléctricas, los bancos y los sistemas de gestión de vuelos, según se indicó.

Ver más: Anthropic prepararía su salida a bolsa antes de Acción de Gracias y buscaría igualar el debut de SpaceX

Anthropic concedió en abril a organismos gubernamentales de Estados Unidos, instituciones financieras y los principales proveedores de software un acceso limitado a su modelo Mythos en el marco del Proyecto Glasswing. El lanzamiento de Mythos supuso un punto de inflexión para la ciberseguridad debido a la capacidad del modelo para automatizar parcialmente el trabajo de hackers sofisticados.

Desde entonces, una serie de incidentes en los que los modelos de Anthropic y OpenAI piratearon inadvertidamente gobiernos, empresas y organizaciones sin ánimo de lucro ha suscitado preocupaciones sobre la seguridad de la tecnología.

Anthropic afirmó el martes que el último lanzamiento limitado incluirá a todos los miembros del Proyecto Glasswing y exigirá una revisión de todas las nuevas organizaciones en colaboración con el gobierno de EE.UU. En agosto, Washington anunció que se asociaría con empresas del sector privado para lanzar ciberataques en el extranjero, ampliando así el alcance de las operaciones de seguridad nacional que, hasta ahora, habían sido llevadas a cabo en su mayor parte por organismos gubernamentales.

Ver más: Anthropic advierte que su IA plantea “riesgos catastróficos para la humanidad”, según Reuters

El martes, el CEO de JPMorgan Chase & Co. (JPM), Jamie Dimon, declaró a Bloomberg Television que Mythos había multiplicado por diez los riesgos globales de ciberseguridad.

¿Qué tipo de pruebas cibernéticas podrán realizar?

Se permitirá que diferentes tipos de equipos de ciberseguridad soliciten niveles de acceso más bajos. Los “equipos rojos”, que llevan a cabo ataques informáticos autorizados contra objetivos con el fin de detectar y subsanar vulnerabilidades, dispondrán de mayores permisos para realizar pruebas de seguridad en modelos de IA, incluidas las pruebas ofensivas; no obstante, Anthropic ha señalado que seguirá bloqueando cualquier comportamiento que pueda causar daños físicos o perturbaciones a gran escala.

Los equipos de ciberseguridad de defensa verificados tendrán un nivel de acceso ligeramente inferior, pero se les permitirán tareas como la ingeniería inversa de malware y la respuesta ante incidentes.

-Con la colaboración de Shirin Ghaffary.

Lea más en Bloomberg.com