La Casa Blanca ha solicitado a algunos laboratorios estadounidenses de inteligencia artificial, entre ellos OpenAI y Anthropic, que reserven el acceso a sus nuevos modelos de vanguardia para que el gobierno de Estados Unidos los pruebe antes de compartirlos con otros organismos de evaluación independientes, como el AI Security Institute (UK AISI), que es una referencia en el sector. 1
- De este modo, el gobierno estadounidense pondría en tela de juicio el acceso privilegiado previo al despliegue del que disponía hasta ahora este instituto público británico.
- El orden de acceso a los nuevos modelos de frontera sería, a partir de ahora, el siguiente: en primer lugar, una evaluación por parte del gobierno estadounidense; a continuación, la protección de los sistemas estadounidenses; y solo después, el intercambio del modelo con socios extranjeros.
El instituto UK AISI es uno de los principales organismos públicos del mundo especializados en la evaluación previa y posterior a la implementación de modelos de frontera.
- Creado en noviembre de 2023 tras la cumbre sobre seguridad de la IA celebrada en Bletchley Park, evalúa la mayoría de los modelos en la frontera y documenta, entre otras cosas, sus capacidades cibernéticas, biológicas y químicas, la autonomía de los agentes o incluso los riesgos relacionados con la mejora recursiva de la IA.
- Al igual que otras organizaciones de evaluación independientes (como METR o Redwood Research, entre otras), la UK AISI podía beneficiarse de un acceso anticipado a los puntos de control previos al lanzamiento al mercado para llevar a cabo pruebas con sus propios referentes y documentar la evolución de las capacidades y los riesgos asociados a los modelos de IA.
A principios de septiembre, el Financial Times informaba de que la AISI del Reino Unido no había tenido acceso a Mythos 5.1, a pesar de que, históricamente, había disfrutado de acceso anticipado a los principales modelos estadounidenses. 2 Anteriormente, OpenAI, Anthropic y Google DeepMind habían proporcionado al Instituto acceso a algunos de sus modelos más avanzados para que fueran sometidos a pruebas.
Esta evolución se produce en un momento en el que las capacidades cibernéticas de los modelos de frontera se están convirtiendo en una cuestión de seguridad nacional.
- En junio, el gobierno estadounidense ya había impuesto controles a la exportación de Fable y Mythos, los modelos de Anthropic, sobre todo debido a la rápida mejora de sus capacidades en el ámbito de la ciberseguridad, prohibiendo así su uso por parte de ciudadanos extranjeros.
- La NSA está probando ahora modelos avanzados para identificar vulnerabilidades que puedan afectar a los sistemas de inteligencia y defensa, y está desarrollando sus propias evaluaciones. Al parecer, la agencia destina a ello varios miles de millones de dólares al año, principalmente en capacidad de cálculo. 3
- El equivalente directo estadounidense del AISI británico, el Centro para las Normas e Innovación en IA (CAISI), sigue contando con recursos mucho más limitados que el instituto británico. Con sede en el NIST, el CAISI padece una financiación insuficiente y cuenta con una plantilla de investigación más reducida.
Los laboratorios de IA también han propuesto una evaluación directa entre ellos, sin supervisión gubernamental. De este modo, se someterían mutuamente a prueba sus modelos antes de su comercialización.
- Google, OpenAI y Anthropic están colaborando en la creación de un organismo privado de normalización dedicado a la seguridad de la IA, que podría definir normas comunes de evaluación previas a la puesta en marcha.
- La cuestión relativa a las capacidades de evaluación independientes cobra aún más importancia a medida que evolucionan las capacidades y las arquitecturas de los modelos.
- Redwood Research destaca, en particular, que ciertas arquitecturas podrían reducir considerablemente la capacidad de los evaluadores humanos para supervisar y auditar el comportamiento de los modelos, ya que estos ya no razonan mediante una cadena de pensamiento textual comprensible, sino a través de estados latentes internos que no se pueden observar directamente. 4
Más allá de las pruebas y los informes de evaluación, esta asimetría en el acceso a los modelos de vanguardia afecta a la industria europea en la práctica. El proyecto Glasswing, el programa de Anthropic que ofrece acceso anticipado a Mythos, permitió desde abril a los bancos y empresas críticas estadounidenses reforzar su defensa cibernética, en particular buscando con Mythos vulnerabilidades en sus propios sistemas. Los bancos europeos no tuvieron acceso a él hasta varios meses después.
Notas al pie
- Sophia Cai y Joseph Bambridge, «White House asks OpenAI and Anthropic to hold new models from UK testers until US review», Politico, 24 de septiembre de 2026.
- Lucy Fisher y Madhumita Murgia, «Anthropic withheld latest AI model from UK testing agency», Financial Times, 9 de septiembre de 2026.
- Jeff Stein, «Classified Estimates Show the NSA Is Paying Billions to Test AI Models», The Washington Sun, 24 de septiembre de 2026.
- Lukas Finnveden et al., «Latent reasoning architectures would undermine CoT, our strongest oversight tool», Redwood Research, 23 de septiembre de 2026.