La Casa Blanca impone un plazo de 30 días a cada modelo de IA fronteriza — y nadie sabe en qué consiste la prueba
Los modelos de IA más potentes del planeta están a punto de chocar contra un nuevo tipo de muro. No un muro de computación. No un muro de datos. Un muro gubernamental.
Para el 1 de agosto, la Casa Blanca debería finalizar un marco voluntario con OpenAI, Anthropic, Google, Microsoft y Amazon que otorga a las agencias federales hasta 30 días para revisar cualquier modelo de IA fronteriza antes de su lanzamiento público. Los puntos de referencia para evaluar esos modelos? Clasificados. Los criterios para aprobarlos? También clasificados. Y Meta, la empresa detrás de los modelos de peso abierto más difundidos del planeta? No forma parte del acuerdo.
Esto no es una discusión de política hipotética. Está a días de volverse operativa, y remodelará la forma en que se lanza la próxima generación de IA.
Qué hace realmente el marco
El mecanismo central es sencillo sobre el papel. Cualquier modelo de IA que las agencias federales clasifiquen como "modelo fronterizo cubierto" — una designación determinada por criterios de evaluación clasificados que desarrollan la NSA y CISA bajo la Orden Ejecutiva de IA y ciberseguridad del 2 de junio de Trump — debe enviarse al gobierno para un período de revisión previo al lanzamiento de hasta 30 días.
Durante esa ventana, la NSA y CISA acceden al modelo antes que cualquier otro socio. El gobierno también adquiere un papel para seleccionar qué "socios de confianza" reciben acceso anticipado después de la autorización. Esa última parte importa: significa que la influencia federal se extiende más allá del momento de lanzamiento y llega al acceso al mercado.
La ventana de 30 días fue en sí misma un compromiso. Los borradores internos supuestamente fijaron el número en 90 días, pero se retrocedió después de que los partidarios de la industria advirtieron que una revisión extendida entregaría ventaja competitiva a los desarrolladores de IA chinos que operan enteramente fuera del marco.
"Voluntario" está haciendo mucho trabajo pesado
La orden ejecutiva excluye expresamente cualquier "licencia gubernamental obligatoria, autorización previa o requisito de permiso" para el desarrollo o lanzamiento de modelos de IA. Esa redacción se incluyó para tranquilizar a la industria de que Washington no está construyendo un régimen de aprobación.
Pero pregúntenle a Anthropic qué tan voluntario se siente.
El 12 de junio, el Pentágono emitió una directiva de control de exportaciones dirigida a Claude Fable 5 y Mythos 5 — cerrados globalmente con 90 minutos de aviso, después de que investigadores de Amazon demostraran una técnica de jailbreak. Los modelos permanecieron bloqueados durante 19 días. La condición para la reinstalación? Anthropic tuvo que implementar lo que describió como "filtros de jailbreak del 99% o más". Una condición fijada por el gobierno, aceptada por la empresa en privado, sin estándar publicado para qué significa el 99% o cómo se medirá.
Un funcionario de la Casa Blanca dijo a CNBC la semana pasada que "no proporciona aprobaciones para lanzamientos de IA de empresas privadas" y que cualquier compromiso es "voluntario". Sin embargo, CNBC también informó que la administración bloqueó Claude Mythos 5 y Fable 5 debido a "preocupaciones de seguridad nacional". Y que OpenAI fue "solicitada por la administración para restringir su reciente lanzamiento de GPT-5.6".
El patrón es claro: el mecanismo de cumplimiento detrás del marco "voluntario" consiste en amenazas de control de exportaciones, retrasos en aprobaciones de lanzamiento y llamadas directas de funcionarios de gabinete. El gobierno ya demostró que puede cerrar modelos sin ningún estándar publicado. El marco simplemente formaliza la palanca.
El sistema de puntuación de jailbreak del que nadie habla
Oculto dentro del acuerdo emergente hay algo que puede importar incluso más que la propia ventana de revisión: el primer sistema de puntuación compartido para vulnerabilidades de jailbreak en IA.
Anthropic publicó un borrador de la propuesta Escala de Severidad de Jailbreak Cibernético (CJS) el 2 de julio, desarrollada con sus socios Glasswing incluyendo Amazon, Microsoft y Google. El marco asigna a cada jailbreak descubierto una calificación de severidad de CJS-0 (Informativo) a CJS-4 (Crítico), puntuada en cuatro ejes: ganancia de capacidad, amplitud, facilidad de armamentización y discoverability.
El diseño está deliberadamente modelado en CVSS — el Sistema de Puntuación de Vulnerabilidades Comunes que le dio a la industria de la ciberseguridad un lenguaje compartido para calificar fallas de software hace dos décadas. Antes de CVSS, los proveedores de seguridad competidores no tenían forma de acordar si un error era lo suficientemente grave como para justificar un parche de emergencia. El marco CJS resuelve el problema idéntico para los jailbreaks de IA.
Esto es significativo porque el cierre del 12 de junio de Claude Fable 5 ocurrió en ausencia de cualquier marco de severidad acordado. El experto en ciberseguridad de Stanford Alex Stamos revisó la investigación subyacente de Amazon y dijo que "no encontró ningún riesgo que no esté presente en otros modelos de IA disponibles públicamente, incluyendo los hechos en China". David Sacks, co-líder del consejo asesor de tecnología de Trump, argumentó lo contrario. Ambos tenían simultáneamente razón — que es precisamente el problema que una rúbrica de severidad está diseñada para resolver.
El agujero con forma de Meta en la sala
Cinco laboratorios están en el acuerdo. Meta no. Y esa brecha es estructural, no incidental.
La familia de modelos Llama de Meta es de peso abierto — los pesos se distribuyen públicamente y no pueden ser limitados por ningún control de acceso aplicado a nivel de laboratorio. Un marco que cubre los laboratorios de jardín vallado mientras los modelos de peso abierto más utilizados permanecen enteramente fuera de él tiene un agujero por el que podrías conducir un centro de datos.
Que Meta haya declinado participar o haya sido excluida es menos relevante que el resultado práctico. El laboratorio que envía los modelos de peso abierto más capaces — y las capacidades de uso informático agente más fuertes con Muse Spark 1.1 — opera fuera del proceso de revisión gubernamental que los otros tres laboratorios están aceptando. Eso crea una clara arbitraje de cumplimiento: si quieres capacidad fronteriza sin la espera de 30 días, los pesos abiertos son la válvula de escape.
Qué significa esto para cualquiera que construya sobre IA
Si diriges un negocio que depende de modelos de IA fronteriza — y hoy en día eso describe a la mayoría del sector tecnológico — las implicaciones golpean en tres niveles.
Incertidumbre de timing. Una ventana de revisión de 30 días que puede extenderse por criterios clasificados significa que no puedes planificar lanzamientos de productos de manera confiable alrededor de nuevos lanzamientos de modelos. La ventana es "hasta" 30 días, no "exactamente" 30 días, y ningún estándar publicado te dice qué desencadena una revisión más larga.
Fragmentación de acceso. Si el gobierno controla qué "socios de confianza" reciben acceso anticipado, el panorama de quién obtiene los mejores modelos primero cambia de dinámicas de mercado a dinámicas políticas. Los clientes empresariales que históricamente han estado primero en la fila para acceso a GPT o Claude pueden encontrarse esperando.
Aceleración de peso abierto. La válvula de escape ya se está llenando. Los Llama y Muse de Meta, Kimi K3 de Moonshot (pesos libres el 27 de julio) y todo el ecosistema de peso abierto se vuelven relativamente más atractivos cuando los laboratorios de jardín vallado enfrentan el control gubernamental. El marco puede inadvertidamente acelerar precisamente lo que no puede controlar.
La pregunta sin respuesta
Dean Ball, coautor del Plan de Acción de IA de la administración Trump que se une al equipo de Futures Estratégicos de OpenAI, lo expresó sin rodeos:
"Nadie sabe cuáles son los requisitos para obtener la licencia. Cuando digo 'nadie' lo digo literalmente: la propia administración parece no saberlo."
Los puntos de referencia son clasificados. Los criterios de aprobación son clasificados. Las condiciones de autorización pueden establecerse y revisarse en privado, como demostró la experiencia de Anthropic en junio, sin registro público de qué cambió o por qué.
Los investigadores de Wharton en el Laboratorio de IA Responsable describieron el acuerdo como "un régimen de licencias puerta trasera construido sobre la autoridad existente del Departamento de Comercio, con condiciones que cambian sin aviso público".
Esa es la pregunta que nadie en Washington está respondiendo: si un modelo pasa las pruebas clasificadas del gobierno y causa daños graves después del lanzamiento, quién es responsable, y contra qué estándar se le debería exigir cuentas?
El marco llega antes del 1 de agosto. Las preguntas llegarán con él. Y para cualquiera que construya sobre IA fronteriza, la única apuesta segura es que las reglas acaban de cambiar — incluso si nadie puede decirte todavía en qué consisten.