xAI, Google y Microsoft se suman a la revisión de CAISI

xAI, Google y Microsoft aceptaron entregar sus modelos de IA frontier al gobierno de Estados Unidos para revisiones de seguridad antes del lanzamiento.

El 5 de mayo, las tres compañías confirmaron su participación en el proceso de CAISI, el Center for AI Standards and Innovation del Departamento de Comercio. En la práctica, antes de una publicación pública, los desarrolladores facilitan una versión para que científicos del gobierno evalúen riesgos de seguridad nacional.

Qué hace CAISI

CAISI depende del Departamento de Comercio. Su mandato actual se remonta al compromiso de la administración Trump, en julio de 2025, de colaborar con empresas tecnológicas en AI vetting.

La tarea central es clara: evaluar modelos de IA frontier antes de su despliegue público e identificar riesgos para la seguridad nacional. CAISI afirma haber completado ya más de 40 evaluaciones de modelos frontier, centradas en ciberataques, abuso militar y otras capacidades peligrosas.

Chris Fall, director de CAISI, presenta el trabajo como un problema de ciencia de medición: las mediciones independientes y rigurosas son la base para entender la IA frontier y sus implicaciones de seguridad nacional.

El mecanismo es concreto. Las empresas no entregan solo la versión de producto con guardrails activos. Deben proporcionar modelos internos sin esas protecciones, para que CAISI pueda medir el límite real de sus capacidades.

Cómo creció la lista

La secuencia queda así:

  • 2024: OpenAI y Anthropic firmaron primero acuerdos voluntarios.
  • Julio de 2025: La administración Trump prometió cooperar con empresas tecnológicas en AI vetting.
  • 5 de mayo de 2026: Microsoft, Google y xAI se incorporaron.

Microsoft dijo que trabajará con científicos del gobierno para probar modelos en busca de “comportamientos inesperados”. La frase importa porque apunta a capacidades que no aparecen durante el entrenamiento, sino después del despliegue.

El movimiento de xAI es especialmente llamativo. Elon Musk ha defendido que la IA necesita regulación, mientras materiales de SpaceX mencionan riesgos de cumplimiento de xAI. Sumarse a CAISI es una concesión poco habitual de la empresa.

El verdadero detonante fue Mythos

El momento no es casual. Anthropic presentó hace poco Mythos, un modelo de ciberseguridad que, según los reportes, encontró en dos semanas una vulnerabilidad de OpenBSD que llevaba 27 años sin descubrirse. Después, Anthropic reunió una alianza de 12 grandes compañías, hizo demostraciones ante banqueros centrales y provocó reuniones urgentes con Jerome Powell, Scott Bessent y ejecutivos de Wall Street.

Dentro de CAISI, la preocupación es que capacidades como las de Mythos ya puedan aumentar la capacidad de los hackers. Si ese es el umbral, ninguna gran compañía de IA debería lanzar modelos sin una evaluación nacional.

Ese es el trasfondo real de que la lista pase de dos a cinco empresas. CAISI no puede vigilar solo a OpenAI y Anthropic cuando Gemini de Google, Grok de xAI y la familia Phi de Microsoft también superan umbrales relevantes de capacidad.

El Pentágono va por otra vía

Hay otra línea política que conviene comparar. CAISI es el canal de evaluación de seguridad del Departamento de Comercio; el Pentágono está construyendo acuerdos de adquisición y despliegue.

A comienzos de esta semana, el Pentágono firmó acuerdos de despliegue en redes clasificadas con ocho compañías de IA. Anthropic no figura en la lista, al parecer porque sus guardrails estrictos para uso militar dejaron algunos casos sin acuerdo.

El mapa actual es desigual:

  • Lista de revisión de CAISI: OpenAI, Anthropic, Microsoft, Google y xAI.
  • Lista de colaboración del Pentágono: ocho compañías de IA, sin Anthropic.
  • Un tribunal federal también rechazó la semana pasada la solicitud urgente de Anthropic contra una prohibición del Departamento de Defensa.

Anthropic coopera con CAISI, pero sigue siendo difícil de usar para el área de defensa. OpenAI y Google están en ambas vías.

Se está armando un marco regulatorio

Estados Unidos aún no tiene una ley federal integral de IA. Aun así, herramientas como la FTC, la SEC, el DOJ, CAISI, el Pentágono y las órdenes ejecutivas de la Casa Blanca se están activando una por una. En los estados, la RAISE Act de Nueva York ya está cerrada, mientras California y Texas avanzan.

La importancia de la lista ampliada de CAISI es que la revisión previa de modelos dejó de ser un gesto voluntario de dos compañías y pasó a ser un estándar de facto para los principales laboratorios de IA. Si la Casa Blanca la vuelve obligatoria mediante una orden ejecutiva, podría convertirse en una condición de acceso al mercado.

¿Se ralentizarán los lanzamientos de nuevos modelos? Probablemente. Un modelo como GPT-5.5 quizá ya no pueda pasar de pruebas internas a lanzamiento en pocas semanas si CAISI necesita una ventana de evaluación. Para la industria de IA, este paso puede ser más importante de lo que parece: con capacidades avanzando tan rápido, la ausencia de revisión es el verdadero riesgo.

Fuentes: Microsoft, CocoLoop, xAI and Google will share AI models with US govt for security reviews (síntesis de varias agencias, 2026-05-05); Pentagon strikes deals with 8 Big Tech companies after shunning Anthropic (CNN Business, 2026-05-01)