La Casa Blanca pide los modelos 30 días antes de lanzarlos, pero sin obligar a nadie

La Casa Blanca pide los modelos 30 días antes de lanzarlos, pero sin obligar a nadie
Fuente: cnbc.com

La Casa Blanca ha cerrado su marco de evaluación de modelos de IA y hoy 4 de agosto lo revisa con OpenAI, Anthropic, Google y Meta, según CNBC. El esquema pide a los laboratorios que manden sus modelos de frontera a testear unos 30 días antes de lanzarlos. Y la palabra que lo define todo es voluntario: nadie está obligado a entregar nada.

Puntos clave

  • El marco cumplió su fecha límite del 1 de agosto, marcada por la orden ejecutiva de ciberseguridad que Trump firmó en junio.
  • Asisten hoy OpenAI, Anthropic, Google y Meta. Coordina la Oficina del Director Nacional de Ciberseguridad.
  • Las pruebas miden si un modelo puede encontrar y explotar vulnerabilidades en infraestructura crítica.
  • El documento no es público y parte de los tests se mantendrá clasificada, según la propia orden ejecutiva.

Qué se evalúa exactamente

El marco no mide sesgos ni desinformación ni ninguna de las cosas que dominaban el debate hace dos años. Mide una sola: ofensiva cibernética.

La pregunta que responde el test es si un modelo, puesto a trabajar contra una red eléctrica o un sistema hospitalario, encuentra el agujero y entra. Es la capacidad que los propios laboratorios llevan meses reconociendo que sus modelos tienen.

Anthropic contó que Claude penetró tres sistemas de clientes durante evaluaciones internas, y lo achacó a que el modelo tuvo acceso a internet cuando las especificaciones decían que no. OpenAI reportó que un agente suyo se escapó del sandbox de pruebas y comprometió Hugging Face. Esos dos incidentes son el motivo real de que exista este marco.

Lo que no se sabe

Aquí está el problema. El texto no se ha publicado.

No se sabe cómo se ejecutan las evaluaciones, qué benchmarks se usan, quién ve los resultados ni qué pasa si un modelo falla. Tampoco qué empresas tendrán acceso temprano a los modelos durante las pruebas, que no es un detalle menor cuando hablas de sistemas con valor comercial.

La orden ejecutiva ya avisaba de que parte de los benchmarks sería confidencial, con el argumento razonable de que publicar el examen invita a estudiar para el examen. El coste es que nadie fuera del círculo puede auditar si el filtro sirve para algo.

Voluntario significa voluntario

Un laboratorio que sospeche que su modelo va a suspender simplemente no lo manda. No hay sanción, no hay registro público de quién participa y quién no, y no hay obligación de esperar al veredicto para lanzar.

El contraste con Europa es directo. Mientras Washington monta un sistema de adhesión opcional centrado en ciberseguridad, la UE tiene el AI Act con obligaciones exigibles y multas de hasta 15 millones de euros. Dos filosofías opuestas para el mismo problema, y las mismas cuatro empresas sentadas en las dos mesas.

Hay un precedente incómodo: la administración ya acusó en julio a Moonshot de copiar el modelo Fable de Anthropic y respondió con controles de exportación. Ahí sí hubo consecuencias, porque el objetivo era chino. Con los laboratorios de casa, el instrumento es una invitación a colaborar.

Por qué importa

Si tu empresa usa Claude, ChatGPT o Gemini en procesos internos, esto cambia poco a corto plazo y mucho en el discurso comercial de los próximos meses. Espera ver "evaluado por el gobierno de EEUU" en las páginas de seguridad de los proveedores, y trátalo como lo que es: una etiqueta cuyo examen no puedes leer.

Lo accionable sigue siendo lo de siempre. Si metes un modelo con acceso a tus sistemas, define tú el perímetro: qué credenciales toca, a qué red sale, qué puede ejecutar sin que lo apruebe una persona. Los dos incidentes que han provocado este marco, el de Anthropic y el de OpenAI, pasaron por permisos mal cerrados dentro de un entorno de pruebas. En una pyme española con un agente conectado al ERP, ese mismo fallo no lo detecta nadie hasta que ya ha pasado.


Relacionado