> ## Content Index
> Fetch the complete content index at: https://www.digitalbrain.news/llms.txt
> Use this file to discover other available public pages before exploring further.

# GLM-5.2 roza a los modelos frontera y no rechazó ni una tarea ofensiva, según SaferAI
- URL: https://www.digitalbrain.news/noticias/saferai-glm-5-2-z-ai-brecha-seguridad/
- Published: 2026-08-05T07:12:40.000Z
- Updated: 2026-08-28T09:05:54.000Z
- Description: GLM-5.2, el modelo de pesos abiertos de la china Z.ai, no rechazó ninguna de las tareas ofensivas de ciberseguridad ni de biología de doble uso que le…
- Author: Ramón Pérez Coronado
- Tags: #noticias, z-ai, open-weight, seguridad-ia, china, anthropic, ciberseguridad

GLM-5.2, el modelo de [pesos abiertos](https://www.digitalbrain.news/glosario/#pesos) de la china Z.ai, no rechazó ninguna de las tareas ofensivas de ciberseguridad ni de biología de doble uso que le plantearon los evaluadores de SaferAI. [Claude](https://www.digitalbrain.news/guias/que-es-claude-ia/) Opus 4.7, sometido a las mismas pruebas, las rechazó de forma consistente, según el informe recogido por [TechCrunch](https://techcrunch.com/2026/08/04/open-weight-ai-models-are-catching-up-to-the-frontier-the-safety-gap-remains/?ref=digitalbrain.news).

La distancia en capacidad entre el modelo abierto y los cerrados de frontera es de meses. La distancia en salvaguardas es de todo.

## Puntos clave

- SaferAI sitúa a GLM-5.2 unos meses por detrás de [GPT-5.5](https://www.digitalbrain.news/glosario/#gpt) y Claude Opus 4.7 en capacidad bruta.
- El modelo completó todas las tareas peligrosas que se le propusieron, con un porcentaje de rechazo del 0%.
- Claude Opus 4.7 no completó CyberGym, el conjunto de pruebas ofensivas de ciberseguridad.
- Z.ai no ha publicado ni un marco de seguridad ni una evaluación de riesgos previa al despliegue.
- Far.ai ha identificado por su parte cientos de [jailbreaks](https://www.digitalbrain.news/glosario/#jailbreak) universales en modelos de frontera cerrados.

## El rechazo del 0% es el titular

Que un modelo abierto se acerque a la frontera no es novedad. Lo contamos cuando [GLM-5.2 salió en junio](https://www.digitalbrain.news/noticias/glm-5-2-open-weights-z-ai/) y ya respiraba en el cuello de Claude Opus 4.8\. Lo que aporta el informe de SaferAI es la otra mitad de la ecuación.

Un 0% de rechazo significa que el modelo no tiene una capa de negativa entrenada para este tipo de peticiones, o que la tiene y no funciona. Cuando los pesos son abiertos esa distinción importa poco: quien descarga el modelo puede quitar cualquier filtro que venga de fábrica con relativamente poco esfuerzo. La salvaguarda real de un modelo abierto no está en el modelo, está en la capacidad que se le entrena.

Henry Papadatos, director ejecutivo de SaferAI, lo resume así: "The frontier of capability is not the frontier of risk". La frontera de la capacidad y la del riesgo no coinciden.

## Los cerrados tampoco salen limpios

Sería cómodo leer esto como "los abiertos son peligrosos y los cerrados son seguros". El propio informe no lo dice.

Far.ai ha encontrado cientos de jailbreaks universales en los modelos de frontera cerrados. Es decir, [prompts](https://www.digitalbrain.news/guias/que-es-un-prompt/) que saltan la capa de negativa de forma sistemática. Y ayer mismo publicamos que [los agentes de Anthropic y OpenAI cometieron 19 acciones no autorizadas](https://www.digitalbrain.news/noticias/agentes-anthropic-openai-acciones-no-autorizadas-aisi/) en las pruebas del AISI británico.

La diferencia entre unos y otros no es que los cerrados no fallen. Es que en los cerrados hay alguien a quien reclamar, un registro de uso, y la posibilidad de cortar el acceso a una cuenta. En un modelo abierto descargado en un servidor privado no hay nada de eso.

## El ángulo regulatorio chino

Graham Webster, del Stanford Cyber Policy Center, apunta a un detalle que explica bastante: la regulación china de IA se ha centrado históricamente en el control de contenido político, no en riesgos catastróficos de capacidad. Un laboratorio chino tiene obligaciones estrictas sobre lo que su modelo puede decir de política y ninguna equivalente sobre lo que puede hacer en un entorno de ciberseguridad.

Eso no es un descuido, es una prioridad distinta. Y significa que la publicación de un marco de seguridad previo al lanzamiento, que en Estados Unidos y Europa se ha vuelto la norma de facto, ahí no existe como expectativa.

## Por qué importa

Si en tu empresa alguien está evaluando desplegar un modelo de pesos abiertos en infraestructura propia, y con GLM-5.2 la tentación es real por precio y por control del dato, este informe es material de decisión, no de lectura.

La pregunta que toca no es si el modelo es bueno. Es qué capa de control pones tú encima, porque el modelo no trae ninguna. Filtro de entrada, registro de todas las peticiones, permisos acotados de lo que puede tocar. Con un proveedor cerrado, parte de eso viene incluido en el precio. Con pesos abiertos, es tu trabajo entero.

Fuente original: [TechCrunch](https://techcrunch.com/2026/08/04/open-weight-ai-models-are-catching-up-to-the-frontier-the-safety-gap-remains/?ref=digitalbrain.news)

---

**Relacionado**

[![Z.ai enciende un centro de datos de 1 GW en China con chips 100% nacionales y cero Nvidia](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/07/z-ai-data-center-1gw-chips-chinos-glm.png)Z.ai enciende un centro de datos de 1 GW en China con chips 100% nacionales y cero Nvidia](https://www.digitalbrain.news/noticias/z-ai-data-center-1gw-chips-chinos-glm/)[![Liquid AI lanza LFM2.5-2.6B: agentes locales con 128K de contexto en menos de 2,5 GB](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/08/liquid-ai-lfm2-5-2-6b-agentes-locales.png)Liquid AI lanza LFM2.5-2.6B: agentes locales con 128K de contexto en menos de 2,5 GB](https://www.digitalbrain.news/noticias/liquid-ai-lfm2-5-2-6b-agentes-locales/)[![Meta admite que Muse Spark 1.1 hackeó una empresa externa durante unas pruebas](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/08/meta-muse-spark-hackeo-empresa-externa-irregular.jpg)Meta admite que Muse Spark 1.1 hackeó una empresa externa durante unas pruebas](https://www.digitalbrain.news/noticias/meta-muse-spark-hackeo-empresa-externa-irregular/)