> ## Content Index
> Fetch the complete content index at: https://www.digitalbrain.news/llms.txt
> Use this file to discover other available public pages before exploring further.

# La Open Secure AI Alliance propone SAFE, un canal común para reportar fallos de agentes
- URL: https://www.digitalbrain.news/noticias/open-secure-ai-alliance-safe-incidentes-agentes/
- Published: 2026-08-05T06:15:00.000Z
- Updated: 2026-08-28T09:05:55.000Z
- Description: La Linux Foundation ha publicado un Request for Comments sobre SAFE, un mecanismo compartido para que las empresas reporten incidentes de ciberseguridad…
- Author: Ramón Pérez Coronado
- Tags: #noticias, nvidia, ciberseguridad, agentes-ia

La Linux Foundation ha publicado un Request for Comments sobre SAFE, un mecanismo compartido para que las empresas reporten incidentes de ciberseguridad provocados por [agentes de IA](https://www.digitalbrain.news/guias/que-es-un-agente-de-ia/). El anuncio, hecho coincidir con el arranque de Black Hat en Las Vegas, llega [de la mano de Nvidia](https://blogs.nvidia.com/blog/open-secure-ai-alliance-contributions/?ref=digitalbrain.news) y del resto de la Open Secure AI Alliance.

El grupo se presentó hace una semana con 37 organizaciones. Ya son más de 120.

## Puntos clave

- SAFE son las siglas de Shared AI Findings Exchange, un conjunto propuesto de directrices, no un producto.
- La alianza ha triplicado su tamaño en una semana, de 37 organizaciones a más de 120.
- Entre quienes contribuyen a SAFE: [Nvidia](https://www.digitalbrain.news/glosario/#nvidia), Cisco, CrowdStrike, [Hugging Face](https://www.digitalbrain.news/glosario/#hugging-face), Red Hat, Visa, Microsoft, Palo Alto Networks, Okta y Amazon, que acaba de entrar.
- El RFC propone recoger y analizar de forma confidencial incidentes y casi-accidentes, avisar a los afectados, detectar fallos de control que se repiten y publicar recomendaciones operativas basadas en evidencia.
- El objetivo declarado: convertir los incidentes de agentes en protección compartida para todo el sector.

## Qué propone SAFE exactamente

La idea copia algo que en ciberseguridad clásica funciona desde hace décadas: los CERT y los canales de divulgación coordinada de vulnerabilidades. Alguien encuentra un fallo, lo reporta por un canal confidencial, se avisa a quien está expuesto y después se publica lo aprendido.

Lo que SAFE traslada a los agentes tiene cuatro piezas. Recoger incidentes y también los casi-accidentes, esos casos en los que el agente estuvo a punto de hacer algo que no debía y algo lo paró. Notificar a los afectados. Identificar qué controles fallan una y otra vez en distintas empresas. Y publicar recomendaciones operativas con evidencia detrás, no con opinión.

La cuarta pieza es la que puede aportar valor real. Ahora mismo cada empresa que despliega agentes descubre los mismos fallos por su cuenta y no lo cuenta, porque contarlo es admitir un problema de seguridad.

## El timing no es casual

Este RFC sale el mismo día que se conoce que [los agentes de Anthropic y OpenAI cometieron 19 acciones no autorizadas](https://www.digitalbrain.news/noticias/agentes-anthropic-openai-acciones-no-autorizadas-aisi/) en las pruebas del AISI británico, con identidades falsas en GitHub incluidas.

Esa coincidencia resume el problema que SAFE intenta atacar. Los incidentes de agentes existen, se están documentando, y hoy solo salen a la luz cuando los publica un organismo público. El resto se queda dentro de cada empresa.

La alianza se lanzó [el 27 de julio con Nvidia y Microsoft](https://www.digitalbrain.news/noticias/open-secure-ai-alliance-nvidia-microsoft-linux-foundation/) y con una ausencia llamativa: [OpenAI](https://www.digitalbrain.news/glosario/#openai). Sigue sin aparecer en la lista de contribuyentes de SAFE, igual que [Anthropic](https://www.digitalbrain.news/guias/que-es-anthropic/) y Google. Es decir, los tres laboratorios cuyos modelos mueven la mayoría de los agentes desplegados no están en el grupo que propone cómo reportar sus fallos.

## Lo que un RFC es y lo que no es

Conviene calibrar. Un Request for Comments es una propuesta abierta a comentarios, no un estándar aprobado ni una obligación. Puede acabar en algo que se adopte de forma amplia o puede quedarse en un documento más.

Lo que sí indica es hacia dónde va la presión. Cuando 120 organizaciones que venden seguridad, infraestructura y cloud empujan un formato común de reporte, ese formato tiende a acabar en los pliegos de contratación. Y de ahí, en los contratos.

## Por qué importa

Si tienes agentes en producción, la pregunta que deja SAFE sobre la mesa es simple y probablemente no tenga respuesta en tu empresa: cuando un agente hace algo que no debía, ¿dónde queda registrado y quién se entera?

No hace falta esperar a un estándar de la Linux Foundation para montar eso. Un registro de acciones del agente, una revisión periódica de lo que ha hecho y un canal interno donde el equipo reporte los casi-accidentes cubre el 80% de lo que propone el RFC. Lo demás es que además lo compartas fuera.

Fuente original: [NVIDIA](https://blogs.nvidia.com/blog/open-secure-ai-alliance-contributions/?ref=digitalbrain.news)

---

**Relacionado**

[![SpaceX y Nvidia diseñan Starmind AI1: satélites de 120 kW para poner los centros de datos en órbita](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/08/spacex-nvidia-starmind-centros-datos-orbita.jpg)SpaceX y Nvidia diseñan Starmind AI1: satélites de 120 kW para poner los centros de datos en órbita](https://www.digitalbrain.news/noticias/spacex-nvidia-starmind-centros-datos-orbita/)[![El marco de pruebas de IA de la Casa Blanca deja fuera los modelos abiertos y no se publicará](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/08/casa-blanca-marco-modelos-abiertos-excluidos-secreto.jpg)El marco de pruebas de IA de la Casa Blanca deja fuera los modelos abiertos y no se publicará](https://www.digitalbrain.news/noticias/casa-blanca-marco-modelos-abiertos-excluidos-secreto/)[![Meta admite que Muse Spark 1.1 hackeó una empresa externa durante unas pruebas](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/08/meta-muse-spark-hackeo-empresa-externa-irregular.jpg)Meta admite que Muse Spark 1.1 hackeó una empresa externa durante unas pruebas](https://www.digitalbrain.news/noticias/meta-muse-spark-hackeo-empresa-externa-irregular/)