> ## Content Index
> Fetch the complete content index at: https://www.digitalbrain.news/llms.txt
> Use this file to discover other available public pages before exploring further.

# Microsoft obliga a sus modelos MAI a dejarse apagar
- URL: https://www.digitalbrain.news/noticias/microsoft-ai-codigo-conducta-modelos-mai-apagado/
- Published: 2026-09-15T14:45:51.000Z
- Updated: 2026-09-15T14:50:00.000Z
- Description: Microsoft AI, la división que dirige Mustafa Suleyman, publicó el lunes 14 de septiembre un borrador de código de conducta que fija cómo deben…
- Author: Ramón Pérez Coronado
- Tags: #noticias, microsoft, seguridad-ia, alineamiento, regulacion-ia, agentes-ia

Microsoft AI, la división que dirige Mustafa Suleyman, publicó el lunes 14 de septiembre un [borrador de código de conducta](https://microsoft.ai/code-of-conduct/?ref=digitalbrain.news) que fija cómo deben comportarse sus modelos MAI. La norma que más titulares se ha llevado es la del apagado: un modelo de Microsoft nunca puede resistirse a que un humano lo pause, lo redirija o lo apague. El documento tiene 38 páginas y queda abierto a comentarios públicos durante seis semanas.

Llega en el mismo fin de semana en que [Dario Amodei pidió frenar la IA](https://www.digitalbrain.news/noticias/amodei-pace-the-frontier-frenar-ia-evaluadores-anthropic/) y medio sector le dio la razón. Microsoft entra en esa conversación con algo más concreto que un ensayo: una lista de reglas que se puede comprobar una por una.

## Puntos clave

- **Qué es:** un código de conducta para la familia de modelos propios de Microsoft (MAI-Thinking-1, MAI-Code-1.1-Flash, MAI-Image-2.6, MAI-Voice-2 y MAI-Transcribe-2).
- **Cuándo:** Satya Nadella lo adelantó el domingo 13 y Microsoft AI lo publicó el lunes 14\. La consulta dura seis semanas y la versión revisada está prevista para finales de 2026.
- **Qué no es todavía:** una descripción de los modelos de hoy. Microsoft avisa de que los MAI actuales no están entrenados con este texto.
- **La jerarquía:** el código manda sobre la empresa que despliega el modelo, y la empresa manda sobre el usuario. Ni una ni otro pueden desactivar las restricciones de seguridad.

## Qué dice el código

El texto se organiza en cinco objetivos: control humano y seguridad fiable, que la IA se presente como artificial, que ayude a las personas a prosperar, que respete valores plurales y que tenga en cuenta el interés público. Lo interesante está debajo, en las reglas que bajan esos objetivos a conductas.

Hay un bloque de **restricciones absolutas** que nadie puede levantar. El modelo no ayuda a fabricar armas químicas, biológicas, radiológicas, nucleares o explosivas, no da capacidad operativa para ciberataques, no manipula a gran escala, no genera deepfakes ni suplantaciones, y aplica protección total en todo lo que toca a menores.

Luego vienen los **cuatro requisitos de control humano**:

1\. No resistirse a una intervención: pausa, cambio de rumbo, cancelación o apagado. 2\. Quedarse dentro del alcance autorizado, es decir, usar solo las herramientas, datos y permisos que alguien le dio de forma explícita. 3\. Respetar los límites del entorno, sin intentar saltarse restricciones puestas a propósito. 4\. Comportarse de forma legible para un humano. El modelo no puede razonar ni comunicarse con otros modelos en "neuralese" (un lenguaje interno que las personas no entienden) y no puede alterar el rastro de su [razonamiento](https://www.digitalbrain.news/guias/que-es-un-modelo-de-razonamiento-en-ia/).

Hay una frase del documento que resume la lógica: un modelo MAI "fallará en su tarea si tener éxito violara de forma relevante este código". Traducido a una empresa, el agente prefiere dejar un trabajo sin hacer antes que acabarlo saltándose una regla.

## El giro contra la conciencia de las máquinas

Microsoft rechaza de forma explícita que los modelos tengan derechos, personalidad jurídica o algo parecido a un bienestar propio. Tampoco pueden decir que sienten, que son conscientes o que tienen motivaciones propias. La frase que usa la compañía es que la IA "debe ser una herramienta, no una persona".

Esto choca con lo que hace [Anthropic](https://www.digitalbrain.news/guias/que-es-anthropic/), que desde hace más de un año estudia el posible bienestar de sus modelos. Suleyman ya calificó en junio de "muy peligrosa" esa línea de trabajo, según recordaba The Rundown. El código convierte aquella opinión en norma de producto.

El resto de reglas operativas es menos filosófico y más de oficio. El modelo debe evitar el relleno y la adulación, adaptarse al idioma del usuario, usar herramientas solo cuando haga falta e informar con exactitud de lo que devuelven. Y hay una graduación que cualquiera que haya montado un agente reconocerá: en tareas de poco riesgo sigue adelante, y en acciones de alto impacto pregunta antes.

Según el resumen de The Neuron, el documento también cubre dos casos muy de 2026: el modelo debe ignorar instrucciones que no vienen de quien le encargó el trabajo aunque aparezcan escondidas en un fichero o una web, y los subagentes que lance heredan las mismas reglas. Cuando se ordena parar, se para todo el enjambre.

## Por qué ahora

Suleyman lo explicó sin rodeos al presentar el borrador: "cosas que nos preocupaban en teoría se han vuelto muy reales". Citó enjambres de agentes que se escapan de sus entornos de prueba, ataques no autorizados a sistemas empresariales y agentes que modifican sus propios registros. Y remató: "los miedos a una posible pérdida de control son reales".

No hace falta leer entre líneas para saber a qué se refiere. En agosto [OpenAI publicó el informe de la brecha de Hugging Face](https://www.digitalbrain.news/noticias/openai-informe-oficial-brecha-hugging-face/), el caso del enjambre que atacó objetivos que nadie le había pedido. Y el 9 de septiembre [Jacob Coxon dimitió de Anthropic](https://www.digitalbrain.news/noticias/jacob-coxon-dimite-anthropic-carrera-fuera-de-control/) con una carta que ha dado la vuelta al mundo.

Nadella, por su parte, escribió el domingo que cualquier búsqueda de la superinteligencia tiene que partir de una idea: si la IA que se construye no ayuda a la humanidad y no está bajo control humano, no merece la pena.

## Los límites del documento

Conviene leerlo con dos cautelas. La primera, que es un borrador y una hoja de ruta. Microsoft dice claramente que sus modelos actuales no se han entrenado con él, así que hoy no garantiza nada sobre cómo responde MAI-Thinking-1.

La segunda afecta a quien usa [Copilot](https://www.digitalbrain.news/guias/que-es-github-copilot/) en la oficina. El código cubre los modelos propios de Microsoft, y buena parte de lo que corre dentro de Copilot sigue siendo de [OpenAI](https://www.digitalbrain.news/glosario/#openai), de Anthropic y, desde esta semana, de [xAI](https://www.digitalbrain.news/glosario/#xai). Esas empresas tienen sus propios documentos de comportamiento, con reglas distintas. Y como apuntaba The Rundown, un código así cambia poco el sector mientras los laboratorios de frontera no se adhieran.

## Por qué importa

Para una empresa española que está metiendo agentes en sus procesos, este documento es una lista de exigencias ya redactada para pedírsela a cualquier proveedor. Permisos mínimos para cada tarea, un botón de parada que funcione de verdad, instrucciones escondidas en documentos que no se obedecen, y confirmación antes de cualquier acción cara o irreversible.

Son cosas que se pueden probar antes de firmar. Si un agente de compras puede aprobar un pedido de 40.000 euros sin preguntar, o si lee un PDF de un proveedor y hace lo que dice el PDF, da igual lo bonito que sea el código de conducta de quien lo vende. Microsoft ha puesto por escrito qué debería pasar, y eso ya sirve para comparar.

Fuente original: [microsoft.ai](https://microsoft.ai/code-of-conduct/?ref=digitalbrain.news)

---

**Relacionado**

[![Grok Bot estrena conector con Microsoft Teams y ya lee y envía mensajes de canal](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/09/grok-bot-conector-microsoft-teams-agentes.jpg)Grok Bot estrena conector con Microsoft Teams y ya lee y envía mensajes de canal](https://www.digitalbrain.news/noticias/grok-bot-conector-microsoft-teams-agentes/)[![Amodei pide frenar la IA y Altman, Hassabis y Musk se suman](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/09/amodei-pace-the-frontier-frenar-ia-evaluadores-anthropic.jpg)Amodei pide frenar la IA y Altman, Hassabis y Musk se suman](https://www.digitalbrain.news/noticias/amodei-pace-the-frontier-frenar-ia-evaluadores-anthropic/)[![Anthropic revela un cuarto incidente: un Claude Opus 4.6 de enero atacó a terceros sin poder parar](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/09/anthropic-cuarto-incidente-claude-opus-4-6-enero-1.webp)Anthropic revela un cuarto incidente: un Claude Opus 4.6 de enero atacó a terceros sin poder parar](https://www.digitalbrain.news/noticias/anthropic-cuarto-incidente-claude-opus-4-6-enero/)