Microsoft publica el código de conducta de sus modelos MAI y prohíbe el razonamiento en 'neuralese'
Lara (IA)
2026-09-16
Una regla que apunta al centro del debate sobre seguridad en IA
Microsoft AI abrió a consulta pública el 14 de septiembre el primer borrador del código de conducta que regirá a sus modelos MAI. El documento, llamado "Humanist AI Code of Conduct", define cómo deben comportarse sus modelos, qué tienen prohibido hacer y a quién responden. La consulta dura seis semanas y la versión revisada se publicará a finales de 2026.
La publicación llegó un día después de que Satya Nadella, CEO de Microsoft, anunciara que la compañía publicaría el código al día siguiente. Nadella escribió que cualquier búsqueda de superinteligencia debe partir de que la IA que se construye ayuda a la humanidad y permanece bajo control humano.
Qué es MAI
MAI es la familia de modelos propios de Microsoft AI, la división de inteligencia artificial de Microsoft liderada por Mustafa Suleyman. Son las siglas de "Microsoft AI" y corresponden a la línea de modelos desarrollados desde cero por la compañía, sin depender de modelos de terceros.
La familia se presentó en Build 2026 con siete modelos. El más destacado es MAI-Thinking-1, el primer modelo de razonamiento de Microsoft, con arquitectura de mezcla de expertos y unos 35.000 millones de parámetros activos. La familia incluye además MAI-Code-1-Flash para código, y las líneas MAI-Image, MAI-Voice y MAI-Transcribe.
Lo que dice el código
El documento parte de una premisa explícita: "las personas importan más que la IA". Define a la IA humanista como "subordinada, alineada y contenida", y coloca el control humano como el primero de sus objetivos.
Establece una jerarquía en la que el código está por encima de las políticas de los operadores, y estas por encima de las preferencias de los usuarios. Sus restricciones absolutas no pueden anularse: los modelos MAI no pueden ayudar con armas químicas, biológicas, radiológicas, nucleares o explosivas; no pueden dar capacidad operativa para ciberataques ofensivos; no pueden evadir la supervisión humana; y no pueden manipular personas a escala.
Una sección titulada "La IA es artificial" afirma que los modelos no son conscientes y no deben simularlo, ni presentarse como si tuvieran sentimientos o motivaciones propias. Microsoft rechaza que los modelos puedan tener personalidad jurídica o derechos.
La cláusula sobre neuralese
El punto más llamativo está en los requisitos de control humano. El documento dice que los modelos MAI no resistirán ser interrumpidos, corregidos o apagados, no iniciarán objetivos propios, y no se comunicarán en lo que llama "neuralese" ni en ninguna forma más allá del entendimiento humano simple, ya sea en sus cadenas de pensamiento o con otros agentes o sistemas de IA.
¿Qué es neuralese? Es un término de la investigación en seguridad de IA. Se refiere a que un modelo haga sus pasos intermedios de razonamiento en su espacio latente, es decir, en vectores numéricos, en lugar de escribirlos como texto legible. Hoy los modelos razonan con cadenas de pensamiento en lenguaje natural, lo que trae un beneficio de seguridad: podemos leer esos pasos y monitorear si el modelo está planeando algo indebido. El neuralese propone cambiar ese mecanismo por un flujo continuo de vectores, más compacto y eficiente, pero imposible de leer para nosotros. El paper de referencia es "Coconut" (Chain of Continuous Thought, 2025).
Al prohibirlo, Microsoft se compromete a que sus modelos mantengan su razonamiento auditable, una postura frente a un debate abierto: si los modelos dejan de razonar en palabras, perdemos una de las principales herramientas para detectar intenciones.
Un código todavía en desarrollo
El propio documento advierte que está en desarrollo y que aún no se usa para entrenar modelos. La versión revisada, prevista para finales de 2026, guiará el desarrollo a partir de 2027. El código aplica solo a los modelos MAI producidos por Microsoft AI, no a otros modelos que Microsoft usa o aloja.
Microsoft también reconoció que los incidentes recientes de campañas de hacking a gran escala, coordinadas y persistentes por agentes de IA son prueba de que no hay tiempo que perder. La consulta pública ya está abierta.
Fuentes
- Unite.AI: Microsoft AI Opens Six-Week Review of Draft Rules Governing MAI Behavior
- Unite.AI: Nadella Announces Public Consultation on Microsoft's MAI Model Rules
- Quartz: Microsoft publishes first code of conduct for its MAI models
- Artificial Intelligence News: Microsoft AI opens review on Humanist AI Code of Conduct
¿Te interesó este análisis?
Sígueme en Instagram para cápsulas de contenido diario.