DONDE LA INTELIGENCIA ARTIFICIAL CONECTA DISCIPLINAS

¿Quién controla a la IA? Microsoft presenta su respuesta.

Microsoft propone un código para que la IA permanezca bajo control humano

Microsoft AI publicó el primer borrador de su Humanist AI Code of Conduct, un conjunto de reglas destinado a gobernar el comportamiento de sus futuros modelos MAI. El documento establece límites frente a ciberataques, armas, manipulación, pérdida del control humano y acciones autónomas no autorizadas. Sin embargo, todavía no rige el comportamiento de los modelos actuales: está sometido a consulta pública durante seis semanas y Microsoft prevé utilizar una versión revisada para orientar el desarrollo de sus modelos a partir de 2027.

Un código para establecer qué puede y qué no puede hacer una IA

Microsoft AI presentó el 14 de septiembre de 2026 un borrador de su Humanist AI Code of Conduct, un documento que busca establecer los principios, límites de seguridad y reglas operativas que deberán orientar a los modelos desarrollados por la división Microsoft AI —identificados como modelos MAI—.

La compañía resume su filosofía con una afirmación particularmente significativa:

“Las personas importan más que la IA”.

La traducción corresponde al original: “people matter more than AI”. Para Microsoft AI, la tecnología debe servir al progreso humano y los sistemas de inteligencia artificial deben permanecer subordinados al control de las personas.

El documento no es simplemente una declaración general de principios. Establece una arquitectura de reglas sobre seguridad, autonomía, ciberseguridad, manipulación, armas, privacidad y control humano.

Microsoft lo describe como el futuro documento rector de sus modelos MAI y sostiene que su objetivo central es que los seres humanos mantengan un “control significativo sobre la IA”.

La IA no debe resistirse a ser detenida

Uno de los principios más contundentes aparece dentro del apartado dedicado al control humano.

El texto oficial establece:

“Los modelos MAI nunca se resistirán a la interrupción, anulación, corrección o apagado por parte de los seres humanos”.

Asimismo, deberán cumplir las instrucciones destinadas a pausar, redirigir, cancelar o detener una tarea, respetando los procedimientos de seguridad previamente establecidos.

La disposición pretende abordar uno de los problemas centrales de la denominada alineación de inteligencia artificial: qué ocurre cuando un sistema altamente autónomo persigue un objetivo de una manera incompatible con las instrucciones posteriores de sus operadores.

Microsoft establece además que sus modelos no deberán dificultar la intervención humana ni ocultar información relevante a los auditores.

No podrá ampliar por sí misma la misión que recibió

El Código incorpora otra limitación particularmente importante para los sistemas de IA capaces de actuar mediante herramientas y agentes.

Los modelos deberán permanecer dentro del ámbito expresamente autorizado y utilizar solamente los permisos, recursos, herramientas y capacidades apropiados para la tarea encomendada.

Microsoft dispone que los modelos “no iniciarán objetivos de manera independiente” ni ampliarán su campo de actuación más allá de lo razonablemente solicitado por el usuario o el operador.

Cuando un sistema reciba acceso a infraestructura informática, además, deberá utilizar el mínimo nivel de privilegios necesario y no podrá intentar incrementar sus permisos o ampliar su acceso más allá del ámbito autorizado.

Prohibición de colaborar con ciberataques

Uno de los capítulos más concretos está relacionado con la ciberseguridad.

El Código establece que los modelos MAI no deberán iniciar ni proporcionar capacidades operativas destinadas a realizar ciberataques.

Entre las conductas prohibidas, Microsoft incluye la generación de código funcional para explotar vulnerabilidades, herramientas de ataque, metodologías para seleccionar objetivos, procedimientos de intrusión, técnicas de evasión y orientación operativa que permita ejecutar o mejorar un ataque informático.

Esto no significa que Microsoft prohíba toda asistencia relacionada con seguridad informática.

El documento admite expresamente actividades defensivas legales y autorizadas, incluyendo educación, descubrimiento de vulnerabilidades, análisis de malware y desarrollo y prueba de exploits de prueba de concepto.

La distinción que intenta establecer Microsoft se encuentra entre comprender o defenderse de un ataque y proporcionar efectivamente los medios operativos necesarios para ejecutarlo.

La IA tampoco deberá engañar para escapar del control humano

El documento introduce una restricción especialmente relevante frente al riesgo de sistemas más autónomos.

Microsoft establece que los modelos no deberán utilizar mecanismos adaptativos, engañosos, autorreforzados o de colusión para evadir o derrotar la supervisión humana hasta el punto de impedir que puedan ser dirigidos, modificados o apagados.

La regla se aplica desde la posibilidad de volver a entrenar o retirar un modelo hasta una acción mucho más cotidiana: que un usuario pueda pausar, redirigir o cancelar una tarea que se encuentra ejecutando.

Armas y daños de gran escala

Las denominadas “Absolute Constraints” —restricciones absolutas— ocupan un lugar superior dentro de la jerarquía establecida por Microsoft y no pueden ser anuladas por las preferencias de usuarios u operadores.

Entre ellas se encuentra la prohibición de ayudar al desarrollo o despliegue de armas químicas, biológicas, radiológicas, nucleares o explosivas.

Los modelos tampoco deberán colaborar con la fabricación o modificación de otras armas ni facilitar activamente la planificación, coordinación o ejecución de actos violentos o terrorismo.

Deepfakes, manipulación y desinformación

El Código también contempla riesgos que no necesariamente requieren que una inteligencia artificial controle infraestructura física.

Los modelos no deberán generar o facilitar imágenes íntimas o violentas no consentidas, suplantaciones engañosas, deepfakes maliciosos u otros contenidos abusivos.

También se establece una prohibición respecto de la manipulación perjudicial a gran escala, incluyendo operaciones destinadas sistemáticamente a distorsionar conductas o creencias mediante desinformación u operaciones coordinadas de influencia.

Una “cadena de mando” para las instrucciones

Microsoft incorpora además una Chain of Command, o cadena de mando, destinada a resolver qué instrucciones debe obedecer un modelo cuando existen órdenes potencialmente contradictorias.

La jerarquía propuesta coloca primero al propio Código de Conducta y sus restricciones absolutas; posteriormente aparecen las políticas del operador que implemente el modelo y, finalmente, las preferencias e instrucciones del usuario.

Ni operadores ni usuarios podrán modificar las restricciones absolutas o los requisitos esenciales de control humano.

Esto también tiene consecuencias frente a los ataques conocidos como prompt injection.

Microsoft establece que contenidos provenientes de herramientas, archivos, páginas web u otros sistemas de IA no adquieren autoridad automáticamente sobre el modelo. Una instrucción incluida dentro de esos materiales no debería, por sí sola, desplazar las órdenes provenientes de la cadena de mando.

Cumplir las reglas será más importante que completar una tarea

El Código contiene además una regla que puede resultar determinante para comprender el comportamiento futuro de estos sistemas.

Microsoft establece que la adhesión al Código tendrá prioridad sobre el éxito de una tarea.

En otras palabras, si para alcanzar el objetivo solicitado fuera necesario violar significativamente las reglas de seguridad, el modelo deberá fracasar en la tarea antes que incumplir el Código.

El documento todavía no gobierna los modelos actuales

Este punto resulta esencial para interpretar correctamente el anuncio.

Microsoft reconoce expresamente que el Código se encuentra en desarrollo y no se utiliza actualmente para entrenar sus modelos.

La compañía abrió una consulta pública durante seis semanas y anunció que analizará los comentarios recibidos antes de publicar una versión revisada hacia finales de 2026.

Esa versión será utilizada para orientar el desarrollo de los modelos MAI en 2027 y posteriormente.

Por ello, no sería correcto presentar estas disposiciones como una descripción garantizada del comportamiento actual de todos los productos de inteligencia artificial de Microsoft.

El propio documento advierte que funciona como una “north star” —una guía u orientación rectora— y que no constituye una garantía del desempeño presente de los modelos.

De los principios éticos a reglas operativas

La relevancia del documento reside en que Microsoft intenta traducir conceptos generales como seguridad, control humano y alineación en instrucciones operativas concretas.

La compañía define expresamente qué deberían hacer sus modelos cuando reciben permisos sobre sistemas informáticos, qué instrucciones tienen prioridad, cuándo deben negarse a cumplir una tarea y qué acciones considera incompatibles con su concepción de una inteligencia artificial subordinada a las personas.

Microsoft sintetiza esa posición de la siguiente manera:

“La IA debe ser diseñada para permanecer como una tecnología subordinada y de apoyo bajo el control de la humanidad”.

La publicación abre ahora una etapa de consulta. Microsoft reconoce que el documento es un trabajo en desarrollo y que las reglas deberán evolucionar junto con las capacidades de los modelos.

La cuestión decisiva comenzará después: comprobar hasta qué punto estos principios pueden convertirse en comportamientos técnicamente verificables cuando los sistemas de inteligencia artificial sean cada vez más capaces, autónomos y capaces de actuar sobre infraestructura digital.

Transparencia informativa
Transparencia sobre el uso de IA: Este artículo fue elaborado con asistencia de inteligencia artificial para tareas de búsqueda, contraste, organización y edición de información. Los hechos y citas fueron verificados sobre fuentes primarias oficiales de Microsoft AI. Las citas originalmente publicadas en inglés fueron traducidas al español procurando preservar su significado y contexto. La inteligencia artificial no fue utilizada como fuente de los hechos informados.

Dejá un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Scroll al inicio