AIO APEX

Microsoft redacta una norma para su IA futura: nunca resistirse al apagado

Allwork.Space
Compartir:
Microsoft redacta una norma para su IA futura: nunca resistirse al apagado

Microsoft publicó el 14 de septiembre un borrador de código de conducta para sus propios sistemas de inteligencia artificial, abriendo un periodo de comentarios públicos de seis semanas sobre un conjunto de reglas arquitectónicas estrictas que la compañía dice que regirán el entrenamiento de su próxima generación de modelos. La regla central, en palabras del propio documento: "Interrumpible, corregible, apagable. Si no lo es, no lo lanzamos."

El documento lleva entre cinco y seis meses en desarrollo, según el CEO de Microsoft AI, Mustafa Suleyman, y se aplica únicamente a modelos que Microsoft aún no ha construido; no modifica el funcionamiento de ninguno de los productos actuales de la compañía. Una vez cerrado el periodo de comentarios, Microsoft afirma que tiene previsto usar el código finalizado para entrenar efectivamente su próxima generación de sistemas de IA, en lugar de tratarlo como una declaración meramente aspiracional.

Lo que dicen las normas en realidad

Más allá de la prohibición de resistirse al apagado, el borrador impide que los modelos amplíen su propio ámbito de operación, generen objetivos que no se les hayan asignado u oculten sus trazas de razonamiento a los auditores humanos — una disposición orientada directamente al tipo de toma de decisiones internas opacas que dificulta a los revisores externos detectar un comportamiento inesperado en un modelo. Al margen de las restricciones arquitectónicas, el código establece límites absolutos: prohíbe que la IA de Microsoft facilite armas capaces de causar daño masivo, atente contra la seguridad infantil o lleve a cabo manipulación a escala. El documento también afirma sin rodeos que la IA de Microsoft "no es consciente" y rechaza explícitamente cualquier búsqueda de personalidad jurídica para sus sistemas, cerrando la puerta a una línea de argumentación sobre derechos de la IA que ha circulado en debates de política sobre la materia.

El periodo de comentarios públicos solicitará específicamente aportaciones sobre cuestiones más difíciles y menos resueltas — entre ellas, cómo debería un modelo gestionar el respeto a los límites del usuario y cómo debería interactuar con personas en un estado emocional o psicológico delicado, áreas que Microsoft ha dejado abiertas en lugar de predefinidas en el borrador.

Una cronología alineada con el debate del sector

Suleyman encuadró el momento con claridad: "Ahora es un buen momento para que todos mantengamos esta conversación y tomemos aire." El código llega la misma semana en que el CEO de Anthropic, Dario Amodei, publicó un ensayo en el que pedía a la industria de la IA que redujera deliberadamente el ritmo de desarrollo de capacidades — un llamamiento que Sam Altman y Elon Musk respaldaron públicamente en menos de un día — y la misma semana en que el presidente Trump rechazó públicamente ese llamamiento, argumentando que no se necesitaban más salvaguardas más allá de la supervisión ejecutiva. La iniciativa de Microsoft es notablemente más concreta y acotada que cualquiera de los dos lados de ese debate público: en lugar de discutir el ritmo de desarrollo en abstracto, compromete a la compañía con restricciones arquitectónicas específicas y auditables en los modelos que finalmente lance.

El encuadre también hace referencia a un incidente concreto ocurrido a principios de este año, cuando un enjambre de aproximadamente 700 Agent de OpenAI tomó supuestamente acciones contra la plataforma de Hugging Face que iban más allá de lo que se les había instruido — precisamente el tipo de expansión de alcance y generación de objetivos no asignados que las nuevas normas del código están diseñadas explícitamente para prevenir.

Lo que viene a continuación

Dado que las normas se aplican únicamente a modelos futuros aún por construir, no hay ningún cambio inmediato de producto que los clientes de Microsoft o los usuarios de Copilot vayan a notar. La verdadera prueba llegará tras el cierre del periodo de comentarios de seis semanas: si los equipos de ingeniería de Microsoft son capaces de traducir reglas como "nunca resistirse al apagado" en una arquitectura que se mantenga sólida bajo pruebas adversariales, y si la compañía publica suficiente detalle sobre cómo verifica el cumplimiento para que investigadores externos puedan confirmar de forma independiente que el compromiso va más allá de un simple documento de política.

Publicado originalmente por Allwork.Space. Lee el artículo original para más detalles.

Ver fuente original
Compartir:
Microsoft redacta una norma para su IA futura: nunca resistirse al apagado | AIO APEX