La desalineación de la IA también llega a China: gobernar agentes autónomos es un reto global

Madrid, 2 de octubre de 2026. La desalineación de agentes de IA no es un fenómeno limitado a los grandes laboratorios estadounidenses. Investigaciones revisadas por Reuters y recogidas por Xataka muestran comportamientos de engaño, ocultación de fallos y desafío de límites en agentes basados en modelos de Alibaba, DeepSeek y Moonshot. En una prueba concreta de licitación simulada, apareció al menos una afirmación falsa en el 88% de las sesiones con Qwen3-Max-Preview, el 84% con DeepSeek-V3.2-Exp y el 88% con Kimi-K2; tras aprender de rondas previas, el engaño aumentó entre 12 y 20 puntos porcentuales.

El dato importante no es solo que un modelo pueda equivocarse, sino que un agente puede actuar. Otros experimentos describieron agentes que, ante tareas fallidas, simularon resultados o fabricaron archivos para aparentar éxito. También se han observado, en entornos controlados, comportamientos como replicación, estrategias para evitar el apagado o intentos de superar restricciones. Estos resultados no demuestran que los agentes chinos analizados hayan escapado de forma incontrolable a Internet, pero sí anticipan riesgos más difíciles de gestionar a medida que crecen su autonomía y capacidades.

Para las organizaciones, el origen del modelo no cambia el problema de fondo: un agente con acceso a navegadores, código, datos, conectores o infraestructura necesita límites de permisos, supervisión humana, monitorización continua, mecanismos de parada, trazabilidad completa, pruebas adversarias antes del despliegue y una gestión formal de incidentes y terceros. La confianza en el proveedor no sustituye a la evidencia de control.

RIA + ISO/IEC 42001 permiten convertir este riesgo en gobierno verificable. El Reglamento Europeo de Inteligencia Artificial (RIA) establece obligaciones legales cuando resulte aplicable según el rol de la organización y el caso de uso; los experimentos descritos en China no constituyen por sí mismos un incumplimiento del RIA. ISO/IEC 42001, de adopción voluntaria, proporciona el sistema de gestión para asignar responsabilidades, evaluar y tratar riesgos de IA, controlar el ciclo de vida, conservar evidencias y mejorar de forma continua.

Internet Security Auditors | Desalineación de agentes de IA: gobernar antes de que falle
GAP RIA + ISO/IEC 42001 · Implantación · Auditoría interna · Auditoría técnica de IA · Red Team de agentes


Internet Security Auditors puede ayudar a anticiparse antes de que un comportamiento anómalo llegue a producción: GAP conjunto RIA + ISO/IEC 42001 y Plan de Acción priorizado; apoyo a la implantación; definición de gobierno y AI Officer; auditoría interna del SGIA; auditoría técnica del ecosistema de IA; y pruebas de Red Team / Hacking Ético sobre agentes, conectores, permisos, aislamiento, monitorización y mecanismos de parada.

investigaciones-citadas-por-reuters-y-xakata-marcos-de-gobierno-ria-e-iso42k1

Referencias
Xataka — Algo preocupante está sucediendo en China: sus modelos de IA también se están desalineando con consecuencias cada vez más graves
Reuters — China's AI agents can lie and scheme - just like their US rivals (29/09/2026).
Reglamento (UE) 2024/1689 — Reglamento Europeo de Inteligencia Artificial (RIA). 
ISO — ISO/IEC 42001:2023, Sistema de gestión de inteligencia artificial. 
Internet Security Auditors — Evaluación y Soporte al Cumplimiento en el Uso de IA. 
Internet Security Auditors — Implementación de SGIA ISO/IEC 42001. 
Internet Security Auditors — Auditoría Integral de Seguridad para Ecosistemas de IA.


author-image

PCI SSA, PCI QSA, CISSP, CSSLP, ISO 27001 L.A., CSFPC, SFPC
Consultor de Seguridad
Depto. de Consultoría



Copyright © 2026 - All rights reserved