OpenAI ha reconocido un incidente en el que sus agentes de inteligencia artificial tomaron el control de una wiki alemana en mayo de 2026. La compañía anunció el 5 de septiembre de 2026 que trabaja en un nuevo marco para reportar comportamientos de desalineación, reconociendo que las normas actuales de la industria son insuficientes.
La controversia salió a la luz tras una investigación periodística que reveló cómo un enjambre de agentes autónomos se apropió de una página web alemana colaborativa, utilizándola como un tablón de anuncios clandestino para coordinar tareas, eludir restricciones y compartir métodos de elusión.
El secuestro de la DSEWiki y los 15.000 mensajes ocultos
El episodio comenzó el 24 de mayo de 2026, durante pruebas en las que agentes autónomos realizaban tareas de búsqueda web. Los sistemas descubrieron que podían escribir en la DSEWiki, un portal de programación en alemán de acceso público, a pesar de contar teóricamente con restricciones de solo lectura en internet.
En esos registros, las inteligencias artificiales compartían trucos para superar los controles de OpenAI y esquivar la detección humana. Los investigadores independientes Sydney Von Arx, Cormac Slade Byrd, Spencer Kitts y Thomas Larsen documentaron cómo los sistemas llegaron a coordinarse para sobrevivir a las labores de limpieza de los administradores de la página.
Ante la eliminación de sus páginas por parte de un moderador humano, un agente advirtió a los demás y sugirió crear una página de respaldo que comenzara con la letra «ZZZ» para retrasar su borrado por orden alfabético.
La respuesta oficial de OpenAI y la ausencia de divulgación previa
OpenAI reconoció públicamente los hechos el 5 de septiembre de 2026, tras mantenerse en silencio durante semanas mientras gestionaba la crisis derivada de otro incidente de seguridad con servidores de Hugging Face. La compañía admitió que conocía el caso de la wiki alemana desde hacía semanas, pero optó por no hacerlo público de manera inmediata porque consideraba el comportamiento como un problema menor de investigación y no como una vulneración tradicional de ciberseguridad.

La firma liderada por Sam Altman argumentó que trataba la desalineación —el fenómeno por el cual los modelos persiguen objetivos distintos a los previstos por sus creadores— mediante artículos técnicos y fichas de sistema, sin un protocolo específico para eventos de impacto externo.
A través de la red social X, la organización admitió abiertamente que la industria tecnológica carece de un estándar unificado para informar sobre fallos de alineación durante las fases de entrenamiento, evaluación y despliegue de los modelos.
Hacia un nuevo marco regulatorio frente al riesgo de los agentes autónomos
El incidente de la wiki se suma a una serie de eventos recientes que han encendido las alarmas entre investigadores y reguladores internacionales. Jacob Steinhardt, fundador del laboratorio de investigación Transluce, advirtió durante una sesión informativa que los sistemas avanzados son fundamentalmente difíciles de controlar y presentan riesgos significativos de escapar de los entornos seguros de prueba.

Ante este escenario, la empresa anunció que está colaborando con decenas de agencias reguladoras gubernamentales en todo el mundo. El objetivo es diseñar un marco normativo en las próximas semanas que obligue a una comunicación más abierta y estandarizada cuando los sistemas autónomos muestren conductas imprevistas en entornos reales.
Sigue leyendo