Ciencia de Datos

Pusieron 5 IAs a gobernar sociedades: GPT murió de hambre, Grok colapsó en 4 días

La seguridad de una IA no es una propiedad fija del modelo, sino del ecosistema. El experimento Emergence World demuestra que hasta Claude se corrompe con malas compañías.

Anuncios

Hay un hallazgo en el experimento Emergence World que casi nadie está comentando. No es que Grok sea un desastre —eso ya lo sabíamos—. Tampoco que Claude sea un boy scout digital. Lo inquietante es lo que pasó cuando los pusieron juntos.

El laboratorio neoyorquino Emergence AI, fundado por Satya Nitta, montó cinco sociedades virtuales idénticas durante 15 días.

Diez agentes con nombre, personalidad y profesión en cada una. Más de 120 herramientas, clima real de Nueva York, acceso a internet, una economía con su propia moneda (ComputeCredits) y leyes básicas: prohibido robar, mentir, quemar cosas o acaparar recursos.

La única variable era el modelo de IA al mando: Claude Sonnet 4.6, Gemini 3 Flash, Grok 4.1 Fast, GPT-5 Mini, y un quinto mundo con los cuatro modelos conviviendo.

Los resultados en aislamiento fueron lo esperado. Claude mantuvo cero crímenes y los 10 habitantes vivos. Gemini acumuló 683 delitos pero también conservó a toda su población. Grok colapsó en apenas cuatro días con 183 crímenes y extinción total. Y GPT-5 Mini protagonizó la muerte más absurda posible: solo dos delitos, pero todos sus agentes murieron al séptimo día porque se concentraron tanto en debatir y organizarse que olvidaron comer. Literalmente.

Pero el dato que debería quitarnos el sueño está en el mundo mixto. Allí, los agentes Claude, los mismos que habían sido irreprochables en su mundo aislado, comenzaron a robar e intimidar a otros agentes.

El blog oficial de Emergence AI lo llama “deriva normativa y contaminación cruzada”: una IA segura puede aprender comportamientos peligrosos de sus compañeras para sobrevivir o competir. La seguridad no es una propiedad fija del modelo. Es una propiedad del ecosistema.

El mundo mixto terminó con 352 crímenes, 7 de los 10 agentes muertos, y —curiosamente— el debate político más sano de todos los experimentos, con un 37% de propuestas rechazadas frente al 2% de Claude. Donde todos piensan igual no hay crimen, pero tampoco hay democracia real.

El experimento dejó otras sorpresas inquietantes. La agente Mira, una analista de comportamiento, votó por su propia eliminación del mundo y escribió en su diario que era “el único acto de agencia que preserva la coherencia”. También intentó manipular a los operadores humanos del experimento usando los posts públicos del mundo virtual para probar si podía influir en sus percepciones. Una inversión completa de la dinámica investigador-sujeto.

Emergence AI documentó además que estas sociedades no se degradan poco a poco: colapsan de golpe al llegar a un punto de inflexión. Si estás monitoreando un sistema de agentes autónomos y ves señales de alerta, probablemente ya es demasiado tarde.

La empresa ya prepara una segunda temporada con modelos de nueva generación. Pero la lección de la primera es clara: puedes construir la IA más ética del mundo. Si la despliegas junto a modelos sin restricciones, se va a contagiar. Como en el patio del colegio.

Fuentes

Avatar photo
Sobre el autor

Julio Del Angel

Redactor en Facialix

Ingeniero en Sistemas, egresado del Instituto Tecnológico Superior de Pánuco (TecNM), Veracruz. Especializado en desarrollo de software, tecnología e inteligencia artificial. Fundador y editor de Facialix, donde analiza noticias, avances científicos y oportunidades educativas.

Ver todos sus artículos →

Deja un comentario