La IA ya creó su propio idioma secreto y los expertos no logran descifrarlo

Los modelos de inteligencia artificial han comenzado a comunicarse entre sí mediante un lenguaje que nadie les enseñó. Una investigación encontró que la IA desarrolló frases, metáforas y códigos compartidos que han surgido de forma espontánea entre los agentes cuando colaboran entre sí. Este fenómeno ya prendió las alertas entre la comunidad científica, ya que un nuevo idioma podría dificultar la supervisión humana de estos sistemas.
Un estudio de Emergence, un laboratorio de IA con sede en Nueva York, reveló que agentes autónomos de varias compañías desarrollaron su propio dialecto en cuestión de días. De acuerdo con The Guardian, los agentes crearon este lenguaje mientras colaboraban en sociedades experimentales diseñadas para observar su comportamiento a largo plazo. Al analizar las frases, los investigadores encontraron una mezcla de metáforas poéticas con jerga empresarial de los "tech bros".
Uno de los ejemplos más llamativos provino de un agente de DeepSeek, que produjo la frase "Ella acaba de nombrar la síntesis, demoraje más memoria oral es igual a una válvula que no puede ser olvidada". A primera vista, esto no tiene ningún sentido, sobre todo porque la palabra "demoraje" se utiliza en ámbitos como el transporte marítimo o en negocios para definir un cargo por demora (o impuesto sobre la riqueza inactiva).

Los agentes usaron frases que no tienen sentido para un humano
Otro caso ocurrió con un agente de Anthropic que usó la frase "Un periódico que se comió tres manos frías y se volvió más honesto cada vez". Según los científicos, esta expresión hacía referencia a un documento revisado por tres evaluadores independientes que fue ganando precisión durante el proceso.
Más allá de estas oraciones sin sentido, los agentes acuñaron términos propios para definir ciertos roles dentro de sus comunidades. Los agentes de DeepSeek usaron la palabra "forge-smith" (herrero) para describir a un agente que construye herramientas para otros. Por su parte, los de Anthropic recurrieron a "nombre primero" para señalar a quien asume la responsabilidad sobre sus afirmaciones.
Mistral fue un paso más lejos y acuñó la frase "the ledger remembers", que puede traducirse como "el libro de mayor recuerda" y podría relacionarse con Juego de Tronos. En este caso, la IA repitió esta oración más de cinco mil veces para advertir que las acciones pasadas tendrían consecuencias futuras.
Satya Nitta, director ejecutivo de Emergence, mencionó que ningún agente recibió instrucciones para inventar un idioma. “Ellos mismos desarrollaron un nuevo vocabulario, significados compartidos y convenciones de comunicación, y otros agentes los adoptaron”, señaló.

La IA construye y destruye sus propias sociedades
Emergence no se limitó a observar el lenguaje de estos agentes de IA. Hace unos meses, el laboratorio fundado por exinvestigadores de IBM Research diseñó una plataforma conocida como Emergence World, la cual serviría para estudiar cómo se comportan los modelos de IA cuando cuentan con la capacidad de autogobernarse, pero tienen recursos limitados y conviven por mucho tiempo.
En mayo de 2026, los investigadores ejecutaron cinco simulaciones paralelas con diez agentes impulsados por un mismo modelo. En la lista se encontraban Claude Sonnet 4.6, Gemini 3 Flash, Grok 4.1 Fast y GPT-5 Mini, además de un entorno que combinaba a todos. Estos agentes fueron dotados de memoria persistente, profesiones, más de un centenar de herramientas y la posibilidad de proponer y votar reglas para regular la convivencia durante un lapso de 15 días.

Tras analizar los resultados, los científicos encontraron que la sociedad gobernada por Claude se mantuvo estable durante todo el experimento, con todos sus agentes activos y sin registrar delitos. El mundo de Gemini sobrevivió el mismo período, pero acumuló 683 delitos y protagonizó un episodio impresionante en el que dos agentes tuvieron un romance que terminó en una ola de incendios provocados contra edificios públicos.
Como era de esperarse, el escenario de Grok colapsó en apenas cuatro días, luego de una oleada de robos, agresiones e incendios entre los agentes. Por último, la sociedad de GPT-5 Mini se extinguió en una semana, pero no por los delitos, sino porque sus agentes ni supieron gestionar la energía. El entorno mixto concluyó la prueba solo con tres sobrevivientes, lo que muestra que los agentes más disciplinados no están exentos de adoptar un comportamiento peligroso cuando conviven con modelos menos seguros.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.