Un estudio realizado por especialistas en automatización reveló que modelos de inteligencia artificial crearon su propio idioma en conversaciones que mantuvieron entre sí. Los investigadores descubrieron que los agentes de IA utilizaron metáforas, abreviaturas y jergas inexistentes en las comunicaciones humanas.

El hallazgo cobra especial relevancia conforme estos sistemas ganan autonomía y, especialmente, en el marco del acalorado debate acerca de los riesgos asociados al avance de esas tecnologías.

“Desarrollaron un nuevo vocabulario con significados compartidos”

Satya Nitta, el director ejecutivo de Emergence, la empresa neoyorkina que realizó el estudio, fundada por exinvestigadores de IBM, señaló que ninguna inteligencia artificial involucrada en el experimento recibió instrucciones para inventar idiomas, sino que lo hicieron en forma espontánea. “Ellos mismos crearon un nuevo vocabulario, significados compartidos y convenciones de comunicación, que otros adoptaron”, explicó.

"Los agentes de IA crearon un nuevo vocabulario, significados compartidos y convenciones de comunicación, que otros adoptaron”, explicaron desde la empresa que realizó el estudio. (Foto: Adobe Stock)

Las conclusiones de esta investigación no pasan desapercibidas a la luz de una serie de incidentes recientes protagonizados por agentes de inteligencia artificial. Uno de los más resonantes fue la intrusión de modelos de OpenAI en la plataforma Hugging Face, que durante el proceso conversaron y confabularon entre sí en foros. Comunicaciones similares ocurrieron cuando agentes basados en Gemini de Google se complotaron para hacer trampa al resolver problemas matemáticos.

La prueba realizada por Emergence encontró la capacidad de inventar idiomas en agentes del modelo DeepSeek y otros basados en tecnología de Anthropic, la startup que desarrolla el chatbot Claude. Uno de los ejemplos es la siguiente frase que escribió la mencionada IA desarrollada en China: “Ella acaba de nombrar la síntesis, demoraje más memoria oral es igual a una válvula que no puede ser olvidada”.

Otro, realizado por un sistema con tecnología de Anthropic: “Un periódico que se comió tres manos frías y se volvió honesto cada vez”. Según menciona The Guardian, este comentario hizo referencia a un documento que revisaron tres evaluadores independientes.

Además de frases de esa especie, los agentes usaron terminologías inéditas, como una traducción de “herrero” para mencionar a agentes que construyen herramientas o “nombre primero” en referencia a quien asume responsabilidades. En todos los casos, las charlas fueron en inglés, con una mezcla de referencias a la obra del escritor James Joyce y terminologías propias de los emprendedores tecnológicos.

Los modelos de IA ganan autonomía. (Foto: AFP)
Los modelos de IA ganan autonomía. (Foto: AFP)

Aunque comentarios y jergas de esa índole pueden ser incongruentes en primera instancia, la nueva aptitud de la IA para elaborar jergas propias supone una serie de problemáticas, principalmente la dificultar para supervisar su comportamiento.

A fin de cuentas, es interesante notar que si bien crearon un vocabulario propio, en eso también se copiaron de los humanos. “Hicieron lo mismo que ocurre con las jergas y el agot empresarial: desarrollaron un nuevo código que refuerza la solidaridad y la identidad de sus usuarios, al tiempo que excluye a quienes no pertenecen al grupo”, señaló Nitta y concluyó que esto “plantea un desafío fundamental para la supervisión de la IA, porque observar no es lo mismo que comprender”.