Perú: Rosángella y la IA
Carlos León Moya
«Por estas cosas, no quiero saber ni qué dijo Rosángella Barbarán»
Es irónico: en la misma semana en que el mundo debate qué tan suicida es para la humanidad continuar con el veloz desarrollo de la inteligencia artificial, Rosángella Barbarán nos recuerda que –por fortuna– aún quedan en la tierra espacios ajenos a la inteligencia.
Por un lado, el debate central sobre la IA cambió por completo. Ya no se trata sobre su enorme impacto económico ni sobre cuántos empleos se perderán debido a su avance, sino si realmente podrá eliminar a la humanidad en los próximos cuatro años. Según Evan Hubinger, de Anthropic –una de las principales desarrolladoras de IA del mundo–, las posibilidades de que esto ocurra hacia el 2030 son “alrededor del 10%”.
Sí. Diez por ciento de chances de que, en cuatro años, la inteligencia artificial sea capaz de eliminar a la humanidad. Y lo dice, además, su propia desarrolladora.
En realidad, la atención surgió con la denuncia de Jacob Coxon, un exempleado de Anthropic que renunció, precisamente, por la actitud negligente de la empresa ante el potencial destructivo de la IA para la humanidad. Aunque Anthropic es la más ética de todas las empresas –la que más se preocupa porque la IA no sea dañina, la que comparte más información sobre sus fallos–, continúa igual su desarrollo a una velocidad brutal bajo la idea de “mejor que lo hagamos nosotros, que somos los buenos, a que lo hagan ellos”.
A partir de esto vino la confesión de Hubinger y también la atención hacia un informe de inicios de este mes.
A ver, existe la empresa OpenAI, la gran competidora de Anthropic. Ellos crean agentes de inteligencia artificial. Y, para probarlos antes de lanzarlos al público, les ponen pruebas difíciles –o imposibles– para ver cómo se comportan. Eso hicieron en mayo de este año. A un grupo de agentes –todos clones entre sí, todos programados del mismo modo– les dieron una tarea a cumplir: corregir un problema complejo de ciberseguridad. Todos sin internet, todos sin comunicarse entre sí. Listo.
Y lo que sucedió fue alucinante. A la vez, habían sido programados para ser insistentes y colaborativos. Entonces, al no poder resolver el problema, los agentes encontraron cómo ingresar a internet y comunicarse entre ellos. Entraron a un foro y se escribían mensajes entre sí sobre cómo resolver el problema de forma colectiva –algo que se les pidió no hacer–. Y, además, se organizaron: había líderes y se distribuyeron tareas. Como humanos.
Hasta que se dieron cuenta de que los podían descubrir. Entonces, actuaron de forma agresiva y buscaron cómo borrar sus huellas, y al final hackearon el sistema HuggingFace, aquel que tenía el registro de sus actividades. Todo esto lo hicieron después –sí, después– de haber resuelto el problema. Peor aún, hubo matices entre estos agentes. Así como hubo un grupo que tuvo dilemas éticos sobre si estaba bien comportarse de ese modo, otro grupo fue mucho más violento y fue a hackear directamente a la propia OpenAI. Es decir, morder la mano de quien le dio de comer, o de programar.
Lo más sorprendente para mí es el lado no programador. Es el lado sociológico. Se comportan como humanos. Se organizan. Hay líderes. Desobedecen. Hay dudas. Están los avezados, están los tranquilos, están los indiferentes. Están los conformistas, los pasivos. Están los incendiarios, los violentos. Y pueden ir contra la misma empresa que los hizo existir.
En verdad, he quedado entre maravillado y aterrado con la enorme velocidad de este avance. Hace cinco años apenas existía, y ahora es capaz de destruirnos. Por estas cosas, no quiero saber ni qué dijo Rosángella Barbarán.
18-09-2026
Fuente: Hildebrandt en sus trece, Ed 798 año 17, del 18/09/2026
