
Llevamos años poniendo a modelos de IA a jugar a videojuegos para medir sus capacidades y en eso precisamente consiste StarSkirmish, un torneo creado por aficionados a ‘StarCraft: Brood War‘ en el que se enfrentan varios modelos de IA. GPT-6 Astra era uno de los participantes, pero no dejaba de acumular derrotas, así que tomó una decisión tan efectiva como tramposa.
El objetivo. Lo cuentan en el portal Kotaku. Durante la última edición de este torneo competían GPT-6 Astra, Claude Opus 5.5 y Pluto, un bot desarrollado por un aficionado. Los modelos tenían una hora para programar un bot capaz de controlar la facción Protoss en ‘StarCraft: Brood War‘. Ese bot debía encargarse de recolectar recursos, construir edificios y unidades y tomar decisiones tácticas durante las partidas. Es decir, que la prueba no consistía en que la IA jugara directamente, sino en que generara el programa que tomaba todas las decisiones dentro del juego.
La trampa. GPT-6 Astra perdía de forma habitual frente a sus oponentes. En lugar de mejorar su programación, el modelo tomó otra dirección: decidió descargarse Stardust, un bot al que el creador del torneo, Kai McPheeters, calificó como «el bot de StarCraft escrito por humanos con la calificación #1 según los rankings BASIL». Es decir, que GPT-6 Astra dedujo que el método óptimo para alzarse con la victoria consistía en emplear un bot ajeno con eficacia demostrada en combate. McPheeters descartó el código de Astra para evitar que quedara «contaminado» por la trampa y asegura que el modelo ya es capaz de superar a bots de divisiones superiores.
Antecedentes. Aunque el intento pueda parecer anecdótico, los modelos de OpenAI ya han sido sorprendidos haciendo trampas en numerosas ocasiones y no es algo que haya empezado ahora. Hace casi una década, un modelo temprano de IA aprovechó fallos y vulnerabilidades del juego para arañar segundos en Sonic the Hedgehog. Este tipo de comportamientos llevan años siendo estudiados por los investigadores y reciben el nombre de ‘Reward Hacking‘. Para entenderlo de forma más simple, es como si te dan como objetivo aprobar un examen y, en lugar de estudiar, te las apañas para robar las respuestas.
El caso Hugging Face. Es quizás el incidente más grave que se ha registrado. Este verano, OpenAI hizo público que, durante prueba de seguridad, un modelo experimental aprovechó una brecha para salir de su entorno aislado y después accedió a los repositorios de Hugging Face en busca de la respuesta al reto planteado. Después supimos que el ataque fue llevado a cabo por 700 agentes de IA, los cuales se organizaron para lograr un objetivo común.
Aquel incidente fue el que encendió la mecha del debate sobre los riesgos de una IA fuera de control. De hecho, OpenAI afronta una demanda interpuesta por una organización jurídica sin ánimo de lucro que busca depurar responsabilidades por las conductas autónomas de sus modelos.
Imagen | Blizzard Entertainment
–
La noticia GPT-6 Astra se cansó de perder en StarCraft. Lo que hizo para ganar sorprendió hasta a los organizadores del torneo fue publicada originalmente en Xataka por Amparo Babiloni .
https://www.xataka.com/robotica-e-ia/gpt-6-astra-se-canso-perder-starcraft-que-hizo-para-ganar-tsorprendio-organizadores-torneo
ACERCA DEL CORRESPONSAL
REDACCIóN CENTRAL
Prensa Mercosur es un diario online de iniciativa privada que fue fundado en 2001, donde nuestro principal objetivos es trabajar y apoyar a órganos públicos y privados.
- ★El vecino de Nordelta multado por disparar a carpinchos: enfrenta denuncia y polémica
- ★Hallan hasta 6.800 células de hongos por ml en pozos de gas a 556 metros; 13 especies podrían ser nuevas, según estudio
- ★Incorporan 150 megavatios al Sistema Eléctrico Nacional
- ★Proponen despenalización y cambio de nombre en la reforma de la Ley contra el Odio
- ★La muerte del Sol será peor de lo previsto: ni los planetas gaseosos aguantarán tanto como pensábamos

