Elecciones 2026Vea quién creemos que merece su voto, según nuestros criteriosLa guía →
ESCRITO EN ESPAÑOL CLARO.
CLAY TRIBUNE.
Publicidad

Con la mayor parte de la información oculta, el juego Stratego había desconcertado a la inteligencia artificial hasta ahora. )

Una inteligencia artificial de bajo costo llamada Ataraxos finalmente descubre los secretos ocultos de Stratego, derrotando a su campeón humano en una sorprendente victoria de 15 a 1. )

Por mitch·6 min de lectura
A Stratego game board with soldiers and flags, a faint digital reflection of an AI face visible upon it.

Un contingente de 40 piezas, cada una con un rango oculto desde mariscal hasta espía, ha sido finalmente descifrado por una máquina de bajo costo. El juego es Stratego, y el programa que lo resolvió se llama Ataraxos. Derrotó a Pim Niemeijer, considerado el mejor jugador de Stratego de todos los tiempos, 15 partidas a una, con cuatro empates.

Stratego ha resistido el auge de las máquinas durante décadas. El triunfo de Deep Blue sobre Garry Kasparov en ajedrez fue primero, allá por 1997. Luego AlphaGo superó a Lee Sedol en Go en 2016. Los bots de póker han estado venciendo a profesionales durante años. Sin embargo, Stratego resistió, con incluso DeepMind, a pesar de su vasto presupuesto, sin lograr construir una máquina que confiablemente superara a los mejores jugadores humanos.

Un equipo de cuatro universidades —Carnegie Mellon, MIT, la Universidad de Nueva York y Stanford— lo ha producido ahora. Entrenaron a Ataraxos utilizando solo 16 GPUs y unos pocos miles de dólares.

Publicidad

Lo que Stratego Oculta

Stratego es un juego construido sobre mentiras. Cada bando comienza con 40 piezas, cada una representando un rango desde mariscal hasta espía, junto con bombas y una bandera. El objetivo es simple: tomar el control de la bandera enemiga. Lo que lo hace funcionar es que su rival puede ver dónde se ubican sus piezas, pero no tiene idea de lo que son en realidad.

Dos jugadores no saben lo que tiene su oponente hasta que sus piezas se encuentran en combate. La pieza con el rango inferior se retira, y la identidad del vencedor se hace conocida de todos. Es por esto que Stratego cuenta como un juego de información imperfecta, al igual que el póker, que las máquinas fueron capaces de resolver hace mucho tiempo. «Hay algo súper distintivo sobre Stratego, que es una gran cantidad de información oculta que se desarrolla a lo largo de un período de tiempo muy largo», señaló en sus comentarios Eugene Vinitsky, quien es investigador en NYU y coautor del estudio.

La comparación con el póker se detiene en la superficie. En algunas formas de póker, la información oculta es pequeña. «En Texas Hold’em, solo tienes dos cartas ocultas», dijo Gabriele Farina, científico informático del MIT y otro coautor. Eso deja solo 1,326 manos posibles, suficientes para que una máquina las evalúe todas.

«En Stratego, hay 40 piezas en el tablero que podrían estar en cualquier orden», dijo Farina. Eso es más de un decillón de posibles configuraciones. El juego también dura mucho más que el ajedrez. «En ajedrez, usualmente el juego dura 40 jugadas, pero en Stratego, un juego puede durar fácilmente 2,000 jugadas», dijo Farina.

El Problema del Farol

Luego está la duración del juego. «En ajedrez, usualmente el juego dura 40 jugadas, pero en Stratego, un juego puede durar fácilmente 2,000 jugadas», dijo Farina. Además de eso, Stratego es un juego de farol. A veces mueves una pieza débil como si fuera un mariscal, solo para asustar al oponente.

Si un jugador farolea demasiado, sus amenazas pierden todo peso. Si nunca farolea en absoluto, se vuelven fáciles de leer. Es ese cuidadoso equilibrio, dice el equipo, que AIs anteriores como DeepNash de DeepMind, introducido en 2022, encontraron difícil de manejar.

Una gran cantidad de información oculta, una duración extrema y una constante decepción hicieron de Stratego un objetivo más difícil que el ajedrez o Go. El juego exige un equilibrio de cálculo y psicología que los sistemas anteriores no podían manejar.

Ataraxos Gana

El equipo de Ataraxos construyó una solución que requería muchos menos recursos que el trabajo anterior de DeepMind. Entrenaron su IA en 16 GPUs y gastaron unos pocos miles de dólares, y aun así lograron igualar el rendimiento de los intentos anteriores de DeepMind.

Niemeijer es ampliamente considerado el mejor jugador de Stratego de todos los tiempos. Su récord habla por sí solo. El resultado del equipo fue de 15 victorias a una, con cuatro empates. Esa es una actuación dominante contra un jugador que ha dedicado su carrera a estudiar las profundidades ocultas del juego.

Por Qué Importa

Stratego finalmente ha caído, y la victoria tiene peso porque cierra una brecha en el registro de la IA. Los juegos anteriores cedieron ante las máquinas: Deep Blue venció al ajedrez, AlphaGo superó a Go, y los bots de póker hace mucho tiempo comenzaron a vencer a los profesionales humanos. Stratego, sin embargo, demostró ser más resistente, su inmensa información oculta y extraordinaria duración convirtiéndolo en un objetivo más difícil que cualquier juego antes que él.

Esta victoria demuestra lo que un pequeño equipo puede lograr. Aunque los investigadores provenían de cuatro universidades importantes, sus recursos siguieron siendo modestos: entrenaron Ataraxos en 16 GPUs y gastaron unos pocos miles de dólares.

Este resultado marca un punto de inflexión. Un juego que resistió a la inteligencia artificial durante muchos años ha cedido al fin, y sucedió con muy poco dinero invertido.

Los Números Detrás de la Victoria

  • Juego: Stratego
  • Ganador: Ataraxos (IA)
  • Perdedor: Pim Niemeijer (considerado el mejor jugador de Stratego de todos los tiempos)
  • Marcador: 15 victorias a una, con cuatro empates
  • Hardware de entrenamiento: 16 GPUs
  • Costo de entrenamiento: Unos pocos miles de dólares
  • Intento anterior de IA: DeepNash de DeepMind, presentado en 2022

Lo Que Significa Esto

El progreso de la IA no avanza en línea recta. Algunos problemas se resuelven rápidamente, mientras que otras cuestiones permanecen firmes durante años. El juego Stratego fue uno de esos casos difíciles. Ahora ha sido resuelto, y la respuesta provino de investigadores universitarios en lugar de una empresa bien financiada.

Una configuración modesta produjo un resultado sólido, lo cual es una lección para cualquiera que esté construyendo sistemas de IA: a veces, menos es más. El enfoque del equipo fue eficiente, produciendo un resultado sólido con recursos mínimos.

La victoria demuestra que la investigación de la inteligencia artificial se está abriendo más a todos, con una suma modesta de dinero y 16 GPU ahora al alcance de numerosos laboratorios.

Esta victoria marca un logro significativo, aunque aún queda mucho trabajo por hacer. Muchos juegos todavía esconden sus secretos de nosotros, y los métodos creados para Ataraxos podrían servir como base para la investigación que sigue, ayudando a los investigadores a abordar estos rompecabezas restantes.

El grupo ha recibido elogios por resolver un problema que dejó a DeepMind buscando respuestas. Su logro muestra que la inteligencia artificial sigue siendo un área relativamente nueva, donde los resultados inesperados siguen apareciendo.

Fuente: “Con la mayor parte de la información oculta, el juego Stratego había desconcertado a la inteligencia artificial hasta ahora”, Ars Technica.

El Cuaderno

Recibe El Cuaderno.

Las mejores historias del día y cada veredicto nuevo, en español claro, en tu correo a las siete. Un correo al día, nada más.

Enviamos una nota para confirmar. Cada número trae un enlace para darte de baja con un clic.

Publicidad

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Como Afiliado de Amazon, Clay Tribune obtiene ingresos por las compras adscritas que cumplen los requisitos aplicables.