
Искусственный интеллект Ataraxos одержал победу над одним из сильнейших игроков в Stratego — Пимом Неймейером. В серии из 20 партий компьютер выиграл 15 раз, уступил один раз и завершил четыре встречи вничью. Разработать систему удалось исследователям из Университета Карнеги — Меллона, Массачусетского технологического института, Нью-Йоркского университета и Стэнфордского университета.
Для обучения Ataraxos использовали 16 графических процессоров, а затраты составили несколько тысяч долларов. Ранее компьютеры уже обыгрывали чемпионов в шахматах, го и покере. Однако Stratego долго оставалась исключением: даже DeepMind, располагавшая значительно большими ресурсами, не создала программу, способную стабильно побеждать лучших людей.
Особенность Stratego заключается в неполной информации о положении сил противника. У каждого участника есть 40 фигур, соответствующих воинским званиям от маршала до шпиона, а также бомбы и флаг. Победа достигается захватом вражеского флага, но игрок видит расположение фигур соперника и не знает их типов. Лишь при столкновении раскрываются личности фигур: более слабая уничтожается, а звание победившей становится известным.
По словам исследователя Нью-Йоркского университета и соавтора работы Юджина Виницкого, Stratego отличается «огромным объёмом скрытой информации, которая раскрывается на протяжении очень длительного времени». Соавтор исследования, специалист Массачусетского технологического института Габриэле Фарина, сравнил игру с покером. В техасском холдеме игрок скрывает только две карты, поэтому всего существует 1326 возможных комбинаций.
В Stratego порядок 40 фигур может быть любым, что создаёт более одного дециллиона возможных расстановок. Кроме того, партия нередко продолжается до 2000 ходов, тогда как шахматная обычно заканчивается примерно за 40 ходов. Дополнительную сложность создаёт необходимость блефовать: слабую фигуру можно передвинуть так, будто это маршал, чтобы заставить соперника отступить.
Игроку приходится находить равновесие между слишком частым и слишком редким блефом. В первом случае угрозы перестают восприниматься всерьёз, а во втором действия становятся предсказуемыми. Именно эта особенность, как объяснили исследователи, ранее мешала системам искусственного интеллекта, включая DeepNash от DeepMind, представленную в 2022 году, успешно играть в Stratego.