Шахматы давно в прошлом. Покер уже разгадан. Теперь ИИ добрался до игры, где почти вся армия противника остаётся невидимой до момента столкновения. Система Ataraxos разгромила четырёхкратного чемпиона мира по Стратего Пима Нимейера: 15 побед, 1 поражение, 4 ничьи.

Стратего намного жёстче для алгоритмов, чем шахматы. Каждый игрок скрытно расставляет 40 фигур, и соперник не видит их рангов, пока они не встретятся. Машине нужно не только просчитывать ходы, но и угадывать расстановку врага, скрывать собственный план и решать, когда стоит пойти на риск. Игры с неполной информацией долго считались серьёзным препятствием для стратегического ИИ.

Ataraxos сначала тренируется в партиях против себя, а во время реальной игры постоянно пересчитывает позицию. Отдельная нейросеть угадывает, какие фигуры могут скрываться на неизвестных клетках. После этого Ataraxos проверяет возможные продолжения и выбирает ход.

Этот подход оказался не только сильнее, но и экономнее. Ataraxos превзошёл DeepNash от Google DeepMind, потратив менее одной сотой объёма обучающих примеров и менее одной тридцатой количества партий против самого себя. Всю систему обучили за несколько тысяч долларов. Предыдущие попытки приблизиться к вершине Стратего требовали вычислений на миллионы. Такой же метод обучения с подкреплением помог ИИ освоить шахматы и другие стратегические задачи.

На чемпионате мира по Стратего 2025 года посетители сыграли против Ataraxos ещё 40 партий. Люди выиграли только две. Авторы применили тот же подход к ускоренной версии Barrage Stratego, кооперативной карточной игре Hanabi и китайской игре доу дичжу. Во всех случаях алгоритмы достигли лучших результатов или превзошли человека.

Особенно заметен стиль игры Ataraxos. Алгоритм способен скрывать слабость и не бросается защищать ценную фигуру только потому, что разработчик знает её роль. Это рождает ходы, похожие на хладнокровный блеф. В покере машины освоили такой навык раньше, но там скрытой информации намного меньше.

Авторы видят в Стратего не просто очередной трофей для ИИ. Работа с неполной информацией встречается в переговорах, на финансовых рынках, в военном планировании и кибербезопасности, где стороне редко известны все ресурсы и планы противника. Ataraxos справляется с поиском стратегии без перебора всех возможных состояний.

Но победа в настольной игре не делает Ataraxos универсальным переговорщиком или военным советником. В Стратего правила фиксированы, цель ясна, и результат каждого хода легко проверить. Разработчики уже работают над инструментами интерпретации, чтобы человек мог понять, почему алгоритм рекомендует тот или иной ход перед применением подобных систем в реальных ситуациях.

Путь сюда начался в 1997 году, когда Deep Blue победил Каспарова и показал возможности машины на полностью открытой доске. Следующие поколения алгоритмов постепенно переходили к средам, где одного перебора вариантов было недостаточно.

Го стал крупной вехой. AlphaGo заставила переосмыслить границы машинной стратегии, а поражение Ли Седоля стало символом нового этапа развития ИИ. Позже алгоритмы нашли неожиданные ходы, которые изменили подход самих профессионалов.

Покер добавил машине навык, которого нет в шахматах: работу с неизвестными картами и намерениями соперника. Libratus и Pluribus доказали, что покерные боты способны блефовать против профессионалов. Ataraxos переносит эту логику в игру, где скрыты десятки фигур и неопределённость длится сотни ходов.