Шахматы давно отдали преимущество компьютерам, покер научил машины блефовать. Теперь ИИ добрался до игры, где почти вся армия противника остаётся невидимой. Система Ataraxos разгромила четырёхкратного чемпиона мира по Стратего Пима Нимейера: 15 побед, 1 поражение, 4 ничьи.

Стратего намного сложнее для алгоритмов, чем шахматы. Каждый игрок тайно расставляет 40 фигур, и соперник не знает их рангов до столкновения. Машине нужно не просто считать ходы, а постоянно восстанавливать чужую расстановку, скрывать свои намерения и выбирать, когда рискнуть. Игры с неполной информацией давно считаются одним из самых сложных полигонов для стратегического ИИ.

Ataraxos сначала учится в партиях против самого себя, затем во время настоящей игры пересчитывает ситуацию. Генеративная модель оценивает, какие фигуры могут быть на неизвестных клетках. После этого Ataraxos проверяет возможные продолжения и выбирает ход.

Подход оказался не только сильнее, но и экономнее. Ataraxos превзошёл DeepNash от Google DeepMind, используя менее одной сотой обучающих примеров и менее одной тридцатой партий против себя. Обучение стоило несколько тысяч долларов. Предыдущие попытки приблизиться к вершине Стратего требовали вычислений стоимостью в миллионы.

На чемпионате мира по Стратего 2025 года посетители сыграли против Ataraxos 40 партий. Люди выиграли только две. Тот же подход применили к ускоренной версии Barrage Stratego, кооперативной карточной Hanabi и китайской доу дичжу. Во всех случаях алгоритмы приблизились к лучшим результатам или превзошли человека.

Стиль игры Ataraxos заслуживает внимания. Алгоритм сохраняет слабость в секрете и не защищает судорожно ценную фигуру только потому, что её роль известна разработчикам. Это порождает ходы, похожие на холодный блеф. В покере боты освоили похожий навык раньше, но там объём скрытой информации намного меньше.

Авторы видят в Стратего не просто новый трофей для ИИ. Работа с неполными данными встречается в переговорах, на финансовых рынках, в военном планировании и кибербезопасности — везде, где сторонам почти никогда не известны все намерения противника. Ataraxos справляется с поиском стратегии без полного перебора возможных состояний.

Однако победа в настольной игре не превращает Ataraxos в универсального переговорщика или военного советника. В Стратего правила фиксированы, цель однозначна, результат хода легко проверить. Разработчики видят следующий шаг в инструментах интерпретации — они позволят человеку понять причину рекомендации перед применением подобных алгоритмов за пределами игры.

История началась в 1997 году, когда Deep Blue победил Гарри Каспарова. Следующие поколения алгоритмов переходили в среды, где одного перебора вариантов недостаточно. AlphaGo в го показала новые границы машинной стратегии. Поражение Ли Седоля стало символом нового этапа развития ИИ.

Покер добавил машинам навык, которого нет в шахматах — работу с неизвестными картами и намерениями соперника. Libratus и Pluribus доказали, что боты способны блефовать против профессионалов. Ataraxos переносит эту логику в игру, где скрыты десятки фигур и неопределённость сохраняется сотни ходов.