ИИ Ataraxos впервые стабильно одержал победу над чемпионом мира по Stratego

Служба новостей Автор статьи
MaxДзенTelegram

Искусственный интеллект Ataraxos одержал победу над одним из лучших игроков в Stratego — Пимом Неймейером. В серии из двадцати партий компьютер выиграл пятнадцать раз, один раз уступил и завершил четыре встречи вничью. Разработка системы была осуществлена исследователями из Университета Карнеги — Меллона, Массачусетского технологического института, Нью-Йоркского университета и Стэнфордского университета. Об этом сообщает портал Science XXI.

Для обучения Ataraxos использовались шестнадцать графических процессоров, а затраты составили несколько тысяч долларов. Ранее компьютеры уже обыгрывали чемпионов в шахматах, го и покере. Однако Stratego долгое время оставалась исключением: даже DeepMind, обладая значительно большими ресурсами, не смогла создать программу, способную стабильно побеждать лучших игроков.

Особенность Stratego заключается в неполной информации о расположении сил противника. У каждого игрока есть сорок фигур, соответствующих воинским званиям от маршала до шпиона, а также бомбы и флаг. Победа достигается захватом вражеского флага, но игрок видит расположение фигур соперника и не знает их типов. Лишь при столкновении раскрываются личности фигур: более слабая уничтожается, а звание победившей становится известным.

По словам исследователя Нью-Йоркского университета и соавтора работы Юджина Виницкого, Stratego отличается «огромным объёмом скрытой информации, которая раскрывается на протяжении очень длительного времени». Соавтор исследования, специалист Массачусетского технологического института Габриэле Фарина, сравнил игру с покером. В техасском холдеме игрок скрывает только две карты, поэтому всего существует 1326 возможных комбинаций.

В Stratego порядок сорока фигур может быть любым, что создаёт более одного дециллиона возможных расстановок. Кроме того, партия нередко продолжается до двух тысяч ходов, тогда как шахматная обычно заканчивается примерно за сорок ходов. Дополнительную сложность создаёт необходимость блефовать: слабую фигуру можно передвинуть так, будто это маршал, чтобы заставить соперника отступить.

Игроку приходится находить равновесие между слишком частым и слишком редким блефом. В первом случае угрозы перестают восприниматься всерьёз, а во втором действия становятся предсказуемыми. Именно эта особенность, как объяснили исследователи, ранее мешала системам искусственного интеллекта, включая DeepNash от DeepMind, представленную в 2022 году.

Больше новостей и эксклюзивных видео смотрите в канале Самара Онлайн 24 в MAX

MaxДзенTelegramВКонтактеОдноклассники

Входные одностворчатые двери