ИИ системата Ataraxos победи световния шампион по Стратего, овладявайки игрите с непълна информация

Снимка: Ars Technica / Getty Images
Съвместен екип от изследователи от MIT, CMU, Нюйоркския университет (NYU) и Станфорд постигна исторически пробив, представяйки изкуствения интелект Ataraxos, който победи световния шампион по настолната игра Стратего Пим Ниймайер [1]. Този триумф слага край на една от последните непревзети крепости пред машините в областта на игрите с непълна информация и теорията на игрите (Game Theory) [2].
Защо Стратего се съпротивляваше на алгоритмите десетилетия наред
След историческите победи на Deep Blue в шаха (1997) и AlphaGo в го (2016), Стратего оставаше непокорен връх поради фундаментално различното си естество [1]. Докато шахът и го са игри с пълна информация, където състоянието на дъската е напълно видимо, в Стратего ранговете на 40-те фигури на противника са скрити, създавайки космическо пространство от 10¹¹⁵ възможни разпределения.
За да спечели, играчът трябва да блъфира, да подмамва опонента си в капани и да актуализира вероятностните си допускания (belief states) при всеки предприет ход [2].
Академичен триумф с оптимизирани изчислителни ресурси
Забележителен аспект на разработката е, че Ataraxos постига този резултат със скромен академичен бюджет, без да разчита на гигантските изчислителни клъстери на корпорации като Google DeepMind [1]. Изследователите са разработили нов математически метод за суб-дискретно търсене в състояния на несигурност, съчетаващ равновесно търсене на Наш с евристична редукция на дървото на ходовете.
По време на мача Ataraxos демонстрира неподражаема тактическа зрялост, включително умишлено жертване на фигури за разкриване на скрити бомби и психологическо маскиране на своя главен шпионин [2].
Отвъд дъската: Алгоритмичното вземане на решения в условия на мъгла и конфликт
Победата на Ataraxos в Стратего има последствия, надхвърлящи света на настолните игри. Реалният свят – за разлика от математически чистите правила на шаха – е свят на несъвършена информация. Военните командири, корпоративните преговарящи и експертите по киберсигурност никога нямат пълна представа за ресурсите, намеренията и разположението на своите противници.
Алгоритмичните пробиви, използвани в Ataraxos за моделиране на несигурността и разпознаване на дезинформация, имат директно приложение в автономните отбранителни системи, анализа на разузнавателни данни и управлението на вериги за доставки при криза. Системи, които могат да преценят кога противникът блъфира и как да поддържат оптимална стратегия при липсващи данни, ще бъдат в основата на бъдещите военни щабни симулации.
Не по-малко значим е фактът, че този пробив идва от академичната общност. Той доказва, че дълбоките алгоритмични иновации и математическата прецизност могат да надделеят над грубата изчислителна сила (brute force compute), напомняйки, че бъдещето на ИИ не принадлежи единствено на притежателите на най-големите центрове за данни.

Инфографика: Анализ на Svetni.me