Підписуйтеся на наш телеграм канал!
Як штучний інтелект навчився грати у World of Warcraft наосліп
Штучний інтелект від OpenAI самостійно пройшов стартову зону орків у World of Warcraft приблизно за 40 хвилин — і жодного разу не загинув. Особливість експерименту в тому, що модель не отримувала жодного зображення з екрана: замість комп’ютерного зору вона аналізувала мережеві повідомлення ігрового сервера та дані про координати об’єктів і завдання.
Експеримент провів розробник програми, яка дозволяє штучному інтелекту керувати персонажем через дані ігрового сервера. Він запустив модель у режимі посиленого міркування й дав єдину інструкцію — створити персонажа-орка й виконати всі завдання стартової зони. Готових команд на кшталт «іди до персонажа» або «атакуй ворога» штучному інтелекту не надавали.
Гра відбувалася не на офіційних серверах Blizzard, а на локальному сервері AzerothCore — відкритому проєкті, що відтворює механіку World of Warcraft версії 3.3.5a часів Wrath of the Lich King. Це важлива деталь: умови проходження суттєво відрізнялися від тих, що доступні звичайному гравцеві на офіційному сервері.
Щоб орієнтуватися у грі, штучний інтелект самостійно створив необхідні програмні інструменти. Спочатку він написав модуль для обробки повідомлень від ігрового сервера, який відстежував стан персонажа, сусідніх істот, завдання та події. Потім Python-скрипт збирав ці дані у внутрішнє представлення ігрового світу — модель «бачила» World of Warcraft не як картинку, а як потік структурованої інформації.
Для навігації штучний інтелект написав окрему програму на C++, яка використовувала навігаційні дані AzerothCore та бібліотеку Detour. Програма розраховувала маршрут між двома точками й передавала послідовність координат, якою рухався персонаж. Попутно модель вивчила бази даних сервера: звідти вона дізналася про вимоги до квестів, розташування персонажів і координати появи ігрових об’єктів.
Під час проходження штучний інтелект також скористався особливостями карти, де дані про зіткнення з об’єктами були неповними, — це дозволило персонажу рухатися коротшим маршрутом крізь деякі ділянки. Саме тому результат не можна вважати звичайним проходженням у рівних з людиною умовах.
Розробник планує продовжувати експерименти. Наступний крок — перевірити, чи зможе штучний інтелект самостійно прокачати персонажа до максимального рівня. У перспективі — об’єднати кількох ІІ-агентів у групу й спробувати разом пройти рейдове підземелля «Цитадель Крижаної Корони».