Сегодня 12 октября 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → компьютерная игра

GPT-4 освоил Red Dead Redemption 2, но его подводит машинное зрение

Группа исследователей из Китая и Сингапура научила ИИ на базе OpenAI GPT-4V играть в Red Dead Redemption 2 (RDR2). В своей статье они рассказали о концепции общего компьютерного контроля (General Computer Control, GCC) для ИИ, и о мультимодальном агенте CRADLE — интерфейсе между GPT-4V и RDR2. По их мнению, основные проблемы у игрового ИИ-агента возникли при использовании машинного зрения.

 Источник изображения: Rockstar

Источник изображения: Rockstar

Исследователи поставили своей целью заставить ИИ, работающий на базе OpenAI GPT-4V, взаимодействовать с компьютером, воспринимая визуальные и звуковые сигналы, как это делает среднестатистический человек-пользователь ПК. Проект даёт представление о том, насколько далеко продвинулись разработчики ИИ в движении в сторону создания общего (сильного) искусственного интеллекта (AGI).

Исследователи выбрали RDR2, так как она имеет «сложную систему управления черным ящиком, которая воплощает в себе самые требовательные компьютерные задачи и позволяет нам оценить границы производительности нашей платформы в таких виртуальных средах». Кроме того, такие элементы пользовательского интерфейса, как диалоги, уникальные значки, внутриигровые подсказки и инструкции, гарантируют, что никакие базовые знания не воспринимаются как нечто само собой разумеющееся, что отлично подходит для обучения ИИ. Исследователи утверждают, что управление игрой с помощью мыши и клавиатуры обеспечивает лучшую тренировку для GCC.

 Как устроен CRADLE / Источник изображения: arxiv.org

Как устроен CRADLE / Источник изображения: arxiv.org

Исследователи стремились продемонстрировать способность ИИ изучать игру с нуля (без доступа к какому-либо внутреннему состоянию игры или API), то есть как это делает человек. ИИ-агент «проходил» игру, перемещаясь по миру и выполняя задания, следуя основной сюжетной линии RDR2. В целом, CRADLE добился заметного успеха в RDR2. Он смог «последовательно выполнять все задачи основной сюжетной линии», за исключением миссии с ураганной перестрелкой, заданий, которые требуют исследования сложного внутреннего мира, и многоэтапных миссий с открытым финалом.

 Как CRADLE выполняет buhjdst задания / Источник изображения: arxiv.org

Как CRADLE выполняет игровые задания / Источник изображения: arxiv.org

Исследователи считают, что причиной некоторых повторяющихся трудностей, с которыми сталкивался CRADLE, является GPT4-V. По их мнению, «возможности пространственно-визуального распознавания GPT-4V недостаточны для точного детального контроля». GPT4-V не справился с концепциями, специфичными для предметной области, такими как уникальные значки в игре, с пониманием мини-карт, а также с общими препятствиями в игровой среде.

 Производительность CRADLE в разных типах миссий / Источник изображения: arxiv.org

Производительность CRADLE в разных типах миссий / Источник изображения: arxiv.org

Хотя опубликованная статья посвящена взаимодействию ИИ с RDR2, авторы утверждают, что предназначение системы CRADLE в рамках GCC гораздо шире: «для поддержки более широкого спектра игр, таких как игры-симуляторы и стратегии, а также различных программных приложений».


window-new
Soft
Hard
Тренды 🔥
Роскомнадзор намерен получить право блокировать ресурсы без решения суда 5 ч.
Новая статья: Iron Meat — наконец-то новая Contra! Рецензия 6 ч.
«Беззаботный взгляд на мир ведьмаков»: CD Projekt Red анонсировала сборник комиксов The Little Witcher про приключения маленькой Цири в Каэр Морхене 6 ч.
Соавтор Disco Elysium основал «революционную новую RPG-студию» для создания ролевой игры под стать «нашему убогому и прекрасному миру» 7 ч.
Функция «Круг для поиска» появилась в складном смартфоне HONOR Magic V3 и серии смартфонов HONOR 200 8 ч.
Aspyr обновит ещё три игры из серии Tomb Raider — трейлер, подробности и предзаказ Tomb Raider IV-VI Remastered в российском Steam 11 ч.
В день релиза Metaphor: ReFantazio побила рекорд Persona 3 Reload по скорости продаж для игр Atlus 12 ч.
TikTok уволил сотни сотрудников — модерировать контент будет ИИ 12 ч.
20 лет свободного обмена идеями и кодом: юбилейная конференция разработчиков СПО 13 ч.
Бывшие сотрудники ZA/UM основали две разные студии, и каждая делает наследника Disco Elysium — настоящий детектив и «психогеографическую» RPG 13 ч.
Планшеты Huawei MatePad Pro 12,2” и MatePad 12 X поступили в продажу в России 9 ч.
Digma Pro выпустила ноутбуки Pactos на процессорах Intel Alder Lake и Ryzen 7000 9 ч.
256 Гбайт HBM3e — это хорошо, а 288 Гбайт — ещё лучше: AMD анонсировала ускорители Instinct MI325X и MI355X 10 ч.
Важнейший для полупроводниковой промышленности кварцевый рудник возобновил работу после урагана «Хелен» 10 ч.
Apple открыла в Китае крупнейшую за пределами США лабораторию, чтобы бороться с Huawei 11 ч.
Nvidia отметила 25-летие выпуска видеокарты GeForce 256 тематическим попкорном и коротеньким видео 11 ч.
Полноразмерные наушники HONOR CHOICE Headphones и Headphones Pro поступили в продажу в России 12 ч.
AMD Ryzen 7 9800X3D сможет работать с частотой 5,2 ГГц для всех ядер, показал ранний тест Cinebench R23 12 ч.
Dasung представила монитор с быстрой матрицей на цветных электронных чернилах — 33 Гц 12 ч.
Астрономы обнаружили кандидата в экзолуну — она похожа на вулканический спутник Юпитера Ио 14 ч.