Сегодня 29 апреля 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

GPT-4 освоил Red Dead Redemption 2, но его подводит машинное зрение

Группа исследователей из Китая и Сингапура научила ИИ на базе OpenAI GPT-4V играть в Red Dead Redemption 2 (RDR2). В своей статье они рассказали о концепции общего компьютерного контроля (General Computer Control, GCC) для ИИ, и о мультимодальном агенте CRADLE — интерфейсе между GPT-4V и RDR2. По их мнению, основные проблемы у игрового ИИ-агента возникли при использовании машинного зрения.

 Источник изображения: Rockstar

Источник изображения: Rockstar

Исследователи поставили своей целью заставить ИИ, работающий на базе OpenAI GPT-4V, взаимодействовать с компьютером, воспринимая визуальные и звуковые сигналы, как это делает среднестатистический человек-пользователь ПК. Проект даёт представление о том, насколько далеко продвинулись разработчики ИИ в движении в сторону создания общего (сильного) искусственного интеллекта (AGI).

Исследователи выбрали RDR2, так как она имеет «сложную систему управления черным ящиком, которая воплощает в себе самые требовательные компьютерные задачи и позволяет нам оценить границы производительности нашей платформы в таких виртуальных средах». Кроме того, такие элементы пользовательского интерфейса, как диалоги, уникальные значки, внутриигровые подсказки и инструкции, гарантируют, что никакие базовые знания не воспринимаются как нечто само собой разумеющееся, что отлично подходит для обучения ИИ. Исследователи утверждают, что управление игрой с помощью мыши и клавиатуры обеспечивает лучшую тренировку для GCC.

 Как устроен CRADLE / Источник изображения: arxiv.org

Как устроен CRADLE / Источник изображения: arxiv.org

Исследователи стремились продемонстрировать способность ИИ изучать игру с нуля (без доступа к какому-либо внутреннему состоянию игры или API), то есть как это делает человек. ИИ-агент «проходил» игру, перемещаясь по миру и выполняя задания, следуя основной сюжетной линии RDR2. В целом, CRADLE добился заметного успеха в RDR2. Он смог «последовательно выполнять все задачи основной сюжетной линии», за исключением миссии с ураганной перестрелкой, заданий, которые требуют исследования сложного внутреннего мира, и многоэтапных миссий с открытым финалом.

 Как CRADLE выполняет buhjdst задания / Источник изображения: arxiv.org

Как CRADLE выполняет игровые задания / Источник изображения: arxiv.org

Исследователи считают, что причиной некоторых повторяющихся трудностей, с которыми сталкивался CRADLE, является GPT4-V. По их мнению, «возможности пространственно-визуального распознавания GPT-4V недостаточны для точного детального контроля». GPT4-V не справился с концепциями, специфичными для предметной области, такими как уникальные значки в игре, с пониманием мини-карт, а также с общими препятствиями в игровой среде.

 Производительность CRADLE в разных типах миссий / Источник изображения: arxiv.org

Производительность CRADLE в разных типах миссий / Источник изображения: arxiv.org

Хотя опубликованная статья посвящена взаимодействию ИИ с RDR2, авторы утверждают, что предназначение системы CRADLE в рамках GCC гораздо шире: «для поддержки более широкого спектра игр, таких как игры-симуляторы и стратегии, а также различных программных приложений».

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме
Прежде чем оставить комментарий, пожалуйста, ознакомьтесь с правилами комментирования. Оставляя комментарий, вы подтверждаете ваше согласие с данными правилами и осознаете возможную ответственность за их нарушение.
Все комментарии премодерируются.
Комментарии загружаются...

window-new
Soft
Hard
Тренды 🔥
Цифровые археологи восстановили контроль над червём PlugX и выявили глобальную эпидемию 41 мин.
Из-за бага крестьяне в Manor Lords предпочитают оставаться бездомными — разработчик отреагировал 58 мин.
Выручка Yandex Cloud выросла в I квартале 2024 года на 58 % благодаря росту спроса на облачные сервисы 3 ч.
Microsoft стала рекламировать свои продукты при первом запуске Windows 11 после обновления 3 ч.
YouTube начал показывать рекламу во время паузы в видео — пока в тестовом режиме 4 ч.
Тень Tencent, затраты на ремейки Max Payne и прогресс Condor: создатели Alan Wake и Control отчитались о новых успехах 4 ч.
Avast вновь уличили в торговле данными пользователей 5 ч.
ЕС обязал Apple разрешить установку приложений на iPad в обход App Store 6 ч.
Инсайдер: Microsoft нацелилась выпустить Fallout 5 «как можно скорее» 7 ч.
Больше никаких 12345: в Великобритании запретят устройства со слабыми паролями 8 ч.
MediaTek представит 7 мая флагманский процессор Dimensity 9300+ с расширенными ИИ-функциями 19 мин.
Razer грозит штраф на $1,1 млн за обман с масками с RGB-подсветкой Zephyr — они не защищали от COVID-19 22 мин.
У «Хаббла» снова засбоил гироскоп — космический телескоп прекратил работу и перешёл в безопасный режим 34 мин.
В США разработали экологичные печатные платы vPCB, которые легко перерабатывать 37 мин.
Квартальная выручка Western Digital в облачном сегменте выросла более чем на четверть 3 ч.
Infinix представила геймерский смартфон GT 20 Pro с чипом Dimensity 8200 Ultimate и RGB-подсветкой 3 ч.
DJI представила бюджетный дрон Mini 4K — видео 4K и 31 минута полёта за $299 5 ч.
Sparkle выпустила белые видеокарты Arc A770 и A750 ROC OC Luna Edition на синих платах 5 ч.
Huawei проведёт глобальную презентацию 7 мая — ожидается анонс ноутбука, планшета и смарт-часов, но не смартфонов Pura 70 5 ч.
На этой неделе Китай запустит зонд для сбора образцов грунта с обратной стороны Луны 7 ч.