Сегодня 01 июня 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Apple научит ИИ понимать интерфейсы приложений

Исследователи компании Apple опубликовали работу, в которой описали систему генеративного искусственного интеллекта Ferret-UI, предназначенную для распознавания интерфейсов мобильных приложений. С её помощью ИИ сможет без предварительного обучения понимать интерфейс разных приложений и взаимодействовать с ними.

 Источник изображения: Carl Heyerdahl / unsplash.com

Источник изображения: Carl Heyerdahl / unsplash.com

Ferret-UI представляет собой большую мультимодальную языковую модель (MLLM), характерная особенность которых — способность к обучению на самых разных материалах, включающих текст, изображения, видео- и аудиоконтент. MLLM пока плохо справляются с распознаванием интерфейсов приложений и тому есть множество причин, одна из которых — несоответствие пропорций используемых для обучения изображений соотношению сторон экрана типичного смартфона. Искусственный интеллект плохо понимает мелкие изображения, такие как значки и кнопки, а кроме того, для анализа интерфейса приложения ему необходимо с ним взаимодействовать. По словам исследователей, им уже удалось превзойти GPT-4V и другие специализирующиеся на анализе интерфейсов MLLM.

Сфера применения Ferret-UI описана довольно расплывчато. С одной стороны, Apple может делать это намеренно, дабы не подавать конкурентам идеи конкретных продуктов, с другой — исследователи разрабатывают технологии, а поиск возможностей их применения не входит в их задачи. Но есть очевидные варианты: например, с помощью Ferret-UI можно попробовать оценить эффективность пользовательского интерфейса или помочь слепым лучше понять происходящее на экране смартфона. Другим возможным применением нового ИИ может стать интеграция с Siri, благодаря чему последней можно будет отдавать команды для взаимодействия с приложениями, например, купить авиабилеты на определённое время и по указанному тарифу.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Хакер заставил GPT-4o работать в «режиме бога» — вообще без ограничений 28 мин.
Anthropic позволит создавать персональных помощников на базе ИИ-чат-бота Claude 2 ч.
ElevenLabs запустила ИИ-генератор звуковых эффектов по текстовому описанию 2 ч.
Новая статья: Songs of Conquest — песнь величия. Рецензия 13 ч.
В ранний доступ Steam ворвался олдскульный шутер Selaco на движке классических Doom — с перестрелками и умными врагами в духе F.E.A.R. 16 ч.
Warhorse официально подтвердила перевод на русский язык в Kingdom Come: Deliverance 2 17 ч.
Perplexity AI превратит поисковую выдачу в веб-страницу, которой удобно делиться с другими 17 ч.
Google добавила редактирование RCS-сообщений и другие полезные функции в Android 18 ч.
Эндгейм подкрался незаметно: авторы перспективного «дьяблоида» Wolcen: Lords of Mayhem решили забросить разработку всего через четыре года после релиза 18 ч.
Глава Take-Two Interactive уклонился от ответа, выйдет ли GTA VI на ПК 19 ч.
Новые спутники Starlink могут уничтожить радиоастрономию на Земле, предупреждают учёные 60 мин.
Корейский профсоюз Samsung объявил забастовку, но на производство и поставки памяти это не повлияет 2 ч.
Последний «дружественный» поставщик VSAT-оборудования Gilat Satellite Networks приостановил работу в РФ 2 ч.
Samsung проиграла Huawei и больше не первая по продажам складных смартфонов в мире 2 ч.
Минцифры предлагает выдавать льготные кредиты для строительства ЦОД 2 ч.
Госархив РФ построит в Калужской области дата-центр за 1 млрд руб., оснастив его российскими серверами и СХД Depo 2 ч.
В метеорите с Марса учёные разглядели образ древней Земли 3 ч.
Blackview выпустила защищённый смартфон Oscal Pilot 2 с двумя экранами и мини-ПК MP100 с мощной начинкой 3 ч.
Робот-пылесос Dreame D9 Max и вертикальный беспроводной пылесос R20 обеспечат качественную и быструю уборку 4 ч.
Samsung будет выпускать для AMD передовые 3-нм чипы с GAA-транзисторами 4 ч.