В AI Times опубликован анализ патента OpenAI на автоматизацию графического пользовательского интерфейса, подготовленный патентным поверенным Ким Ёндоком.
Этот анализ представляет собой мультимодальную технологию взаимодействия, которая может одновременно понимать ввод текста и изображения пользователя, идентифицировать и визуально выделять конкретные элементы в изображении или выполнять реальные операции на графическом интерфейсе. С патентом США US 12 051 205 B1, зарегистрированным OpenAI, языковая модель описывает техническую структуру, которая непосредственно манипулирует и реагирует на графическую среду, как если бы она была пользователем.
В этой статье патентный поверенный Ким Ёндок подробно объяснил эволюцию систем ИИ, которые могут выполнять визуальные и поведенческие взаимодействия, такие как щелчки мышью, выделение и редактирование изображений на реальном графическом интерфейсе. В частности, мы проанализировали, как эта технология может быть применена в различных отраслях, включая улучшение доступности, редактирование изображений и учебный контент, а также виртуальных помощников.
Полную статью вы можете найти по ссылке ниже.
Проверка взносов
Материал отражает ситуацию на дату публикации. Обратитесь в IPLEX, чтобы обсудить обстоятельства вашего дела.
