AI Times publicó un análisis de Yongduck Kim sobre la interfaz multimodal de OpenAI y la evolución de la interacción con los LLM.
La patente analizada es una técnica para crear una respuesta de lenguaje natural basada en un contexto visual, reconociendo el comportamiento del usuario como una entrada al LLM, como hacer clic o arrastrar un área específica en la imagen. La patente estadounidense US 12,039,431 B1 registrada por OpenAI describe una estructura de interacción multimodal que maneja el texto, las imágenes y el usuario de la interfaz de usuario integrada.
El agente de patentes Yongduck Kim explicó con facilidad y claridad el contenido técnico de la patente e introdujo el potencial de uso en una variedad de industrias como la salud, la educación y el comercio.
Usted puede encontrar el artículo completo en el enlace de abajo.
Contribuciones de comprobación
Este artículo del archivo refleja la situación en su fecha de publicación. Contacte con el despacho para analizar su caso.
