OpenAI lança recurso de processamento visual em tempo real para inteligência artificial

Foto: Divulgação/OpenAI

A OpenAI anunciou uma nova etapa evolutiva para seus modelos de linguagem com a liberação de um sistema avançado de processamento visual contínuo. A atualização permite que a inteligência artificial analise o que acontece na câmera do celular em tempo real, sem a necessidade de o usuário capturar fotos estáticas.

O recurso funciona de maneira fluida, mantendo a câmera aberta enquanto o usuário conversa com o aplicativo. A IA consegue identificar objetos em movimento, ler expressões e interpretar mudanças de cenário com uma latência descrita pela empresa como "na casa dos milissegundos".

Durante demonstrações, a ferramenta foi utilizada para traduzir placas de rua instantaneamente enquanto uma pessoa caminhava e para fornecer instruções de montagem de um móvel acompanhando os movimentos das mãos do usuário.

A novidade tem potencial para alterar a forma como os usuários interagem com assistentes virtuais em dispositivos móveis, aproximando a experiência da computação espacial. O sistema processa os dados localmente de forma parcial para garantir velocidade, conectando-se aos servidores em nuvem apenas para a interpretação complexa.

A atualização começa a ser distribuída gradualmente nesta semana para assinantes das versões pagas do serviço, estando disponível inicialmente apenas para dispositivos iOS e Android de última geração.

Fontes consultadas nesta matéria:

Esta matéria foi produzida com apoio de inteligência artificial e revisada por um jornalista antes da publicação.