Aplicação ChatGPT para iOS ganha nova funcionalidade de gestos para facilitar o envio de fotos recentes nas conversas.

Como uma nova geração de assistente de pesquisa visual, ChatGPT otimizou novamente o fluxo de utilização no ecossistema iOS esta semana, permitindo que os utilizadores adicionem fotos recentes nas conversas de forma mais rápida. Anteriormente, os utilizadores tinham de clicar no botão +, escolher “Photos” e depois selecionar a partir do álbum. Embora este processo não fosse complicado, ainda assim interrompia o ritmo natural da conversa quando era necessário fazer o upload rápido de várias fotos ou ligar múltiplas pesquisas visuais. OpenAI foi alertada por Adam Fry na comunidade, que agora basta pressionar longamente o botão + à esquerda da caixa de diálogo para chamar o painel de seleção rápida das quatro fotos mais recentes do sistema; ao selecionar uma delas, a foto é anexada à conversa, permitindo que a questão seja colocada diretamente ou que seja incluída no prompt. O lançamento deste novo gesto surge juntamente com outras melhorias desta semana, como a captura mais precisa da hora atual, a melhoria da velocidade de carregamento e resposta de longas conversas na versão web, e a oferta de atualizações de interface mais claras enquanto se aguarda a conexão à internet. Esta onda de mudanças demonstra que a OpenAI está a reduzir a barreira para consultas visuais diárias com um design de interação mais intuitivo, permitindo que os utilizadores realizem pesquisas visuais rápidas sem interromper o fluxo da conversa.

No que diz respeito ao fundo, a funcionalidade de Inteligência Visual já está em funcionamento no sistema iOS há quase dois anos, mas atualmente apenas suporta modelos de iPhone relativamente novos e ainda apresenta limitações na cobertura geográfica global. Para os utilizadores que dependem do ChatGPT para realizar pesquisas visuais semelhantes, o novo gesto oferece uma alternativa mais imediata: sem necessidade de mudar de interface ou selecionar manualmente, é possível enviar rapidamente as fotos mais recentes diretamente na caixa de conversa, tornando as consultas mais próximas do contexto real. Esta alteração demonstra a importância que a OpenAI atribui ao “contexto visual” e estende uma experiência de interação mais fluida entre dispositivos. Comparado com os processos anteriores, esta abordagem pode aumentar a eficiência no dia a dia, especialmente em tarefas que requerem uma rápida comparação entre a aparência física e a descrição textual.

Novo gesto torna as consultas visuais do ChatGPT mais intuitivas e impulsiona o ritmo da colaboração entre dispositivos

Além disso, esta atualização não se foca apenas no upload rápido, mas também permite que os utilizadores completem todo o processo, desde “selecionar fotos” até “fazer perguntas relacionadas com a imagem”, na mesma tela. Durante a operação, os utilizadores pressionam longamente o botão +, e o sistema mostra as quatro fotos mais recentes; em seguida, ao clicar em qualquer uma delas, ela é adicionada à conversa como um anexo, permitindo que os utilizadores insiram diretamente comandos, descrevam detalhes ou façam perguntas específicas sobre o conteúdo da foto na caixa de diálogo. O núcleo deste design reside na redução da carga cognitiva, permitindo que os utilizadores não precisem alternar entre múltiplas interfaces para rapidamente estabelecer cenários de consulta centrados em imagens. Além disso, se as fotos forem de múltiplos momentos, a seleção rápida das mais recentes também ajuda a comparar e raciocinar de forma eficiente, sendo especialmente útil em situações do dia a dia como compras, edição de fotos e planeamento de viagens. Isto demonstra que a OpenAI continua a ser orientada para os cenários dos utilizadores, promovendo a popularização da pesquisa de imagens através de operações mais intuitivas.

A atualização atual também foca na performance e estabilidade, além de melhorar a resposta em tempo real da interface frontal, a velocidade de processamento de longas conversas na versão web também foi aprimorada. Para situações que exigem a citação ou comparação contínua de múltiplos conteúdos visuais na conversa, estas otimizações podem reduzir significativamente o tempo de espera, tornando a experiência geral mais fluida. Indicadores de espera de conexão mais claros significam que os utilizadores podem compreender mais rapidamente o estado atual, mesmo quando a internet está instável, evitando confusões causadas por atrasos na exibição. Estas mudanças apontam todas na mesma direção: o ChatGPT está a melhorar a utilidade em cenários diários de trabalho e entretenimento com um design mais robusto e intuitivo para consultas visuais digitais.

No que diz respeito à cobertura geográfica e de dispositivos, embora a velocidade de disseminação da Inteligência Visual esteja limitada por dispositivos e regiões, a OpenAI continua a investir na otimização do suporte e da experiência do utilizador. Para os utilizadores, se for possível alcançar um suporte mais amplo de dispositivos e uma sincronização mais rápida entre dispositivos nas futuras atualizações, a utilidade e acessibilidade das consultas visuais aumentarão significativamente. Esta série de melhorias da OpenAI também pode incentivar a comunidade de desenvolvedores a integrar referências de diálogo visual mais naturais em aplicações de terceiros, expandindo ainda mais os cenários de trabalho e entretenimento do “ver é entender”.

Comparação e Perspectivas: Diferenças em relação a outras IAs semelhantes e direções futuras

Conteúdo original
Este artigo é a versão em português de um conteúdo original do TechRitual.
Stein Yep
Stein Yep