Gemini Conquista Novo Patamar: Lê Tela do Computador e Responde Perguntas
O Google anunciou uma atualização significativa para o aplicativo Gemini no macOS, que inclui um modo de voz capaz de entender o que está sendo exibido na tela do computador. Com essa novidade, a inteligência artificial pode responder a perguntas, resumir informações e editar textos com base no conteúdo visível, sem que o usuário precise copiar e colar trechos no chatbot.
Para ativar essa funcionalidade, o usuário deve pressionar e segurar a tecla fn do Mac enquanto fala. A partir daí, o Gemini pode analisar o contexto do aplicativo aberto e executar ações no local em que o cursor está posicionado. Isso significa que é possível pedir para resumir anotações de uma reunião, reescrever um e-mail ou organizar um documento sem trocar de janela.
Além disso, a atualização também aprimora o ditado por voz, removendo automaticamente pausas e expressões como 'hã' e 'ah' para gerar um texto mais limpo. O Google garante que a leitura da tela é opcional e pode ser desativada para que o usuário decida quando a IA poderá analisar o conteúdo exibido.
Essa é mais uma demonstração da capacidade do Gemini em evoluir e melhorar a experiência do usuário, como já mostramos em nossas coberturas anteriores sobre o desenvolvimento do painel de personalização de voz para o Gemini e sua aplicação no mercado de compras com inteligência artificial.
A nova experiência de voz começou a ser distribuída para todos os usuários do aplicativo Gemini no macOS, inicialmente apenas em inglês. O Google afirmou que o suporte a outros idiomas será lançado ainda este ano, mas não divulgou uma data específica para a expansão. Até lá, usuários que utilizam o aplicativo em outros idiomas precisarão aguardar para acessar a novidade.
Com informacoes de Canaltech.

