A Google acabou de dar mais um passo gigante no mundo da inteligência artificial. O seu famoso assistente Gemini recebeu uma atualização que promete mudar por completo a forma como a plataforma lida com conteúdos multimédia pesados.
Até agora, a análise de vídeo por parte destas ferramentas era um processo moroso e dispendioso, dissecando cada segundo de gravação como se fosse uma simples imagem estática. Felizmente, os engenheiros da gigante tecnológica decidiram criar uma solução consideravelmente mais eficiente.
Com a introdução do que a marca apelida de compreensão de vídeo agêntica, o cenário muda de figura. Vais poder atirar-lhe vídeos com várias horas e o assistente não vai sequer suar para te dar todas as respostas de que precisas.

O que muda na forma como o Gemini vê vídeos
O grande segredo desta novidade é a capacidade de o Gemini decidir, de forma autónoma, o que deve observar e a que velocidade. Em vez de partir o vídeo frame a frame às cegas, o modelo cruza agora imagens, áudio e transcrições para ir direto ao assunto, atuando como um verdadeiro realizador digital a trabalhar em exclusivo para ti.
Na prática, isto traduz-se numa poupança incrível de recursos informáticos. A Google garante que o consumo de tokens cai até uns impressionantes 88%, tudo enquanto a precisão da ferramenta ainda sobe ligeiramente. É no mínimo impressionante e até um pouco assustador ver uma tecnologia ficar simultaneamente tão mais barata e inteligente de um dia para o outro.
Esta autêntica magia está a ser aplicada diretamente aos modelos mais recentes, nomeadamente o Gemini 3.7 Flash, o 3.6 Flash e o mais modesto 3.5 Flash-Lite. A inteligência artificial consegue agora detetar alterações que ocorrem numa fração de segundo, provando que os dias de uma análise superficial e lenta ficaram definitivamente para trás.

As novas capacidades que vão facilitar a tua rotina
Se já utilizas a inteligência artificial para otimizar o teu trabalho ou os teus momentos de lazer, vais perceber de imediato o potencial tremendo desta atualização. Imagina não teres de ver um longo tutorial aborrecido de três horas apenas para encontrar um passo específico ou uma informação solta.
Com esta compreensão avançada e contextualmente rica, o teu assistente passa a conseguir extrair dados de forma quase cirúrgica. Eis algumas das novas proezas técnicas que podes exigir ao Gemini:
- Responder a perguntas complexas cruzando informações de vídeos com várias horas de duração.
- Localizar e inspecionar rapidamente defeitos visuais e artefactos nas imagens.
- Contar objetos distintos que apareçam de forma aleatória ao longo da gravação.
- Rastrear o movimento físico de pessoas ou de elementos específicos na cena.
Para já, se fores um simples curioso, terás de ter um pouco de paciência para testar esta inovação. A funcionalidade encontra-se apenas disponível através da API do Gemini e em plataformas empresariais. Contudo, a gigante norte-americana já assegurou que a novidade vai chegar à aplicação oficial muito em breve, alimentando ainda o recurso Ask YouTube para ajudar criadores e espetadores a domarem vídeos longos sem qualquer esforço.
Outros artigos interessantes:



