O Google lançou um novo modelo de IA projetado para oferecer alto desempenho com foco na eficiência. Ele se chama Gemini 2.5 Flash e em breve estará disponível como parte da plataforma Vertex AI do Google Cloud para implantação e gerenciamento de modelos de inteligência artificial (IA).

Fonte da imagem: Google

A empresa observa que o Gemini 2.5 Flash oferece computação “dinâmica e controlada”, permitindo que os desenvolvedores ajustem o tempo de processamento das solicitações com base na complexidade delas.

«Você pode personalizar a velocidade, a precisão e o equilíbrio de custos para atender às suas necessidades específicas. Essa flexibilidade é essencial para otimizar o desempenho do Flash em aplicativos de alta carga e com alto custo”, escreveu a empresa em seu blog oficial.

Com o aumento do custo de execução dos principais modelos de IA, o Gemini 2.5 Flash pode ser extremamente útil. Modelos mais baratos e potentes, como o 2.5 Flash, são uma alternativa atraente às opções caras dos carros-chefes, mas ao custo de perder um pouco de precisão.

O Gemini 2.5 Flash é um modelo de “raciocínio” semelhante ao o3-mini da OpenAI e ao R1 da DeepSeek. Isso significa que ela demora um pouco mais para verificar os fatos e responder às perguntas. O Google diz que o Flash 2.5 é ideal para trabalhar com grandes quantidades de dados e para uso em tempo real, especialmente para tarefas como atendimento ao cliente e análise de documentos.

«Este modelo de trabalho é otimizado especificamente para baixa latência e baixos custos. “É um mecanismo ideal para assistentes virtuais responsivos e ferramentas de resumo em tempo real, onde a eficiência em escala é fundamental”, descreve a empresa sobre o novo modelo de IA.

O Google não publicou um relatório de segurança ou especificações técnicas para o Gemini 2.5 Flash, o que dificulta determinar seus pontos fortes e fracos. A empresa disse anteriormente que não publica relatórios para modelos que considera experimentais.

O Google também anunciou que planeja integrar modelos Gemini, como o 2.5 Flash, em ambientes locais a partir do terceiro trimestre. Eles estarão disponíveis no Google Distributed Cloud (GDC), a solução local do Google para clientes com requisitos rigorosos de governança de dados. A empresa acrescentou que está trabalhando com a Nvidia para implementar o Gemini em sistemas Nvidia Blackwell compatíveis com GDC, que os clientes podem comprar pelo Google ou por seus próprios canais.

avalanche

Postagens recentes

A Xiaomi confirmou que lançará um novo processador proprietário da série Xring ainda este ano.

A Xiaomi confirmou oficialmente que lançará um novo processador móvel proprietário, o Xring, para smartphones…

2 horas atrás

Blocos de cobre impressos em 3D para melhorar a eficiência energética de data centers.

Pesquisadores americanos da Universidade de Illinois em Urbana-Champaign (UIUC) desenvolveram uma nova tecnologia para a…

3 horas atrás

A fabricante japonesa de chips TSMC anunciou lucro pela primeira vez, apenas um ano após o início da produção em massa.

A subsidiária da TSMC em Kumamoto, no Japão, registrou lucro pela primeira vez. A joint…

3 horas atrás

Testes de desempenho revelaram por que a Intel não lançou o Core Ultra 9 290K Plus: é inútil.

A Intel nunca lançou o processador Core Ultra 9 290K Plus em sua linha atualizada…

4 horas atrás

A Microsoft expandiu o suporte para a tecnologia Advanced Shader Delivery para placas gráficas AMD.

A Microsoft expandiu a lista de dispositivos compatíveis com o Advanced Shader Delivery (ASD), que…

4 horas atrás

O CEO da Samsung pediu desculpas aos clientes pelo impacto da greve, que ainda não começou.

O presidente da Samsung Electronics, Lee Jae-yong, pediu desculpas aos clientes da empresa em todo…

6 horas atrás