ÚLTIMAS NOTÍCIAS

Google apresenta Gemini 3.1 Flash-Lite: foco em velocidade e eficiência

O Google oficializou nesta terça-feira (3) o Gemini 3.1 Flash-Lite, uma evolução focada em eficiência, baixo custo e respostas imediatas. O modelo foi desenhado especificamente para aplicações onde a velocidade de processamento e o orçamento são fatores críticos, sendo a opção multimodal mais econômica da empresa até o momento.

O que o Gemini 3.1 Flash-Lite entrega?

A nova versão da família Gemini 3 Flash foi otimizada para “tarefas simples em larga escala”. Segundo o Google, o modelo é ideal para empresas que precisam gerenciar fluxos constantes de dados sem perder a agilidade.

Principais aplicações:

  • Atendimento e Suporte: Gestão de chatbots, triagem de tíquetes e análise de mensagens em tempo real.
  • Processamento de Áudio: Conversão rápida de gravações e conteúdos sonoros em texto (transcrição).
  • Extração de Dados: Coleta simplificada de informações em avaliações de clientes e documentos.
  • Resumos Rápidos: Triagem e síntese de arquivos para fluxos de trabalho ágeis.

Performance e Comparativos

O salto de desempenho é o grande diferencial desta atualização. Em comparação ao Flash 2.5, o novo modelo é 2,5 vezes mais rápido na entrega do primeiro token e apresenta um ganho de 45% na velocidade de saída de texto.

Nos testes de mercado (benchmarking), o Gemini 3.1 Flash-Lite superou concorrentes diretos, como o GPT-5 mini, Claude 4.5 Haiku e Grok 4.1 Fast, destacando-se não apenas pela rapidez, mas pela precisão em seguir instruções complexas.

Preços e Disponibilidade

O modelo já está disponível em versão prévia para desenvolvedores através da API Gemini (Google AI Studio) e para clientes corporativos via Vertex AI.

A estratégia de preços é agressiva, posicionando-o como a escolha mais barata da linha:

  • Entrada: US$ 0,25 (aprox. R$ 1,32) por 1 milhão de tokens.
  • Saída: US$ 1,50 (aprox. R$ 7,92) por 1 milhão de tokens.

WhatsApp