chat.gemini_3_1_flash_lite_preview
google/gemini-3-1-flash-lite

A Gemini 3.1 Flash-Lite API é o modelo Gemini 3.1 mais rápido e econômico do Google —— janela de contexto de 1M tokens, entrada nativa de texto/imagem/áudio/vídeo/PDF, function calling e saídas JSON estruturadas, otimizado para baixa latência e alto throughput. A Gemini 3.1 Flash-Lite API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e defina o modelo como gemini-3-1-flash-lite. Entrada a $0.2375 / 1M, saída a $1.425 / 1M, leituras em cache a $0.02375 / 1M —— 5% abaixo da tarifa oficial publicada, tudo por um endpoint REST.

Input
Gemini 3.1 Flash-Lite
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 3.1 Flash-Lite Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 3.1 Flash-Lite API: Chat

Use a Gemini 3.1 Flash-Lite API para executar o modelo Gemini 3.1 mais rápido e barato do Google: contexto de 1M tokens, entrada multimodal nativa e saídas estruturadas.

A Gemini 3.1 Flash-Lite API é o modelo Gemini 3.1 mais rápido e econômico do Google: uma janela de contexto de 1M tokens, entrada nativa para texto, imagens, áudio, vídeo e PDF, function calling e saídas JSON estruturadas, ajustado para baixa latência e alto throughput. Roteada pela RouterBase, a Gemini 3.1 Flash-Lite API é totalmente compatível com OpenAI: aponte qualquer SDK existente para a URL base da RouterBase, defina o modelo como gemini-3-1-flash-lite e a sua primeira chamada é processada na hora.

O preço é de $0.2375 / 1M tokens de entrada, $1.425 / 1M tokens de saída e $0.02375 / 1M leituras de entrada em cache: 5% abaixo da tarifa oficial publicada. Uma única chave da RouterBase, sem necessidade de credenciais do Google.

Por que este modelo

Seis motivos pelos quais equipes lançam na Gemini 3.1 Flash-Lite API

Da velocidade da geração mais recente ao preço com 5% de desconto: o que faz a Gemini 3.1 Flash-Lite API se destacar.

O Gemini 3.1 mais rápido e barato

A Gemini 3.1 Flash-Lite API é o modelo leve mais novo do Google, criado para o menor custo e o maior throughput da família Gemini 3.1.

Contexto de 1M tokens

Aceita até 1 milhão de tokens por requisição: documentos longos, código de múltiplos arquivos ou transcrições de vídeo cabem em uma única chamada à Gemini 3.1 Flash-Lite API sem fragmentação.

Entrada multimodal nativa

A Gemini 3.1 Flash-Lite API entende texto, imagens, áudio, vídeo e PDF. Envie mídia mista em uma única requisição para analisar, transcrever ou raciocinar entre modalidades.

Function calling e JSON

Defina ferramentas e solicite um schema JSON; a Gemini 3.1 Flash-Lite API retorna chamadas de ferramentas estruturadas e JSON estritamente válido para pipelines confiáveis de agentes e extração.

Endpoint compatível com OpenAI

A Gemini 3.1 Flash-Lite API fala o formato de chat-completions da OpenAI. Aponte qualquer SDK da OpenAI para a RouterBase: sem necessidade de SDK do Google nem credenciais separadas.

Uma chave para mais de 200 modelos

A mesma chave da RouterBase que chama a Gemini 3.1 Flash-Lite API também roteia para GPT-5, Claude Opus 4.8, Gemini 3.1 Pro e mais de 200 outros modelos, sem gerenciar credenciais por provedor.

RouterBase dashboard preview
Início rápido

Comece a usar a Gemini 3.1 Flash-Lite API em 3 passos

Do cadastro à sua primeira resposta em menos de 5 minutos.

  1. Crie uma chave de API da RouterBase

    Cadastre-se e gere uma chave de API: uma única chave alcança a Gemini 3.1 Flash-Lite API e todos os outros modelos do catálogo.

  2. Envie a sua primeira mensagem

    Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como gemini-3-1-flash-lite. A resposta segue o schema padrão de chat-completions, com suporte a streaming e entrada multimodal.

  3. Inspecione o uso

    Cada resposta inclui um detalhamento completo de tokens (entrada, saída e leitura de cache), de modo que o custo e a taxa de acerto de cache ficam visíveis em cada chamada.

Preços

Paga apenas pelo que usas

A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.

Histórias de clientes

O que as equipes constroem com a Gemini 3.1 Flash-Lite API

Cargas de produção reais rodando na Gemini 3.1 Flash-Lite API e no catálogo de modelos da RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

A Gemini 3.1 Flash-Lite API é o nosso padrão para alto volume: qualidade da geração mais recente, rápida e barata o suficiente para dispensar o carro-chefe na maioria das chamadas. O desconto de 5% da RouterBase é margem pura.

Priya Lakshmi
Priya LakshmiFounder, Quillo

O multimodal nativo da Gemini 3.1 Flash-Lite API lê vídeo e áudio diretamente: uma única chamada rápida transcreve e raciocina sobre o conteúdo em conjunto.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

As saídas JSON estruturadas da Gemini 3.1 Flash-Lite API acabaram com o nosso frágil parsing por regex. JSON estritamente válido sempre, zero retentativas.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Movemos a classificação e o roteamento para a Gemini 3.1 Flash-Lite API e a latência caiu enquanto a qualidade subiu. A RouterBase deixa tudo 5% mais barato e roteia ao redor de quedas automaticamente.

Jonas Keller
Jonas KellerIndie Developer

1M tokens de contexto a preços de Flash-Lite significa que posso jogar documentos inteiros nela de forma barata. A Gemini 3.1 Flash-Lite API simplesmente os processa rápido.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

A RouterBase coloca a Gemini 3.1 Flash-Lite API e mais de 200 outros modelos atrás de uma única chave. A nossa equipe parou de abrir solicitações de novas contas de provedores.

Sophia Martín
Sophia MartínCTO, Relay

Fazemos teste A/B da Gemini 3.1 Flash-Lite API contra o 3.1 Pro por requisição: o mesmo SDK, um único campo de modelo. A maior parte do tráfego fica no Flash-Lite e a conta caiu bruscamente.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Roteamos os nossos endpoints de alto volume para a Gemini 3.1 Flash-Lite API em um fim de semana. O único comentário no PR foi: 'espera, é só isso?'.

David Okonkwo
David OkonkwoCo-founder, Figment

A $0.2375 / 1M de entrada menos 5%, a Gemini 3.1 Flash-Lite API nos deu inferência multimodal da geração mais recente a um preço que escala. A conta do ROI foi instantânea.

Perguntas frequentes

Perguntas comuns sobre a Gemini 3.1 Flash-Lite API.

É o acesso direto da RouterBase ao Gemini 3.1 Flash-Lite do Google: o modelo Gemini 3.1 mais rápido e econômico do Google, com contexto de 1M tokens, entrada nativa de visão/áudio/vídeo, function calling e saídas estruturadas, servido por uma interface REST compatível com OpenAI.