chat.gemini_3_1_pro_preview
google/gemini-3-1-pro-preview

A Gemini 3.1 Pro API é o modelo multimodal de raciocínio principal do Google —— janela de contexto de 1M tokens, entrada nativa de texto/imagem/áudio/vídeo/PDF, raciocínio avançado, function calling e saídas JSON estruturadas. A Gemini 3.1 Pro API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e defina o modelo como gemini-3-1-pro-preview. Entrada a $1.40 / 1M, saída a $8.40 / 1M, leituras em cache a $0.14 / 1M —— 5% abaixo da taxa padrão (taxa base para prompts de até 200K tokens), tudo por um endpoint REST.

Input
Gemini 3.1 Pro (Preview)
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 3.1 Pro (Preview) Online
Hi! I'm a helpful AI assistant. What can I do for you?

API do Gemini 3.1 Pro: Chat

Use a Gemini 3.1 Pro API para rodar o modelo multimodal de raciocínio carro-chefe do Google com uma janela de contexto de 1M de tokens.

A Gemini 3.1 Pro API é o modelo Gemini Pro carro-chefe do Google: uma janela de contexto de 1M de tokens, entrada multimodal nativa (texto, imagens, áudio, vídeo, PDF), raciocínio avançado, function calling e saídas estruturadas em JSON. Roteada pela RouterBase, é totalmente compatível com a OpenAI: aponte qualquer SDK existente para a URL base da RouterBase, defina o modelo como gemini-3-1-pro-preview e a sua primeira chamada já é processada na hora.

O preço é de $1.40 / 1M de tokens de entrada, $8.40 / 1M de tokens de saída e $0.14 / 1M de leituras de entrada em cache, 5% abaixo da tarifa padrão. A tarifa base se aplica a prompts de até 200K tokens. Uma única chave RouterBase, sem precisar de credenciais do Google.

Por que este modelo

Seis motivos pelos quais as equipes entregam com a Gemini 3.1 Pro API

Do contexto multimodal de 1M de tokens ao preço com 5% de desconto: o que faz o Gemini 3.1 Pro se destacar.

Contexto de 1M de tokens

Aceita até 1 milhão de tokens por requisição (tarifa base para prompts de até 200K): bases de código inteiras, documentos longos ou transcrições de vídeo cabem em uma única chamada à Gemini 3.1 Pro API.

Entrada multimodal nativa

A Gemini 3.1 Pro API entende texto, imagens, áudio, vídeo e PDF. Passe mídia mista em uma única requisição para analisar, transcrever ou raciocinar entre modalidades.

Raciocínio avançado

O Gemini 3.1 Pro pensa antes de responder, alocando computação extra para problemas difíceis: forte em matemática de várias etapas, programação e análises complexas.

Function calling e JSON

Defina ferramentas e solicite um esquema JSON; a Gemini 3.1 Pro API retorna chamadas de ferramentas estruturadas e JSON estritamente válido para pipelines confiáveis de agentes e extração.

Endpoint compatível com OpenAI

A Gemini 3.1 Pro API fala o formato de chat-completions da OpenAI. Aponte qualquer SDK da OpenAI para a RouterBase: sem SDK do Google nem credenciais à parte.

Uma chave para mais de 200 modelos

A mesma chave RouterBase que chama a Gemini 3.1 Pro API também roteia para GPT-5, Claude Opus 4.8, GPT-4o mini e mais de 200 outros modelos: sem gerenciar credenciais por provedor.

RouterBase dashboard preview
Início rápido

Comece com a Gemini 3.1 Pro API em 3 passos

Do cadastro à sua primeira resposta em menos de 5 minutos.

  1. Crie uma chave de API da RouterBase

    Cadastre-se e gere uma chave de API: uma única chave alcança a Gemini 3.1 Pro API e todos os outros modelos do catálogo.

  2. Envie sua primeira mensagem

    Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como gemini-3-1-pro-preview. A resposta segue o esquema padrão de chat-completions, com suporte a streaming e entrada multimodal.

  3. Inspecione o uso

    Cada resposta inclui um detalhamento completo de tokens (entrada, saída e leituras de cache), de modo que o custo e a taxa de acertos de cache ficam visíveis em cada chamada.

Preços

Paga apenas pelo que usas

A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.

Histórias de clientes

O que as equipes constroem com a Gemini 3.1 Pro API

Cargas reais de produção rodando sobre a Gemini 3.1 Pro API e o catálogo de modelos da RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

A Gemini 3.1 Pro API processa nossos conjuntos de documentos de 800K tokens em uma única chamada: sem fragmentação, sem cola de recuperação. O contexto de 1M mudou a forma como construímos.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Alimentamos vídeo e PDF direto na Gemini 3.1 Pro API: uma única chamada multimodal substituiu três pipelines separados.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Migrar para a Gemini 3.1 Pro API foi uma mudança de duas linhas pela RouterBase. A qualidade do raciocínio deu um salto e os 5% de desconto são margem pura.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

O raciocínio do Gemini 3.1 Pro resolveu tarefas de planejamento que nosso modelo anterior nem conseguia encostar. A precisão subiu 31% no nosso benchmark interno.

Jonas Keller
Jonas KellerIndie Developer

Um milhão de tokens de contexto significa que posso jogar um repositório inteiro mais a documentação na Gemini 3.1 Pro API. Acabou a cola de fragmentação.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

A RouterBase coloca a Gemini 3.1 Pro API e mais de 200 outros modelos atrás de uma única chave. Nossa equipe parou de abrir solicitações de novas contas de provedores.

Sophia Martín
Sophia MartínCTO, Relay

As saídas estruturadas em JSON da Gemini 3.1 Pro API acabaram com nosso parsing instável: JSON estritamente válido sempre, mesmo em entradas multimodais.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Migramos 42 serviços para a Gemini 3.1 Pro API em um fim de semana. O único comentário no PR foi 'peraí, é só isso?'.

David Okonkwo
David OkonkwoCo-founder, Figment

As leituras de cache a $0.14 / 1M na Gemini 3.1 Pro API tornaram acessíveis nossos recursos de contexto longo. A conta do ROI foi instantânea.

Perguntas frequentes

Perguntas comuns sobre a Gemini 3.1 Pro API.

É o acesso direto da RouterBase ao Gemini 3.1 Pro do Google: um endpoint de chat multimodal carro-chefe com contexto de 1M de tokens, raciocínio avançado, entrada nativa de visão/áudio/vídeo, function calling e saídas estruturadas, servido por uma interface REST compatível com OpenAI.