chat.gemini_3_1_flash_lite_preview
google/gemini-3-1-flash-lite

Die Gemini 3.1 Flash-Lite API ist Googles schnellstes, kosteneffizientestes Gemini-3.1-Modell —— ein 1M-Token-Kontextfenster, native Eingabe für Text/Bild/Audio/Video/PDF, Function Calling und strukturierte JSON-Ausgaben, optimiert für niedrige Latenz und hohen Durchsatz. Die Gemini 3.1 Flash-Lite API ist OpenAI-kompatibel: Richten Sie ein bestehendes SDK auf RouterBase und setzen Sie das Modell auf gemini-3-1-flash-lite. Eingabe $0.2375 / 1M, Ausgabe $1.425 / 1M, Cache-Lesezugriffe $0.02375 / 1M —— 5% unter dem offiziell veröffentlichten Tarif, alles über einen REST-Endpunkt.

Input
Gemini 3.1 Flash-Lite
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 3.1 Flash-Lite Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 3.1 Flash-Lite API: Chat

Nutzen Sie die Gemini 3.1 Flash-Lite API, um Googles schnellstes und günstigstes Gemini 3.1-Modell auszuführen — mit 1M-Token-Kontext, nativer multimodaler Eingabe und strukturierten Ausgaben.

Die Gemini 3.1 Flash-Lite API ist Googles schnellstes und kosteneffizientestes Gemini 3.1-Modell — mit einem 1M-Token-Kontextfenster, nativer Eingabe für Text, Bilder, Audio, Video und PDF, function calling und strukturierten JSON-Ausgaben, optimiert für niedrige Latenz und hohen Durchsatz. Über RouterBase geroutet, ist die Gemini 3.1 Flash-Lite API vollständig OpenAI-kompatibel: Richten Sie ein beliebiges vorhandenes SDK auf die Basis-URL von RouterBase, setzen Sie das Modell auf gemini-3-1-flash-lite, und Ihr erster Aufruf geht sofort durch.

Die Preise betragen $0.2375 / 1M Eingabe-Token, $1.425 / 1M Ausgabe-Token und $0.02375 / 1M Reads für zwischengespeicherte Eingaben — 5% unter dem offiziell veröffentlichten Tarif. Ein RouterBase-Schlüssel — keine Google-Anmeldedaten erforderlich.

Warum dieses Modell

Sechs Gründe, warum Teams auf die Gemini 3.1 Flash-Lite API setzen

Von der Geschwindigkeit der neuesten Generation bis zu 5% Preisnachlass — was die Gemini 3.1 Flash-Lite API auszeichnet.

Schnellstes, günstigstes Gemini 3.1

Die Gemini 3.1 Flash-Lite API ist Googles neuestes leichtgewichtiges Modell — gebaut für die niedrigsten Kosten und den höchsten Durchsatz in der Gemini 3.1-Familie.

1M-Token-Kontext

Akzeptiert bis zu 1 Million Token pro Anfrage — lange Dokumente, mehrteiliger Code oder Videotranskripte passen in einen einzigen Gemini 3.1 Flash-Lite API-Aufruf ohne Chunking.

Native multimodale Eingabe

Die Gemini 3.1 Flash-Lite API versteht Text, Bilder, Audio, Video und PDFs. Übergeben Sie gemischte Medien in einer Anfrage, um über Modalitäten hinweg zu analysieren, zu transkribieren oder zu schlussfolgern.

Function calling & JSON

Definieren Sie Tools und fordern Sie ein JSON-Schema an; die Gemini 3.1 Flash-Lite API liefert strukturierte Tool-Aufrufe und streng gültiges JSON für zuverlässige Agenten- und Extraktions-Pipelines.

OpenAI-kompatibler Endpunkt

Die Gemini 3.1 Flash-Lite API spricht das OpenAI-Chat-Completions-Wire-Format. Richten Sie ein beliebiges OpenAI-SDK auf RouterBase — kein Google-SDK und keine separaten Anmeldedaten nötig.

Ein Schlüssel für 200+ Modelle

Derselbe RouterBase-Schlüssel, der die Gemini 3.1 Flash-Lite API aufruft, routet auch zu GPT-5, Claude Opus 4.8, Gemini 3.1 Pro und 200+ weiteren Modellen — keine anbieterspezifische Verwaltung von Anmeldedaten.

RouterBase dashboard preview
Schnellstart

Starten Sie mit der Gemini 3.1 Flash-Lite API in 3 Schritten

Von der Anmeldung bis zur ersten Antwort in unter 5 Minuten.

  1. Erstellen Sie einen RouterBase-API-Schlüssel

    Melden Sie sich an und generieren Sie einen API-Schlüssel — ein Schlüssel erreicht die Gemini 3.1 Flash-Lite API und jedes andere Modell im Katalog.

  2. Senden Sie Ihre erste Nachricht

    Richten Sie ein beliebiges OpenAI-kompatibles SDK auf routerbase.com/v1 und setzen Sie das Modell auf gemini-3-1-flash-lite. Die Antwort folgt dem Standard-Chat-Completions-Schema — Streaming und multimodale Eingabe werden unterstützt.

  3. Überprüfen Sie die Nutzung

    Jede Antwort enthält eine detaillierte Token-Aufschlüsselung — Eingabe-, Ausgabe- und Cache-Read-Token — sodass Kosten und Cache-Trefferquote bei jedem Aufruf sichtbar sind.

Preise

Nur für die Nutzung zahlen

RouterBase reicht Partner-Tier-Preise durch. Verglichen mit dem offiziellen API-Tarif des Modells.

Kundengeschichten

Was Teams mit der Gemini 3.1 Flash-Lite API bauen

Echte Produktionslasten, die auf der Gemini 3.1 Flash-Lite API und dem RouterBase-Modellkatalog laufen.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Die Gemini 3.1 Flash-Lite API ist unser Standard für hohes Volumen — Qualität der neuesten Generation, schnell und günstig genug, um bei den meisten Aufrufen auf das Flaggschiff zu verzichten. Der 5%-RouterBase-Rabatt ist reine Marge.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Natives Multimodal auf der Gemini 3.1 Flash-Lite API liest Video und Audio direkt — ein schneller Aufruf transkribiert und schlussfolgert über den Inhalt zusammen.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Strukturierte JSON-Ausgaben der Gemini 3.1 Flash-Lite API haben unser fehleranfälliges Regex-Parsing beendet. Streng gültiges JSON jedes Mal, null Wiederholungen.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Wir haben Klassifizierung und Routing auf die Gemini 3.1 Flash-Lite API verlagert, und die Latenz sank, während die Qualität stieg. RouterBase macht es 5% günstiger und routet automatisch um Ausfälle herum.

Jonas Keller
Jonas KellerIndie Developer

1M Token Kontext zu Flash-Lite-Preisen bedeutet, dass ich ihr ganze Dokumente günstig zuwerfen kann. Die Gemini 3.1 Flash-Lite API verarbeitet sie einfach schnell.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase stellt die Gemini 3.1 Flash-Lite API und 200+ weitere Modelle hinter einen Schlüssel. Unser Team hat aufgehört, Anträge für neue Anbieter-Konten zu stellen.

Sophia Martín
Sophia MartínCTO, Relay

Wir testen die Gemini 3.1 Flash-Lite API per Anfrage im A/B-Verfahren gegen 3.1 Pro — dasselbe SDK, ein Modellfeld. Der meiste Traffic bleibt auf Flash-Lite und die Rechnung sank stark.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Wir haben unsere Endpunkte mit hohem Volumen an einem Wochenende auf die Gemini 3.1 Flash-Lite API umgeleitet. Der einzige PR-Kommentar war 'Moment, das war's schon?'.

David Okonkwo
David OkonkwoCo-founder, Figment

Bei $0.2375 / 1M Eingabe minus 5% lieferte uns die Gemini 3.1 Flash-Lite API multimodale Inferenz der neuesten Generation zu einem Preis, der skaliert. Die ROI-Rechnung war sofort klar.

Häufig gestellte Fragen

Häufige Fragen zur Gemini 3.1 Flash-Lite API.

Es ist der Pass-Through von RouterBase zu Googles Gemini 3.1 Flash-Lite — Googles schnellstem und kosteneffizientestem Gemini 3.1-Modell, mit 1M-Token-Kontext, nativer Vision-/Audio-/Video-Eingabe, function calling und strukturierten Ausgaben, bereitgestellt über eine OpenAI-kompatible REST-Schnittstelle.