Die Gemini 3.1 Flash-Lite API ist unser Standard für hohes Volumen — Qualität der neuesten Generation, schnell und günstig genug, um bei den meisten Aufrufen auf das Flaggschiff zu verzichten. Der 5%-RouterBase-Rabatt ist reine Marge.
Die Gemini 3.1 Flash-Lite API ist Googles schnellstes, kosteneffizientestes Gemini-3.1-Modell —— ein 1M-Token-Kontextfenster, native Eingabe für Text/Bild/Audio/Video/PDF, Function Calling und strukturierte JSON-Ausgaben, optimiert für niedrige Latenz und hohen Durchsatz. Die Gemini 3.1 Flash-Lite API ist OpenAI-kompatibel: Richten Sie ein bestehendes SDK auf RouterBase und setzen Sie das Modell auf gemini-3-1-flash-lite. Eingabe $0.2375 / 1M, Ausgabe $1.425 / 1M, Cache-Lesezugriffe $0.02375 / 1M —— 5% unter dem offiziell veröffentlichten Tarif, alles über einen REST-Endpunkt.
Gemini 3.1 Flash-Lite API: Chat
Nutzen Sie die Gemini 3.1 Flash-Lite API, um Googles schnellstes und günstigstes Gemini 3.1-Modell auszuführen — mit 1M-Token-Kontext, nativer multimodaler Eingabe und strukturierten Ausgaben.
Die Gemini 3.1 Flash-Lite API ist Googles schnellstes und kosteneffizientestes Gemini 3.1-Modell — mit einem 1M-Token-Kontextfenster, nativer Eingabe für Text, Bilder, Audio, Video und PDF, function calling und strukturierten JSON-Ausgaben, optimiert für niedrige Latenz und hohen Durchsatz. Über RouterBase geroutet, ist die Gemini 3.1 Flash-Lite API vollständig OpenAI-kompatibel: Richten Sie ein beliebiges vorhandenes SDK auf die Basis-URL von RouterBase, setzen Sie das Modell auf gemini-3-1-flash-lite, und Ihr erster Aufruf geht sofort durch.
Die Preise betragen $0.2375 / 1M Eingabe-Token, $1.425 / 1M Ausgabe-Token und $0.02375 / 1M Reads für zwischengespeicherte Eingaben — 5% unter dem offiziell veröffentlichten Tarif. Ein RouterBase-Schlüssel — keine Google-Anmeldedaten erforderlich.
Sechs Gründe, warum Teams auf die Gemini 3.1 Flash-Lite API setzen
Von der Geschwindigkeit der neuesten Generation bis zu 5% Preisnachlass — was die Gemini 3.1 Flash-Lite API auszeichnet.
Schnellstes, günstigstes Gemini 3.1
Die Gemini 3.1 Flash-Lite API ist Googles neuestes leichtgewichtiges Modell — gebaut für die niedrigsten Kosten und den höchsten Durchsatz in der Gemini 3.1-Familie.
1M-Token-Kontext
Akzeptiert bis zu 1 Million Token pro Anfrage — lange Dokumente, mehrteiliger Code oder Videotranskripte passen in einen einzigen Gemini 3.1 Flash-Lite API-Aufruf ohne Chunking.
Native multimodale Eingabe
Die Gemini 3.1 Flash-Lite API versteht Text, Bilder, Audio, Video und PDFs. Übergeben Sie gemischte Medien in einer Anfrage, um über Modalitäten hinweg zu analysieren, zu transkribieren oder zu schlussfolgern.
Function calling & JSON
Definieren Sie Tools und fordern Sie ein JSON-Schema an; die Gemini 3.1 Flash-Lite API liefert strukturierte Tool-Aufrufe und streng gültiges JSON für zuverlässige Agenten- und Extraktions-Pipelines.
OpenAI-kompatibler Endpunkt
Die Gemini 3.1 Flash-Lite API spricht das OpenAI-Chat-Completions-Wire-Format. Richten Sie ein beliebiges OpenAI-SDK auf RouterBase — kein Google-SDK und keine separaten Anmeldedaten nötig.
Ein Schlüssel für 200+ Modelle
Derselbe RouterBase-Schlüssel, der die Gemini 3.1 Flash-Lite API aufruft, routet auch zu GPT-5, Claude Opus 4.8, Gemini 3.1 Pro und 200+ weiteren Modellen — keine anbieterspezifische Verwaltung von Anmeldedaten.

Starten Sie mit der Gemini 3.1 Flash-Lite API in 3 Schritten
Von der Anmeldung bis zur ersten Antwort in unter 5 Minuten.
Erstellen Sie einen RouterBase-API-Schlüssel
Melden Sie sich an und generieren Sie einen API-Schlüssel — ein Schlüssel erreicht die Gemini 3.1 Flash-Lite API und jedes andere Modell im Katalog.
Senden Sie Ihre erste Nachricht
Richten Sie ein beliebiges OpenAI-kompatibles SDK auf routerbase.com/v1 und setzen Sie das Modell auf gemini-3-1-flash-lite. Die Antwort folgt dem Standard-Chat-Completions-Schema — Streaming und multimodale Eingabe werden unterstützt.
Überprüfen Sie die Nutzung
Jede Antwort enthält eine detaillierte Token-Aufschlüsselung — Eingabe-, Ausgabe- und Cache-Read-Token — sodass Kosten und Cache-Trefferquote bei jedem Aufruf sichtbar sind.
Nur für die Nutzung zahlen
RouterBase reicht Partner-Tier-Preise durch. Verglichen mit dem offiziellen API-Tarif des Modells.
Was Teams mit der Gemini 3.1 Flash-Lite API bauen
Echte Produktionslasten, die auf der Gemini 3.1 Flash-Lite API und dem RouterBase-Modellkatalog laufen.
Natives Multimodal auf der Gemini 3.1 Flash-Lite API liest Video und Audio direkt — ein schneller Aufruf transkribiert und schlussfolgert über den Inhalt zusammen.
Strukturierte JSON-Ausgaben der Gemini 3.1 Flash-Lite API haben unser fehleranfälliges Regex-Parsing beendet. Streng gültiges JSON jedes Mal, null Wiederholungen.
Wir haben Klassifizierung und Routing auf die Gemini 3.1 Flash-Lite API verlagert, und die Latenz sank, während die Qualität stieg. RouterBase macht es 5% günstiger und routet automatisch um Ausfälle herum.
1M Token Kontext zu Flash-Lite-Preisen bedeutet, dass ich ihr ganze Dokumente günstig zuwerfen kann. Die Gemini 3.1 Flash-Lite API verarbeitet sie einfach schnell.
RouterBase stellt die Gemini 3.1 Flash-Lite API und 200+ weitere Modelle hinter einen Schlüssel. Unser Team hat aufgehört, Anträge für neue Anbieter-Konten zu stellen.
Wir testen die Gemini 3.1 Flash-Lite API per Anfrage im A/B-Verfahren gegen 3.1 Pro — dasselbe SDK, ein Modellfeld. Der meiste Traffic bleibt auf Flash-Lite und die Rechnung sank stark.
Wir haben unsere Endpunkte mit hohem Volumen an einem Wochenende auf die Gemini 3.1 Flash-Lite API umgeleitet. Der einzige PR-Kommentar war 'Moment, das war's schon?'.
Bei $0.2375 / 1M Eingabe minus 5% lieferte uns die Gemini 3.1 Flash-Lite API multimodale Inferenz der neuesten Generation zu einem Preis, der skaliert. Die ROI-Rechnung war sofort klar.
Häufig gestellte Fragen
Häufige Fragen zur Gemini 3.1 Flash-Lite API.
Es ist der Pass-Through von RouterBase zu Googles Gemini 3.1 Flash-Lite — Googles schnellstem und kosteneffizientestem Gemini 3.1-Modell, mit 1M-Token-Kontext, nativer Vision-/Audio-/Video-Eingabe, function calling und strukturierten Ausgaben, bereitgestellt über eine OpenAI-kompatible REST-Schnittstelle.