chat.gemini_2_5_flash_lite
google/gemini-2-5-flash-lite

Die Gemini 2.5 Flash Lite API ist Googles schnellstes und kosteneffizientestes Gemini-2.5-Modell —— ein 1M-Token-Kontextfenster, native Eingabe für Text/Bild/Audio/Video/PDF, Function Calling und strukturierte JSON-Ausgaben, optimiert für niedrige Latenz und hohen Durchsatz. Die Gemini 2.5 Flash Lite API ist OpenAI-kompatibel: Richten Sie ein bestehendes SDK auf RouterBase und setzen Sie das Modell auf gemini-2-5-flash-lite. Eingabe $0.095 / 1M, Ausgabe $0.34 / 1M, Cache-Lesezugriffe $0.0095 / 1M —— 5% unter dem offiziell veröffentlichten Tarif, alles über einen REST-Endpunkt.

Input
Gemini 2.5 Flash-Lite
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 2.5 Flash-Lite Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 2.5 Flash Lite API: Chat

Nutzen Sie die Gemini 2.5 Flash Lite API, um Googles schnellstes und kosteneffizientestes Gemini 2.5-Modell mit einem Kontextfenster von 1M Tokens und multimodaler Eingabe auszuführen.

Die Gemini 2.5 Flash Lite API ist Googles kleinstes und kosteneffizientestes Gemini 2.5-Modell — ein Kontextfenster von 1M Tokens, native Eingabe für Text, Bilder, Audio, Video und PDF, function calling sowie strukturierte JSON-Ausgaben, optimiert für niedrigste Latenz und höchsten Durchsatz im großen Maßstab. Über RouterBase geleitet ist die Gemini 2.5 Flash Lite API vollständig OpenAI-kompatibel: Richten Sie ein beliebiges vorhandenes SDK auf die Basis-URL von RouterBase, setzen Sie das Modell auf gemini-2-5-flash-lite, und Ihr erster Aufruf geht sofort durch.

Die Preise betragen $0.095 / 1M Eingabe-Tokens, $0.34 / 1M Ausgabe-Tokens und $0.0095 / 1M zwischengespeicherte Eingabe-Reads — 5% unter dem offiziell veröffentlichten Tarif. Ein RouterBase-Schlüssel — keine Google-Zugangsdaten erforderlich.

Warum dieses Modell

Sechs Gründe, warum Teams auf der Gemini 2.5 Flash Lite API liefern

Von einem Kontext mit 1M Tokens bis zu 5% Preisnachlass — was die Gemini 2.5 Flash Lite API auszeichnet.

Kontext mit 1M Tokens

Akzeptiert bis zu 1 Million Tokens pro Anfrage — lange Dokumente, Code aus mehreren Dateien oder Video-Transkripte passen in einen einzigen Aufruf der Gemini 2.5 Flash Lite API, ganz ohne Chunking.

Schnellste, günstigste 2.5-Stufe

Gebaut für Workloads mit hohem Volumen: Die Gemini 2.5 Flash Lite API ist das kostengünstigste Gemini 2.5-Modell mit $0.095 / 1M Eingabe-Tokens — ideal für Klassifizierung, Zusammenfassung, Extraktion und Routing im großen Maßstab.

Native multimodale Eingabe

Die Gemini 2.5 Flash Lite API versteht Text, Bilder, Audio, Video und PDFs. Übergeben Sie gemischte Medien in einer Anfrage, um über Modalitäten hinweg zu analysieren, zu transkribieren oder zu schlussfolgern.

Function calling & JSON

Definieren Sie Tools und fordern Sie ein JSON-Schema an; die Gemini 2.5 Flash Lite API liefert strukturierte Tool-Aufrufe und streng gültiges JSON für zuverlässige Agenten- und Extraktions-Pipelines.

OpenAI-kompatibler Endpunkt

Die Gemini 2.5 Flash Lite API spricht das OpenAI-Wire-Format für Chat-Completions. Richten Sie ein beliebiges OpenAI-SDK auf RouterBase — kein Google-SDK und keine separaten Zugangsdaten nötig.

Ein Schlüssel für 200+ Modelle

Derselbe RouterBase-Schlüssel, der die Gemini 2.5 Flash Lite API aufruft, leitet auch an GPT-5, Claude Opus 4.8, Gemini 2.5 Pro und 200+ weitere Modelle weiter — ohne Verwaltung von Zugangsdaten pro Anbieter.

RouterBase dashboard preview
Schnellstart

Starten Sie mit der Gemini 2.5 Flash Lite API in 3 Schritten

Von der Anmeldung bis zur ersten Antwort in unter 5 Minuten.

  1. Erstellen Sie einen RouterBase-API-Schlüssel

    Melden Sie sich an und generieren Sie einen API-Schlüssel — ein Schlüssel erreicht die Gemini 2.5 Flash Lite API und jedes andere Modell im Katalog.

  2. Senden Sie Ihre erste Nachricht

    Richten Sie ein beliebiges OpenAI-kompatibles SDK auf routerbase.com/v1 und setzen Sie das Modell auf gemini-2-5-flash-lite. Die Antwort folgt dem Standard-Schema für Chat-Completions — Streaming und multimodale Eingabe werden unterstützt.

  3. Prüfen Sie die Nutzung

    Jede Antwort enthält eine detaillierte Token-Aufschlüsselung — Eingabe-, Ausgabe- und Cache-Read-Tokens — sodass Kosten und Cache-Trefferquote bei jedem Aufruf sichtbar sind.

Preise

Nur für die Nutzung zahlen

RouterBase reicht Partner-Tier-Preise durch. Verglichen mit dem offiziellen API-Tarif des Modells.

Kundengeschichten

Was Teams mit der Gemini 2.5 Flash Lite API bauen

Echte Produktionslasten, die auf der Gemini 2.5 Flash Lite API und dem RouterBase-Modellkatalog laufen.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Wir leiten 90% unseres Traffics über die Gemini 2.5 Flash Lite API — Klassifizierung und Extraktion zu einem Bruchteil der Kosten. Der 5%-RouterBase-Rabatt ist reine Marge.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Natives Multimodal auf der Gemini 2.5 Flash Lite API liest Bilder und Audio direkt — ein schneller, günstiger Aufruf beschriftet und transkribiert zugleich.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Strukturierte JSON-Ausgaben der Gemini 2.5 Flash Lite API haben unser fehleranfälliges Regex-Parsing erledigt. Streng gültiges JSON jedes Mal, null Wiederholungen.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Bei unserem Volumen ist Flash-Lite das einzige Gemini 2.5-Modell, das sich rechnet. RouterBase macht es noch einmal 5% günstiger.

Jonas Keller
Jonas KellerIndie Developer

Die Gemini 2.5 Flash Lite API bewältigt meine Zusammenfassungsschleife mit hohem Volumen. Günstig genug, dass ich aufgehört habe, Tokens zu zählen.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase stellt die Gemini 2.5 Flash Lite API und 200+ weitere Modelle hinter einen einzigen Schlüssel. Unser Team stellt keine Anträge mehr für neue Anbieter-Konten.

Sophia Martín
Sophia MartínCTO, Relay

Wir testen die Gemini 2.5 Flash Lite API per A/B gegen Gemini 2.5 Pro pro Anfrage — dasselbe SDK, ein Modellfeld. Der meiste Traffic bleibt bei Flash-Lite, und die Rechnung sank um 70%.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Wir haben an einem Wochenende 42 Services auf die Gemini 2.5 Flash Lite API migriert. Der einzige PR-Kommentar war 'Moment, das war alles?'.

David Okonkwo
David OkonkwoCo-founder, Figment

Bei $0.095 / 1M Eingabe minus 5% machte die Gemini 2.5 Flash Lite API unsere Features mit hohem Volumen tatsächlich profitabel. Die ROI-Rechnung ging sofort auf.

Häufig gestellte Fragen

Häufige Fragen zur Gemini 2.5 Flash Lite API.

Es ist der Durchleitungsdienst von RouterBase zu Googles Gemini 2.5 Flash-Lite — dem schnellsten, günstigsten Gemini 2.5-Chat-Endpunkt mit einem Kontext von 1M Tokens, nativer Vision-/Audio-/Video-Eingabe, function calling und strukturierten Ausgaben, bereitgestellt über eine OpenAI-kompatible REST-Schnittstelle.