chat.gemini_2_5_flash
google/gemini-2-5-flash

Die Gemini 2.5 Flash API ist Googles auf Geschwindigkeit und Kosten ausbalanciertes Gemini-2.5-Modell —— ein 1M-Token-Kontextfenster, optionales Thinking, native Eingabe für Text/Bild/Audio/Video/PDF, Function Calling und strukturierte JSON-Ausgaben, optimiert für niedrige Latenz und hohen Durchsatz. Die Gemini 2.5 Flash API ist OpenAI-kompatibel: Richten Sie ein bestehendes SDK auf RouterBase und setzen Sie das Modell auf gemini-2-5-flash. Eingabe $0.285 / 1M, Ausgabe $2.375 / 1M, Cache-Lesezugriffe $0.0285 / 1M —— 5% unter dem offiziell veröffentlichten Tarif, alles über einen REST-Endpunkt.

Input
Gemini 2.5 Flash
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 2.5 Flash Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 2.5 Flash API: Chat

Nutzen Sie die Gemini 2.5 Flash API, um Googles schnelles, effizientes multimodales Modell mit einem 1M-Token-Kontextfenster und integriertem Thinking auszuführen.

Die Gemini 2.5 Flash API ist Googles auf Geschwindigkeit und Kosten ausbalanciertes Gemini 2.5 Modell — ein 1M-Token-Kontextfenster, optionales Thinking, native Eingabe für Text, Bilder, Audio, Video und PDF, function calling sowie strukturierte JSON-Ausgaben, optimiert für niedrige Latenz und hohen Durchsatz. Über RouterBase geroutet ist die Gemini 2.5 Flash API vollständig OpenAI-kompatibel: Richten Sie ein beliebiges bestehendes SDK auf die Basis-URL von RouterBase, setzen Sie das Modell auf gemini-2-5-flash, und Ihr erster Aufruf geht sofort durch.

Der Preis liegt bei $0.285 / 1M Eingabe-Tokens, $2.375 / 1M Ausgabe-Tokens und $0.0285 / 1M gecachten Eingabe-Lesevorgängen — 5% unter dem offiziell veröffentlichten Tarif. Ein RouterBase-Schlüssel — keine Google-Anmeldedaten erforderlich.

Warum dieses Modell

Sechs Gründe, warum Teams mit der Gemini 2.5 Flash API live gehen

Von integriertem Thinking bis zu 5% Preisnachlass — was die Gemini 2.5 Flash API auszeichnet.

1M-Token-Kontext

Akzeptiert bis zu 1 Million Tokens pro Anfrage — lange Dokumente, Code aus mehreren Dateien oder Video-Transkripte passen ohne Chunking in einen einzigen Gemini 2.5 Flash API-Aufruf.

Optionales Thinking

Aktivieren Sie Thinking, damit die Gemini 2.5 Flash API vor der Antwort Schritt für Schritt schlussfolgert, oder schalten Sie es für die schnellsten, günstigsten Antworten ab — Sie steuern den Geschwindigkeits-/Qualitäts-Kompromiss pro Anfrage.

Native multimodale Eingabe

Die Gemini 2.5 Flash API versteht Text, Bilder, Audio, Video und PDFs. Übergeben Sie gemischte Medien in einer Anfrage, um über Modalitäten hinweg zu analysieren, zu transkribieren oder zu schlussfolgern.

Function calling & JSON

Definieren Sie Tools und fordern Sie ein JSON-Schema an; die Gemini 2.5 Flash API liefert strukturierte Tool-Aufrufe und strikt gültiges JSON für zuverlässige Agenten- und Extraktions-Pipelines.

OpenAI-kompatibler Endpunkt

Die Gemini 2.5 Flash API spricht das OpenAI-Wire-Format für Chat-Completions. Richten Sie ein beliebiges OpenAI-SDK auf RouterBase — kein Google-SDK und keine separaten Anmeldedaten nötig.

Ein Schlüssel für 200+ Modelle

Derselbe RouterBase-Schlüssel, der die Gemini 2.5 Flash API aufruft, routet auch zu GPT-5, Claude Opus 4.8, Gemini 2.5 Pro und 200+ weiteren Modellen — keine anbieterspezifische Verwaltung von Anmeldedaten.

RouterBase dashboard preview
Schnellstart

In 3 Schritten mit der Gemini 2.5 Flash API loslegen

Von der Anmeldung bis zur ersten Antwort in unter 5 Minuten.

  1. Einen RouterBase-API-Schlüssel erstellen

    Melden Sie sich an und generieren Sie einen API-Schlüssel — ein Schlüssel erreicht die Gemini 2.5 Flash API und jedes andere Modell im Katalog.

  2. Ihre erste Nachricht senden

    Richten Sie ein beliebiges OpenAI-kompatibles SDK auf routerbase.com/v1 und setzen Sie das Modell auf gemini-2-5-flash. Die Antwort folgt dem Standard-Schema für Chat-Completions — Streaming und multimodale Eingabe werden unterstützt.

  3. Verbrauch einsehen

    Jede Antwort enthält eine detaillierte Token-Aufschlüsselung — Eingabe-, Ausgabe- und Cache-Read-Tokens — sodass Kosten und Cache-Trefferquote bei jedem Aufruf sichtbar sind.

Preise

Nur für die Nutzung zahlen

RouterBase reicht Partner-Tier-Preise durch. Verglichen mit dem offiziellen API-Tarif des Modells.

Kundengeschichten

Was Teams mit der Gemini 2.5 Flash API bauen

Echte Produktivlasten, die auf der Gemini 2.5 Flash API und dem RouterBase-Modellkatalog laufen.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Die Gemini 2.5 Flash API ist unser täglicher Standard — schnell, multimodal und gut genug, um bei den meisten Aufrufen auf das Flaggschiff zu verzichten. Der 5%-RouterBase-Rabatt ist reine Marge.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Natives Multimodal auf der Gemini 2.5 Flash API liest Video und Audio direkt — ein schneller Aufruf transkribiert und schlussfolgert über den Inhalt zugleich.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Strukturierte JSON-Ausgaben der Gemini 2.5 Flash API haben unser fehleranfälliges Regex-Parsing beseitigt. Jedes Mal strikt gültiges JSON, null Wiederholungen.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Das Umschalten von Thinking auf der Gemini 2.5 Flash API lässt uns Geschwindigkeit gegen Qualität pro Aufgabe abstimmen. RouterBase macht es 5% günstiger und routet automatisch um Ausfälle herum.

Jonas Keller
Jonas KellerIndie Developer

1M Tokens Kontext bedeuten, dass ich ganze Dokumente hineinwerfen kann. Die Gemini 2.5 Flash API verarbeitet sie einfach schnell und günstig.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase stellt die Gemini 2.5 Flash API und 200+ weitere Modelle hinter einen Schlüssel. Unser Team hat aufgehört, Anträge für neue Anbieter-Konten zu stellen.

Sophia Martín
Sophia MartínCTO, Relay

Wir testen die Gemini 2.5 Flash API per A/B gegen 2.5 Pro pro Anfrage — dasselbe SDK, ein Modellfeld. Der meiste Traffic bleibt auf Flash, und die Rechnung ist stark gesunken.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Wir haben 42 Services an einem Wochenende auf die Gemini 2.5 Flash API migriert. Der einzige PR-Kommentar war 'Moment, das war alles?'.

David Okonkwo
David OkonkwoCo-founder, Figment

Bei $0.285 / 1M Eingabe minus 5% lieferte uns die Gemini 2.5 Flash API schnelle multimodale Inferenz ohne die Flaggschiff-Rechnung. Die ROI-Rechnung ging sofort auf.

Häufig gestellte Fragen

Häufige Fragen zur Gemini 2.5 Flash API.

Es ist RouterBases Pass-Through zu Googles Gemini 2.5 Flash — ein schneller, effizienter multimodaler Chat-Endpunkt mit 1M-Token-Kontext, optionalem Thinking, nativer Vision-/Audio-/Video-Eingabe, function calling und strukturierten Ausgaben, bereitgestellt über eine OpenAI-kompatible REST-Schnittstelle.