chat.gemini_3_5_flash
google/gemini-3-5-flash

Die Gemini 3.5 Flash API ist Googles schnelles, effizientes multimodales Modell —— ein Kontextfenster von 1M Tokens, native Eingabe von Text/Bild/Audio/Video/PDF, Function Calling und strukturierte JSON-Ausgaben, optimiert für niedrige Latenz und hohen Durchsatz. Die Gemini 3.5 Flash API ist OpenAI-kompatibel: Richten Sie ein bestehendes SDK auf RouterBase und setzen Sie das Modell auf gemini-3-5-flash. Eingabe $1.05 / 1M, Ausgabe $6.30 / 1M, Cache-Lesezugriffe $0.105 / 1M —— 5% unter dem Standardtarif, alles über einen REST-Endpunkt.

Input
Gemini 3.5 Flash
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 3.5 Flash Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 3.5 Flash API: Chat

Nutzen Sie die Gemini 3.5 Flash API, um Googles schnelles, effizientes multimodales Modell mit einem 1M-Token-Kontextfenster auszuführen.

Die Gemini 3.5 Flash API ist Googles geschwindigkeitsoptimiertes multimodales Modell — ein 1M-Token-Kontextfenster, native Eingabe für Text, Bilder, Audio, Video und PDF, function calling sowie strukturierte JSON-Ausgaben, abgestimmt auf niedrige Latenz und hohen Durchsatz. Über RouterBase geleitet, ist sie vollständig OpenAI-kompatibel: Richten Sie ein beliebiges bestehendes SDK auf die Basis-URL von RouterBase, setzen Sie das Modell auf gemini-3-5-flash, und Ihr erster Aufruf geht sofort durch.

Die Preise betragen $1.05 / 1M Eingabe-Tokens, $6.30 / 1M Ausgabe-Tokens und $0.105 / 1M gecachte Eingabe-Lesevorgänge — 5 % unter dem Standardtarif. Ein einziger RouterBase-Schlüssel — keine Google-Zugangsdaten erforderlich.

Warum dieses Modell

Sechs Gründe, warum Teams mit der Gemini 3.5 Flash API live gehen

Von schneller multimodaler Inferenz bis zu 5 % Preisnachlass — was Gemini 3.5 Flash auszeichnet.

1M-Token-Kontext

Verarbeitet bis zu 1 Million Tokens pro Anfrage — lange Dokumente, dateiübergreifender Code oder Video-Transkripte passen in einen einzigen Aufruf der Gemini 3.5 Flash API.

Native multimodale Eingabe

Die Gemini 3.5 Flash API versteht Text, Bilder, Audio, Video und PDFs. Übergeben Sie gemischte Medien in einer Anfrage, um über Modalitäten hinweg zu analysieren, zu transkribieren oder zu schlussfolgern.

Schnell & durchsatzstark

Abgestimmt auf niedrige Latenz und hohes Volumen: Die Gemini 3.5 Flash API liefert Flash-Tier-Geschwindigkeit für Chat, Klassifizierung, Extraktion und Routing im großen Maßstab.

Function calling & JSON

Definieren Sie Tools und fordern Sie ein JSON-Schema an; die Gemini 3.5 Flash API liefert strukturierte Tool-Aufrufe und streng gültiges JSON für zuverlässige Agenten- und Extraktions-Pipelines.

OpenAI-kompatibler Endpunkt

Die Gemini 3.5 Flash API spricht das OpenAI-Chat-Completions-Wire-Format. Richten Sie ein beliebiges OpenAI-SDK auf RouterBase — kein Google-SDK und keine separaten Zugangsdaten nötig.

Ein Schlüssel für 200+ Modelle

Derselbe RouterBase-Schlüssel, der die Gemini 3.5 Flash API aufruft, leitet auch an GPT-5, Claude Opus 4.8, GPT-4o mini und 200+ weitere Modelle weiter — keine anbieterspezifische Verwaltung von Zugangsdaten.

RouterBase dashboard preview
Schnellstart

Starten Sie mit der Gemini 3.5 Flash API in 3 Schritten

Von der Anmeldung bis zur ersten Antwort in unter 5 Minuten.

  1. Erstellen Sie einen RouterBase-API-Schlüssel

    Melden Sie sich an und generieren Sie einen API-Schlüssel — ein Schlüssel erreicht die Gemini 3.5 Flash API und jedes andere Modell im Katalog.

  2. Senden Sie Ihre erste Nachricht

    Richten Sie ein beliebiges OpenAI-kompatibles SDK auf routerbase.com/v1 und setzen Sie das Modell auf gemini-3-5-flash. Die Antwort folgt dem Standard-Chat-Completions-Schema — Streaming und multimodale Eingabe werden unterstützt.

  3. Nutzung einsehen

    Jede Antwort enthält eine detaillierte Token-Aufschlüsselung — Eingabe-, Ausgabe- und Cache-Read-Tokens — sodass Kosten und Cache-Trefferquote bei jedem Aufruf sichtbar sind.

Preise

Nur für die Nutzung zahlen

RouterBase reicht Partner-Tier-Preise durch. Verglichen mit dem offiziellen API-Tarif des Modells.

Kundengeschichten

Was Teams mit der Gemini 3.5 Flash API entwickeln

Echte Produktionslasten, die auf der Gemini 3.5 Flash API und dem RouterBase-Modellkatalog laufen.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Wir leiten umfangreichen Chat über die Gemini 3.5 Flash API — schnelle multimodale Antworten im großen Maßstab, und der 5%-RouterBase-Rabatt ist reine Marge.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Natives Vision auf der Gemini 3.5 Flash API ersetzte eine OCR-Pipeline — ein schneller Aufruf beschriftet und extrahiert, Text und Bild zusammen.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Strukturierte JSON-Ausgaben der Gemini 3.5 Flash API beendeten unser fehleranfälliges Parsing — jedes Mal streng gültiges JSON, selbst bei multimodalen Eingaben.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Die Flash-Tier-Latenz der Gemini 3.5 Flash API erlaubte uns, die Klassifizierung online zu verlagern. RouterBase macht es noch einmal 5 % günstiger.

Jonas Keller
Jonas KellerIndie Developer

Der 1M-Kontext der Gemini 3.5 Flash API bedeutet, dass ich ganze Dokumente hineinwerfen kann und trotzdem schnelle Antworten erhalte. Kein Chunking-Klebstoff.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase stellt die Gemini 3.5 Flash API und 200+ weitere Modelle hinter einen einzigen Schlüssel. Unser Team beantragt keine neuen Anbieterkonten mehr.

Sophia Martín
Sophia MartínCTO, Relay

Wir testen die Gemini 3.5 Flash API pro Anfrage gegen Pro im A/B-Verfahren — dasselbe SDK, ein Modellfeld. Der meiste Traffic bleibt auf Flash, und die Latenz sank.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Wir haben an einem Wochenende 42 Services auf die Gemini 3.5 Flash API migriert. Der einzige PR-Kommentar war: Moment, das war es schon?

David Okonkwo
David OkonkwoCo-founder, Figment

Cache-Lesevorgänge zu $0.105 / 1M auf der Gemini 3.5 Flash API machten unsere Long-Context-Features bezahlbar. Die ROI-Rechnung ging sofort auf.

Häufig gestellte Fragen

Häufige Fragen zur Gemini 3.5 Flash API.

Sie ist der Durchleitungszugang von RouterBase zu Googles Gemini 3.5 Flash — ein schneller, effizienter multimodaler Chat-Endpunkt mit einem 1M-Token-Kontext, nativer Vision-/Audio-/Video-Eingabe, function calling und strukturierten Ausgaben, bereitgestellt über eine OpenAI-kompatible REST-Schnittstelle.