Foxwire Logo
Gemini

Gemini 3.5 Flash Lite: Online-Chat & API

gemini-3.5-flash-lite

Die leichteste Stufe von Googles Gemini-Reihe — für Pipelines im großen Maßstab, in denen der Stückpreis entscheidet, und dennoch mit 1M-Token-Kontextfenster.

🔥 10% günstiger als die offizielle Google-Gemini-API
Eingabe $0.27 vs. $0.30 /1M offiziell
Ausgabe $2.25 vs. $2.50 /1M offiziell
Eingabe $0.27 · Ausgabe $2.25 /1M tokens1M Kontext Denkmodus Prompt-Caching
gemini-3.5-flash-lite

Try it right here

Real model, streaming live — free trial credits on sign-up

Ähnliche Modelle

Über Gemini 3.5 Flash Lite

Gemini 3.5 Flash Lite tauscht Spitzenintelligenz gegen extreme Effizienz: Klassifizierung, Extraktion, Routing, Moderation und Massen-Chat zu einem Preis, der Millionen von Aufrufen praktikabel macht.

Ungewöhnlich für diesen Preis behält es ein 1M-Token-Kontextfenster und native Bildeingabe, und automatisches Caching rabattiert wiederholte Präfixe ohne jede Konfiguration.

Auf Foxwire nutzen Sie Gemini 3.5 Flash Lite auf zwei Arten mit einem Konto und einem Guthaben: im Browser-Playground auf dieser Seite chatten oder programmatisch über einen OpenAI-kompatiblen Endpunkt aufrufen. Die Abrechnung erfolgt rein nutzungsbasiert pro Token, ohne Abo.

Warum Gemini 3.5 Flash Lite

Für den großen Maßstab gebaut

Stückkosten, die Pipelines mit Millionen Aufrufen zur Routine machen — der Standard für Massen-Workloads.

1M-Kontext in der untersten Stufe

Riesige Eingaben und lange Dokumente bleiben auch beim leichtesten Modell ein einziger Aufruf.

OpenAI-kompatible API

Richten Sie Ihr vorhandenes OpenAI SDK auf unsere base URL — es funktioniert einfach: Streaming, Tool-Calling und Nutzungsabrechnung inklusive.

Automatisches Prompt-Caching

Wiederholte Prompt-Präfixe werden upstream automatisch gecacht und zu einem Bruchteil des Eingabepreises berechnet — ohne Parameter. Ideal für Agenten und RAG.

Ein Guthaben für alles

Web-Chat und API teilen sich dasselbe Guthaben und transparente Preise pro Token. Kein Abo, keine Mindestbeträge.

Spezifikationen

Modell-IDgemini-3.5-flash-lite
FamilieGemini
TypLLM
Kontextfenster1M tokens
Preis Eingabe$0.27 / 1M tokens
Preis Ausgabe$2.25 / 1M tokens
Preis Cache-Lesen$0.027 / 1M tokens
Denk- / Reasoning-ModusJa
Prompt-CachingJa
API-KompatibilitätOpenAI SDK + Anthropic /v1/messages
StreamingJa

In drei Schritten integrieren

1

API-Schlüssel erstellen

Registrieren, die Konsole öffnen und einen Schlüssel ausstellen — kostenlose Testguthaben inklusive, keine Karte nötig.

2

SDK auf Foxwire richten

Setzen Sie die base URL auf unseren Endpunkt und übergeben Sie das Modell \"gemini-3.5-flash-lite\". Bestehender OpenAI-SDK-Code braucht keine weiteren Änderungen.

3

Ausliefern und überwachen

Streamen Sie Antworten in der Produktion und verfolgen Sie Token und Kosten jeder Anfrage in den Nutzungsprotokollen.

Häufig gestellte Fragen

Kann ich Gemini 3.5 Flash Lite ohne Code ausprobieren?+

Ja — der Playground auf dieser Seite ist das echte Modell. Registrieren, Testguthaben erhalten und sofort chatten; dasselbe Konto funktioniert später für die API.

Ist die API mit dem OpenAI SDK kompatibel?+

Ja. Verwenden Sie ein beliebiges OpenAI SDK (Python, Node usw.) mit unserer base URL — Streaming und Tool-Calling inklusive.

Wie funktioniert die Abrechnung?+

Rein nutzungsbasiert pro Token, auf dieser Seite angezeigt und von Ihrem Guthaben abgebucht (1 Guthaben = $0.01). Cache-Treffer werden stark rabattiert berechnet. Kein Abo.

Unterstützt es Thinking / Reasoning?+

Ja — leichtes Reasoning lässt sich pro Anfrage aktivieren, das Modell ist jedoch auf schnelle Durchläufe optimiert.

Wie groß ist das Kontextfenster?+

1M Token — selten in dieser Preisklasse.