Foxwire Logo
Gemini

Gemini 3.5 Flash Lite: chat online e API

gemini-3.5-flash-lite

Il livello più leggero della linea Gemini di Google — pensato per pipeline su vasta scala dove conta il costo unitario, con comunque una finestra di contesto da 1M token.

🔥 10% più economico dell'API ufficiale di Google Gemini
Input $0.27 vs $0.30 /1M ufficiale
Output $2.25 vs $2.50 /1M ufficiale
Input $0.27 · Output $2.25 /1M tokens1M contesto Ragionamento Cache dei prompt
gemini-3.5-flash-lite

Try it right here

Real model, streaming live — free trial credits on sign-up

Modelli simili

Informazioni su Gemini 3.5 Flash Lite

Gemini 3.5 Flash Lite scambia l'intelligenza di punta con un'efficienza estrema: classificazione, estrazione, instradamento, moderazione e chat di massa a un prezzo che rende pratici milioni di chiamate.

Cosa insolita per il prezzo, mantiene una finestra di contesto da 1M token e l'input immagine nativo, e la cache automatica sconta i prefissi ripetuti senza alcuna configurazione.

Su Foxwire puoi usare Gemini 3.5 Flash Lite in due modi con un solo account e un solo saldo di crediti: chattare nel playground del browser in questa pagina, oppure richiamarlo a livello di codice tramite un endpoint compatibile con OpenAI. La fatturazione è puro pay-as-you-go per token, senza abbonamento.

Perché Gemini 3.5 Flash Lite

Costruito per la vasta scala

Un'economia unitaria che rende ordinarie le pipeline da milioni di chiamate — la scelta predefinita per i carichi di massa.

1M di contesto al livello base

Input enormi e documenti lunghi restano una singola chiamata anche sul modello più leggero.

API compatibile con OpenAI

Punta il tuo SDK OpenAI esistente alla nostra base URL e funziona senza altro — streaming, chiamata di strumenti e contabilità dell'uso inclusi.

Cache automatica dei prompt

I prefissi di prompt ripetuti vengono memorizzati in cache automaticamente a monte e fatturati a una frazione del prezzo di input — senza parametri. Ottimo per agenti e RAG.

Un solo saldo per tutto

Chat web e API condividono lo stesso saldo di crediti e prezzi trasparenti per token. Nessun abbonamento, nessun minimo.

Specifiche

ID del modellogemini-3.5-flash-lite
FamigliaGemini
TipoLLM
Finestra di contesto1M tokens
Prezzo input$0.27 / 1M tokens
Prezzo output$2.25 / 1M tokens
Prezzo lettura cache$0.027 / 1M tokens
RagionamentoSì
Cache dei promptSì
Compatibilità APIOpenAI SDK + Anthropic /v1/messages
StreamingSì

Integra in tre passaggi

1

Crea una chiave API

Registrati, apri la console ed emetti una chiave — crediti di prova gratuiti inclusi, nessuna carta richiesta.

2

Punta il tuo SDK a Foxwire

Imposta la base URL sul nostro endpoint e passa il modello \"gemini-3.5-flash-lite\". Il codice OpenAI SDK esistente non richiede altre modifiche.

3

Pubblica e monitora

Trasmetti le risposte in produzione e monitora token e costo di ogni richiesta nei log di utilizzo.

Domande frequenti

Posso provare Gemini 3.5 Flash Lite senza scrivere codice?+

Sì — il playground in questa pagina è il modello reale. Registrati, ottieni crediti di prova e chatta subito; lo stesso account servirà poi per l'API.

L'API è compatibile con l'SDK OpenAI?+

Sì. Usa qualsiasi SDK OpenAI (Python, Node, ecc.) con la nostra base URL — streaming e chiamata di strumenti inclusi.

Come funziona il prezzo?+

Puro pay-as-you-go per token, mostrato in questa pagina e addebitato dal tuo saldo di crediti (1 credito = $0.01). Gli hit in cache sono fatturati a una tariffa fortemente scontata. Nessun abbonamento.

Supporta il thinking / reasoning?+

Sì — un ragionamento leggero può essere attivato per richiesta, anche se il modello è ottimizzato per passaggi rapidi.

Qual è la finestra di contesto?+

1M token — rara in questa fascia di prezzo.