Foxwire Logo
Gemini

Gemini 3.6 Flash: chat online e API

gemini-3.6-flash

La nuova generazione della linea efficiente di Google — ragionamento più forte di 3.5 Flash con la stessa classe di velocità e costo. Contesto 1M.

🔥 10% più economico dell'API ufficiale di Google Gemini
Input $1.35 vs $1.5 /1M ufficiale
Output $6.75 vs $7.5 /1M ufficiale
Input $1.35 · Output $6.75 /1M tokens1M contesto Ragionamento Cache dei prompt
gemini-3.6-flash

Try it right here

Real model, streaming live — free trial credits on sign-up

Modelli simili

Informazioni su Gemini 3.6 Flash

Gemini 3.6 Flash è il modello più recente di livello efficienza di Google, che riduce il divario con la qualità Pro mantenendo latenza e prezzo della classe Flash. Gestisce testo e immagini in modo nativo.

La profondità di ragionamento è regolabile per richiesta, il caching automatico sconta i prefissi ripetuti senza parametri, e la finestra di contesto da 1M di token inghiotte grandi input in una sola chiamata.

Su Foxwire puoi usare Gemini 3.6 Flash in due modi con un account e un saldo di crediti: chattare nel playground del browser in questa pagina, oppure richiamarlo in modo programmatico tramite un endpoint compatibile con OpenAI. La fatturazione è puro pagamento a consumo per token, senza abbonamento.

Perché Gemini 3.6 Flash

Ultima generazione Flash

Un chiaro passo avanti rispetto a 3.5 Flash in ragionamento e coding, nella stessa classe di velocità.

Ragionamento regolabile

Regola la profondità di ragionamento per richiesta — minima per la velocità, alta per i problemi difficili.

API compatibile con OpenAI

Punta il tuo SDK OpenAI esistente alla nostra base URL e funziona — streaming, chiamata a strumenti e contabilità dei consumi inclusi.

Caching automatico dei prompt

I prefissi di prompt ripetuti vengono messi in cache a monte automaticamente e fatturati a una frazione del prezzo di input — senza parametri. Ottimo per agenti e RAG.

Un unico saldo per tutto

Chat web e API condividono lo stesso saldo di crediti e prezzi trasparenti per token. Nessun abbonamento, nessun minimo.

Specifiche

ID del modellogemini-3.6-flash
FamigliaGemini
TipoLLM
Finestra di contesto1M tokens
Prezzo input$1.35 / 1M tokens
Prezzo output$6.75 / 1M tokens
Prezzo lettura cache$0.135 / 1M tokens
RagionamentoSì
Cache dei promptSì
Compatibilità APIOpenAI SDK + Anthropic /v1/messages
StreamingSì

Integra in tre passi

1

Crea una chiave API

Registrati, apri la console ed emetti una chiave — crediti di prova gratuiti inclusi, nessuna carta richiesta.

2

Punta il tuo SDK a Foxwire

Imposta la base URL sul nostro endpoint e passa il modello \"gemini-3.6-flash\". Il codice SDK OpenAI esistente non richiede altre modifiche.

3

Rilascia e monitora

Trasmetti le risposte in produzione e tieni traccia di token e costo di ogni richiesta nei log dei consumi.

Domande frequenti

Posso provare Gemini 3.6 Flash senza scrivere codice?+

Sì — il playground di questa pagina è il modello reale. Registrati, ottieni crediti di prova e chatta subito; lo stesso account funziona poi per l'API.

L'API è compatibile con l'SDK OpenAI?+

Sì. Usa qualsiasi SDK OpenAI (Python, Node, ecc.) con la nostra base URL — streaming e chiamata a strumenti inclusi.

Come funziona il prezzo?+

Puro pagamento a consumo per token, mostrato in questa pagina e addebitato dal tuo saldo di crediti (1 credito = $0.01). Gli hit in cache sono fatturati a tariffa fortemente scontata. Nessun abbonamento.

Supporta il pensiero / ragionamento?+

Sì — la profondità di ragionamento è configurabile per richiesta (reasoning effort).

Qual è la finestra di contesto?+

1M di token — grandi input e sessioni lunghe in una sola chiamata.