Foxwire Logo
Gemini

Gemini 3.5 Flash: chat online e API

gemini-3.5-flash

Il modello multimodale ad alta efficienza di Google — ragionamento quasi da livello Pro alla velocità e al prezzo di Flash, con livelli di thinking regolabili e contesto da 1M.

🔥 10% più economico dell'API ufficiale di Google Gemini
Input $1.35 vs $1.5 /1M ufficiale
Output $8.1 vs $9 /1M ufficiale
Input $1.35 · Output $8.1 /1M tokens1M contesto Ragionamento Cache dei prompt
gemini-3.5-flash

Try it right here

Real model, streaming live — free trial credits on sign-up

Modelli simili

Informazioni su Gemini 3.5 Flash

Gemini 3.5 Flash offre ragionamento e coding quasi da livello Pro con latenza e costo della classe Flash, e comprende le immagini in modo nativo.

La profondità di ragionamento è configurabile per richiesta — da minima per la velocità ad alta per i problemi difficili — e la cache implicita sconta automaticamente i prefissi ripetuti. La finestra di contesto da 1M token gestisce input di grandi dimensioni in una sola chiamata.

Su Foxwire puoi usare Gemini 3.5 Flash in due modi con un account e un saldo crediti: chattare nel playground del browser in questa pagina oppure richiamarlo via codice tramite un endpoint compatibile con OpenAI. La fatturazione è puro pagamento a token, senza abbonamento.

Perché Gemini 3.5 Flash

Livelli di thinking regolabili

Regola il ragionamento da minimo ad alto per richiesta — paghi la profondità solo quando il compito la richiede.

Multimodale veloce

Comprensione nativa delle immagini con latenza di classe Flash per screenshot, documenti e foto.

API compatibile con OpenAI

Punta il tuo SDK OpenAI esistente alla nostra base URL e funziona subito — streaming, chiamata a strumenti e conteggio dell'uso inclusi.

Cache dei prompt automatica

I prefissi di prompt ripetuti vengono messi in cache a monte automaticamente e fatturati a una frazione del prezzo di input — senza parametri. Ottima per agenti e RAG.

Un unico saldo per tutto

Chat web e API condividono lo stesso saldo crediti e la stessa tariffazione trasparente a token. Nessun abbonamento, nessun minimo.

Specifiche

ID del modellogemini-3.5-flash
FamigliaGemini
TipoLLM
Finestra di contesto1M tokens
Prezzo input$1.35 / 1M tokens
Prezzo output$8.1 / 1M tokens
Prezzo lettura cache$0.135 / 1M tokens
RagionamentoSì
Cache dei promptSì
Compatibilità APIOpenAI SDK + Anthropic /v1/messages
StreamingSì

Integra in tre passi

1

Crea una chiave API

Registrati, apri la console ed emetti una chiave — crediti di prova inclusi, senza carta.

2

Punta l'SDK a Foxwire

Imposta la base URL sul nostro endpoint e passa il modello \"gemini-3.5-flash\". Il codice OpenAI SDK esistente non richiede altre modifiche.

3

Pubblica e monitora

Trasmetti le risposte in produzione e traccia token e costo di ogni richiesta nei log di utilizzo.

Domande frequenti

Posso provare Gemini 3.5 Flash senza scrivere codice?+

Sì — il playground in questa pagina è il modello reale. Registrati, ottieni crediti di prova e chatta subito; lo stesso account funziona poi per l'API.

L'API è compatibile con l'SDK OpenAI?+

Sì. Usa qualsiasi SDK OpenAI (Python, Node, ecc.) con la nostra base URL — streaming e chiamata a strumenti inclusi.

Come funziona il prezzo?+

Puro pagamento a token, mostrato in questa pagina e addebitato dal tuo saldo crediti (1 credito = $0.01). Gli hit in cache sono fatturati a tariffa molto scontata. Nessun abbonamento.

Supporta il thinking / ragionamento?+

Sì — la profondità di ragionamento è configurabile per richiesta (tramite reasoning effort), da passaggi rapidi a ragionamento approfondito.

Qual è la finestra di contesto?+

1M token — input di grandi dimensioni e sessioni lunghe in una sola chiamata.