Foxwire Logo
Gemini

Gemini 3.6 Flash: chat online e API

gemini-3.6-flash

A nova geração da linha eficiente da Google — raciocínio mais forte do que o 3.5 Flash na mesma classe de velocidade e custo. Contexto de 1M.

🔥 10% mais barato do que a API oficial do Google Gemini
Entrada $1.35 vs $1.5 /1M oficial
Saída $6.75 vs $7.5 /1M oficial
Entrada $1.35 · Saída $6.75 /1M tokens1M contexto Raciocínio Cache de prompts
gemini-3.6-flash

Try it right here

Real model, streaming live — free trial credits on sign-up

Modelos semelhantes

Sobre o Gemini 3.6 Flash

O Gemini 3.6 Flash é o modelo mais recente do nível de eficiência da Google, estreitando a distância para a qualidade Pro e mantendo a latência e o preço da classe Flash. Processa texto e imagens de forma nativa.

A profundidade de raciocínio é ajustável por pedido, o cache automático dá desconto em prefixos repetidos sem parâmetros, e a janela de contexto de 1M de tokens engole grandes entradas numa só chamada.

Na Foxwire pode usar o Gemini 3.6 Flash de duas formas com uma conta e um saldo de créditos: conversar no playground do navegador nesta página, ou chamá-lo de forma programática através de um endpoint compatível com OpenAI. A faturação é puro pagamento por utilização por token, sem subscrição.

Porquê o Gemini 3.6 Flash

Última geração Flash

Um claro avanço face ao 3.5 Flash em raciocínio e código, na mesma classe de velocidade.

Raciocínio ajustável

Regule a profundidade de raciocínio por pedido — mínima para velocidade, alta para problemas difíceis.

API compatível com OpenAI

Aponte o seu SDK OpenAI existente para a nossa base URL e funciona — streaming, chamada de ferramentas e contabilização de uso incluídos.

Cache de prompts automático

Os prefixos de prompt repetidos são colocados em cache a montante automaticamente e faturados a uma fração do preço de entrada — sem parâmetros. Ótimo para agentes e RAG.

Um saldo para tudo

O chat web e a API partilham o mesmo saldo de créditos e preços transparentes por token. Sem subscrição, sem mínimos.

Especificações

ID do modelogemini-3.6-flash
FamíliaGemini
TipoLLM
Janela de contexto1M tokens
Preço de entrada$1.35 / 1M tokens
Preço de saída$6.75 / 1M tokens
Preço de leitura de cache$0.135 / 1M tokens
RaciocínioSim
Cache de promptsSim
Compatibilidade da APIOpenAI SDK + Anthropic /v1/messages
StreamingSim

Integre em três passos

1

Crie uma chave de API

Registe-se, abra a consola e emita uma chave — créditos de teste gratuitos incluídos, sem cartão.

2

Aponte o seu SDK para a Foxwire

Defina a base URL para o nosso endpoint e passe o modelo \"gemini-3.6-flash\". O código de SDK OpenAI existente não precisa de outras alterações.

3

Publique e monitorize

Faça streaming de respostas em produção e acompanhe os tokens e o custo de cada pedido nos registos de uso.

Perguntas frequentes

Posso experimentar o Gemini 3.6 Flash sem escrever código?+

Sim — o playground nesta página é o modelo real. Registe-se, obtenha créditos de teste e converse de imediato; a mesma conta serve depois para a API.

A API é compatível com o SDK da OpenAI?+

Sim. Use qualquer SDK OpenAI (Python, Node, etc.) com a nossa base URL — streaming e chamada de ferramentas incluídos.

Como funciona o preço?+

Puro pagamento por utilização por token, mostrado nesta página e cobrado do seu saldo de créditos (1 crédito = $0.01). Os acertos de cache são faturados a uma taxa fortemente reduzida. Sem subscrição.

Suporta pensamento / raciocínio?+

Sim — a profundidade de raciocínio é configurável por pedido (reasoning effort).

Qual é a janela de contexto?+

1M de tokens — grandes entradas e sessões longas numa só chamada.