Foxwire Logo
Gemini

Gemini 3.5 Flash: chat online e API

gemini-3.5-flash

O modelo multimodal de alta eficiência da Google — raciocínio quase ao nível Pro à velocidade e ao preço de Flash, com níveis de thinking ajustáveis e contexto de 1M.

🔥 10% mais barato do que a API oficial do Google Gemini
Entrada $1.35 vs $1.5 /1M oficial
Saída $8.1 vs $9 /1M oficial
Entrada $1.35 · Saída $8.1 /1M tokens1M contexto Raciocínio Cache de prompts
gemini-3.5-flash

Try it right here

Real model, streaming live — free trial credits on sign-up

Modelos semelhantes

Sobre o Gemini 3.5 Flash

O Gemini 3.5 Flash oferece raciocínio e programação quase ao nível Pro com a latência e o custo da classe Flash, e compreende imagens de forma nativa.

A profundidade de raciocínio é configurável por pedido — de mínima para velocidade a alta para problemas difíceis — e a cache implícita reduz automaticamente o custo de prefixos repetidos. A janela de contexto de 1M tokens processa entradas grandes numa única chamada.

No Foxwire pode usar o Gemini 3.5 Flash de duas formas com uma conta e um saldo de créditos: conversar no playground do navegador nesta página ou chamá-lo por programação através de um endpoint compatível com OpenAI. A faturação é puro pagamento por token, sem subscrição.

Porquê o Gemini 3.5 Flash

Níveis de thinking ajustáveis

Ajuste o raciocínio de mínimo a alto por pedido — pague pela profundidade só quando a tarefa a exigir.

Multimodal rápido

Compreensão nativa de imagens com latência de classe Flash para capturas de ecrã, documentos e fotos.

API compatível com OpenAI

Aponte o seu SDK OpenAI existente para a nossa base URL e funciona logo — streaming, chamada de ferramentas e contabilização de uso incluídos.

Cache de prompt automática

Os prefixos de prompt repetidos são colocados em cache a montante automaticamente e faturados a uma fração do preço de entrada — sem parâmetros. Ideal para agentes e RAG.

Um saldo para tudo

O chat web e a API partilham o mesmo saldo de créditos e a mesma tarifação transparente por token. Sem subscrição nem mínimos.

Especificações

ID do modelogemini-3.5-flash
FamíliaGemini
TipoLLM
Janela de contexto1M tokens
Preço de entrada$1.35 / 1M tokens
Preço de saída$8.1 / 1M tokens
Preço de leitura de cache$0.135 / 1M tokens
RaciocínioSim
Cache de promptsSim
Compatibilidade da APIOpenAI SDK + Anthropic /v1/messages
StreamingSim

Integre em três passos

1

Crie uma chave API

Registe-se, abra a consola e emita uma chave — créditos de teste incluídos, sem cartão.

2

Aponte o seu SDK para o Foxwire

Defina a base URL para o nosso endpoint e passe o modelo \"gemini-3.5-flash\". O código existente com OpenAI SDK não precisa de outras alterações.

3

Publique e monitorize

Faça streaming das respostas em produção e acompanhe os tokens e o custo de cada pedido nos registos de uso.

Perguntas frequentes

Posso experimentar o Gemini 3.5 Flash sem escrever código?+

Sim — o playground nesta página é o modelo real. Registe-se, receba créditos de teste e converse de imediato; a mesma conta serve depois para a API.

A API é compatível com o SDK da OpenAI?+

Sim. Use qualquer SDK OpenAI (Python, Node, etc.) com a nossa base URL — com streaming e chamada de ferramentas.

Como funciona o preço?+

Puro pagamento por token, apresentado nesta página e debitado do seu saldo de créditos (1 crédito = $0.01). Os acertos de cache são faturados com grande desconto. Sem subscrição.

Suporta thinking / raciocínio?+

Sim — a profundidade de raciocínio é configurável por pedido (via reasoning effort), de passagens rápidas a raciocínio aprofundado.

Qual é a janela de contexto?+

1M tokens — entradas grandes e sessões longas numa única chamada.