Foxwire Logo
DeepSeek

DeepSeek V4 Flash: chat online e API

deepseek-v4-flash

O modelo de eficiência da DeepSeek — resultado surpreendentemente capaz ao menor preço por token, com cache automático e contexto de 1M.

Entrada $0.42 · Saída $0.84 /1M tokens1M contexto Raciocínio Cache de prompts
deepseek-v4-flash

Try it right here

Real model, streaming live — free trial credits on sign-up

Modelos semelhantes

Sobre o DeepSeek V4 Flash

O DeepSeek V4 Flash é a resposta padrão quando o custo unitário manda: resumo, extração, classificação, chat e pipelines em massa obtêm um resultado realmente capaz ao preço mais baixo da plataforma.

O cache automático de prompts não precisa de parâmetros e reduz ainda mais o custo do contexto repetido; a janela de contexto de 1M tokens mantém até entradas enormes numa única chamada.

Na Foxwire pode usar o DeepSeek V4 Flash de duas formas com uma só conta e um só saldo de créditos: conversar no playground do navegador nesta página ou chamá-lo por programação através de um endpoint compatível com OpenAI. A faturação é puro pagamento por utilização por token, sem subscrição.

Porquê o DeepSeek V4 Flash

O menor custo da plataforma

O preço por token baixíssimo transforma pipelines de grande volume de caras em triviais.

Mais capaz do que o preço sugere

O raciocínio do dia a dia, a programação e a escrita saem muito melhor do que o preço indica.

API compatível com OpenAI

Aponte o seu SDK OpenAI existente para o nosso base URL e funciona logo — streaming, chamada de ferramentas e contabilização de uso incluídos.

Cache automático de prompts

Os prefixos de prompt repetidos são colocados em cache a montante automaticamente e faturados a uma fração do preço de entrada — sem parâmetros. Ótimo para agentes e RAG.

Um só saldo para tudo

O chat web e a API partilham o mesmo saldo de créditos e preços por token transparentes. Sem subscrição, sem mínimos.

Especificações

ID do modelodeepseek-v4-flash
FamíliaDeepSeek
TipoLLM
Janela de contexto1M tokens
Preço de entrada$0.42 / 1M tokens
Preço de saída$0.84 / 1M tokens
Preço de leitura de cache$0.009 / 1M tokens
RaciocínioSim
Cache de promptsSim
Compatibilidade da APIOpenAI SDK + Anthropic /v1/messages
StreamingSim

Integre em três passos

1

Crie uma chave API

Registe-se, abra a consola e emita uma chave — créditos de teste gratuitos incluídos, sem cartão.

2

Aponte o seu SDK para a Foxwire

Defina o base URL para o nosso endpoint e passe o modelo \"deepseek-v4-flash\". O código existente do OpenAI SDK não precisa de outras alterações.

3

Publique e monitorize

Faça streaming das respostas em produção e acompanhe os tokens e o custo de cada pedido nos registos de uso.

Perguntas frequentes

Posso experimentar o DeepSeek V4 Flash sem escrever código?+

Sim — o playground nesta página é o modelo real. Registe-se, obtenha créditos de teste e converse de imediato; a mesma conta funciona depois para a API.

A API é compatível com o SDK da OpenAI?+

Sim. Use qualquer SDK OpenAI (Python, Node, etc.) com o nosso base URL — streaming e chamada de ferramentas incluídos.

Como funciona o preço?+

Puro pagamento por utilização por token, mostrado nesta página e cobrado do seu saldo de créditos (1 crédito = $0.01). Os acertos de cache são cobrados a uma tarifa fortemente reduzida. Sem subscrição.

Suporta thinking / reasoning?+

Sim — o raciocínio pode ser ativado por pedido quando uma tarefa precisa de mais do que uma passagem rápida.

Qual é a janela de contexto?+

1M tokens — entradas enormes numa única chamada.