Foxwire Logo
DeepSeek

DeepSeek V4 Flash: chat online y API

deepseek-v4-flash

El modelo de eficiencia de DeepSeek — un resultado sorprendentemente capaz al precio por token más bajo, con caché automática y contexto de 1M.

Entrada $0.42 · Salida $0.84 /1M tokens1M contexto Razonamiento Caché de prompts
deepseek-v4-flash

Try it right here

Real model, streaming live — free trial credits on sign-up

Modelos similares

Acerca de DeepSeek V4 Flash

DeepSeek V4 Flash es la respuesta por defecto cuando manda el coste unitario: resumen, extracción, clasificación, chat y pipelines masivas obtienen un resultado realmente capaz al precio más bajo de la plataforma.

La caché de prompts automática no necesita parámetros y reduce aún más el coste del contexto repetido; la ventana de contexto de 1M tokens mantiene incluso entradas enormes en una sola llamada.

En Foxwire puedes usar DeepSeek V4 Flash de dos formas con una sola cuenta y un solo saldo de créditos: chatea en el playground del navegador en esta página o llámalo por programación a través de un endpoint compatible con OpenAI. La facturación es puro pago por uso por token, sin suscripción.

Por qué DeepSeek V4 Flash

El coste más bajo de la plataforma

El precio por token bajísimo convierte las pipelines de alto volumen de caras en triviales.

Más capaz de lo que sugiere su precio

El razonamiento cotidiano, la programación y la redacción salen mucho mejor de lo que insinúa el precio.

API compatible con OpenAI

Apunta tu SDK de OpenAI existente a nuestra base URL y funciona sin más — streaming, llamada a herramientas y registro de uso incluidos.

Caché de prompts automática

Los prefijos de prompt repetidos se almacenan en caché upstream de forma automática y se facturan a una fracción del precio de entrada — sin parámetros. Ideal para agentes y RAG.

Un solo saldo para todo

El chat web y la API comparten el mismo saldo de créditos y precios por token transparentes. Sin suscripción ni mínimos.

Especificaciones

ID del modelodeepseek-v4-flash
FamiliaDeepSeek
TipoLLM
Ventana de contexto1M tokens
Precio de entrada$0.42 / 1M tokens
Precio de salida$0.84 / 1M tokens
Precio de lectura de caché$0.009 / 1M tokens
RazonamientoSí
Caché de promptsSí
Compatibilidad de APIOpenAI SDK + Anthropic /v1/messages
StreamingSí

Integra en tres pasos

1

Crea una clave API

Regístrate, abre la consola y emite una clave — créditos de prueba gratis incluidos, sin tarjeta.

2

Apunta tu SDK a Foxwire

Configura la base URL con nuestro endpoint y pasa el modelo \"deepseek-v4-flash\". El código existente del SDK de OpenAI no necesita más cambios.

3

Publica y monitoriza

Transmite respuestas en producción y controla los tokens y el coste de cada solicitud en los registros de uso.

Preguntas frecuentes

¿Puedo probar DeepSeek V4 Flash sin escribir código?+

Sí — el playground de esta página es el modelo real. Regístrate, obtén créditos de prueba y chatea al instante; la misma cuenta sirve luego para la API.

¿La API es compatible con el SDK de OpenAI?+

Sí. Usa cualquier SDK de OpenAI (Python, Node, etc.) con nuestra base URL — streaming y llamada a herramientas incluidos.

¿Cómo funciona el precio?+

Puro pago por uso por token, mostrado en esta página y cobrado de tu saldo de créditos (1 crédito = $0.01). Los aciertos de caché se cobran con un gran descuento. Sin suscripción.

¿Admite pensamiento / razonamiento?+

Sí — el razonamiento se puede activar por solicitud cuando una tarea necesita más que una pasada rápida.

¿Cuál es la ventana de contexto?+

1M tokens — entradas enormes en una sola llamada.