Foxwire Logo
Gemini

Gemini 3.6 Flash: chat online y API

gemini-3.6-flash

La nueva generación de la línea eficiente de Google — razonamiento más fuerte que 3.5 Flash con la misma clase de velocidad y coste. Contexto 1M.

🔥 10% más barato que la API oficial de Google Gemini
Entrada $1.35 vs $1.5 /1M oficial
Salida $6.75 vs $7.5 /1M oficial
Entrada $1.35 · Salida $6.75 /1M tokens1M contexto Razonamiento Caché de prompts
gemini-3.6-flash

Try it right here

Real model, streaming live — free trial credits on sign-up

Modelos similares

Sobre Gemini 3.6 Flash

Gemini 3.6 Flash es el modelo más reciente de nivel de eficiencia de Google, que estrecha la distancia con la calidad Pro manteniendo la latencia y el precio de la clase Flash. Procesa texto e imágenes de forma nativa.

La profundidad de pensamiento es ajustable por solicitud, el almacenamiento en caché automático descuenta los prefijos repetidos sin parámetros, y la ventana de contexto de 1M de tokens engulle grandes entradas en una sola llamada.

En Foxwire puedes usar Gemini 3.6 Flash de dos formas con una cuenta y un saldo de créditos: chatear en el playground del navegador en esta página, o llamarlo de forma programática a través de un endpoint compatible con OpenAI. La facturación es puro pago por uso por token, sin suscripción.

Por qué Gemini 3.6 Flash

La última generación Flash

Un claro avance sobre 3.5 Flash en razonamiento y código, en la misma clase de velocidad.

Pensamiento ajustable

Regula la profundidad de razonamiento por solicitud: mínima para velocidad, alta para problemas difíciles.

API compatible con OpenAI

Apunta tu SDK de OpenAI existente a nuestra base URL y funciona sin más — streaming, llamada a herramientas y contabilidad de uso incluidos.

Caché de prompts automática

Los prefijos de prompt repetidos se almacenan en caché arriba automáticamente y se facturan a una fracción del precio de entrada — sin parámetros. Ideal para agentes y RAG.

Un saldo para todo

El chat web y la API comparten el mismo saldo de créditos y precios transparentes por token. Sin suscripción ni mínimos.

Especificaciones

ID del modelogemini-3.6-flash
FamiliaGemini
TipoLLM
Ventana de contexto1M tokens
Precio de entrada$1.35 / 1M tokens
Precio de salida$6.75 / 1M tokens
Precio de lectura de caché$0.135 / 1M tokens
RazonamientoSí
Caché de promptsSí
Compatibilidad de APIOpenAI SDK + Anthropic /v1/messages
StreamingSí

Integra en tres pasos

1

Crea una clave API

Regístrate, abre la consola y emite una clave — créditos de prueba gratis incluidos, sin tarjeta.

2

Apunta tu SDK a Foxwire

Fija la base URL a nuestro endpoint y pasa el modelo \"gemini-3.6-flash\". El código de SDK de OpenAI existente no necesita otros cambios.

3

Despliega y monitoriza

Transmite respuestas en producción y controla los tokens y el coste de cada solicitud en los registros de uso.

Preguntas frecuentes

¿Puedo probar Gemini 3.6 Flash sin escribir código?+

Sí — el playground de esta página es el modelo real. Regístrate, obtén créditos de prueba y chatea al instante; la misma cuenta sirve luego para la API.

¿La API es compatible con el SDK de OpenAI?+

Sí. Usa cualquier SDK de OpenAI (Python, Node, etc.) con nuestra base URL — streaming y llamada a herramientas incluidos.

¿Cómo funciona el precio?+

Puro pago por uso por token, mostrado en esta página y cobrado de tu saldo de créditos (1 crédito = $0.01). Los aciertos de caché se facturan con un gran descuento. Sin suscripción.

¿Admite pensamiento / razonamiento?+

Sí — la profundidad de pensamiento es configurable por solicitud (reasoning effort).

¿Cuál es la ventana de contexto?+

1M de tokens — grandes entradas y sesiones largas en una sola llamada.