Foxwire Logo
Gemini

Gemini 3.5 Flash: chat online y API

gemini-3.5-flash

El modelo multimodal de alta eficiencia de Google — razonamiento casi de nivel Pro a la velocidad y precio de Flash, con niveles de thinking ajustables y contexto de 1M.

🔥 10% más barato que la API oficial de Google Gemini
Entrada $1.35 vs $1.5 /1M oficial
Salida $8.1 vs $9 /1M oficial
Entrada $1.35 · Salida $8.1 /1M tokens1M contexto Razonamiento Caché de prompts
gemini-3.5-flash

Try it right here

Real model, streaming live — free trial credits on sign-up

Modelos similares

Sobre Gemini 3.5 Flash

Gemini 3.5 Flash ofrece razonamiento y programación casi de nivel Pro con la latencia y el coste de la clase Flash, y entiende imágenes de forma nativa.

La profundidad de pensamiento se configura por solicitud — de mínima para velocidad a alta para problemas difíciles — y el caché implícito abarata automáticamente los prefijos repetidos. La ventana de contexto de 1M tokens procesa entradas grandes en una sola llamada.

En Foxwire puedes usar Gemini 3.5 Flash de dos formas con una cuenta y un saldo de créditos: chatear en el playground del navegador de esta página o llamarlo por programación mediante un endpoint compatible con OpenAI. La facturación es puro pago por token, sin suscripción.

Por qué Gemini 3.5 Flash

Niveles de thinking ajustables

Ajusta el razonamiento de mínimo a alto por solicitud — paga por profundidad solo cuando la tarea lo necesita.

Multimodal rápido

Comprensión nativa de imágenes con latencia de clase Flash para capturas, documentos y fotos.

API compatible con OpenAI

Apunta tu SDK de OpenAI existente a nuestra base URL y funciona sin más — streaming, llamada a herramientas y registro de uso incluidos.

Caché de prompts automático

Los prefijos de prompt repetidos se cachean upstream automáticamente y se facturan a una fracción del precio de entrada — sin parámetros. Ideal para agentes y RAG.

Un saldo para todo

El chat web y la API comparten el mismo saldo de créditos y la misma tarifa transparente por token. Sin suscripción ni mínimos.

Especificaciones

ID del modelogemini-3.5-flash
FamiliaGemini
TipoLLM
Ventana de contexto1M tokens
Precio de entrada$1.35 / 1M tokens
Precio de salida$8.1 / 1M tokens
Precio de lectura de caché$0.135 / 1M tokens
RazonamientoSí
Caché de promptsSí
Compatibilidad de APIOpenAI SDK + Anthropic /v1/messages
StreamingSí

Integra en tres pasos

1

Crea una clave API

Regístrate, abre la consola y emite una clave — créditos de prueba incluidos, sin tarjeta.

2

Apunta tu SDK a Foxwire

Configura la base URL a nuestro endpoint y pasa el modelo \"gemini-3.5-flash\". El código existente con OpenAI SDK no necesita otros cambios.

3

Publica y monitoriza

Transmite respuestas en producción y controla los tokens y el coste de cada solicitud en los registros de uso.

Preguntas frecuentes

¿Puedo probar Gemini 3.5 Flash sin escribir código?+

Sí — el playground de esta página es el modelo real. Regístrate, obtén créditos de prueba y chatea al instante; la misma cuenta sirve luego para la API.

¿La API es compatible con el SDK de OpenAI?+

Sí. Usa cualquier SDK de OpenAI (Python, Node, etc.) con nuestra base URL — con streaming y llamada a herramientas.

¿Cómo funciona el precio?+

Puro pago por token, mostrado en esta página y cobrado de tu saldo de créditos (1 crédito = $0.01). Los aciertos de caché se cobran con gran descuento. Sin suscripción.

¿Admite thinking / razonamiento?+

Sí — la profundidad de pensamiento se configura por solicitud (mediante reasoning effort), desde pasadas rápidas hasta razonamiento profundo.

¿Cuál es la ventana de contexto?+

1M tokens — entradas grandes y sesiones largas en una sola llamada.