> ## Documentation Index
> Fetch the complete documentation index at: https://docs.tess.im/llms.txt
> Use this file to discover all available pages before exploring further.

# Gemini Flash

Los modelos Gemini Flash de Google DeepMind están disponibles en Tess para chat y agentes con baja latencia y buen costo. Esta página cubre **Gemini 3.6 Flash** (workhorse de producción) y **Gemini 3.5 Flash-Lite** (mayor throughput / menor costo de la clase 3.5 Flash).

| **Familia**<br /><br />Gemini Flash                                                         | **Provider**<br /><br />Google DeepMind | **Contexto**<br /><br />Hasta 1M de input | **Keys**<br /><br />`gemini-3.6-flash` · `gemini-3.5-flash-lite` |
| :------------------------------------------------------------------------------------------ | :-------------------------------------- | :---------------------------------------- | :--------------------------------------------------------------- |
| **Capacidades**<br /><br /><Icon icon="brain" /><Icon icon="image" /><Icon icon="wrench" /> | **Velocidad**<br /><br />Alta           | **Costo**<br /><br />Bajo–Medio           | **Inteligencia**<br /><br />Texto + multimodal                   |

## Cuándo usar cuál

| Necesidad                                            | Modelo recomendado        |
| ---------------------------------------------------- | ------------------------- |
| Coding agéntico y workflows multi-step en producción | **Gemini 3.6 Flash**      |
| Knowledge work con mejor eficiencia de tokens        | **Gemini 3.6 Flash**      |
| Tareas multimodales (texto + imagen + audio + video) | **Gemini 3.6 Flash**      |
| Búsqueda, extracción, traducción y resumen a escala  | **Gemini 3.5 Flash-Lite** |
| Menor costo / máxima velocidad de respuesta          | **Gemini 3.5 Flash-Lite** |

### Gemini 3.6 Flash

* Mejor calidad en coding y knowledge work con **menor verbosidad** que 3.5 Flash (hasta \~17% menos tokens de output)
* Multimodal nativo: texto, imagen, audio y video
* Reasoning, tools (function calling / MCP) y computer use
* Contexto grande para workflows de largo horizonte (1M input / hasta 64K output)

### Gemini 3.5 Flash-Lite

* Opción más rápida y económica de la clase Gemini 3.5 Flash (hasta \~350 tokens/s de output)
* Niveles de thinking configurables: priorizá latencia/costo o profundidad
* Ideal como worker barato en pipelines multiagente

## Precios (créditos Tess)

Valores alineados a [Modelos y Costos](/es/models-and-cost) (créditos por 100 tokens):

| Modelo                | Input / 100 tokens | Output / 100 tokens |
| --------------------- | ------------------ | ------------------- |
| Gemini 3.6 Flash      | 0,072              | 0,360               |
| Gemini 3.5 Flash-Lite | 0,0144             | 0,120               |

> **Placeholder de captura — selector de modelos:** Capturá el selector del chat con **Gemini 3.6 Flash** y **Gemini 3.5 Flash-Lite** visibles.

<Tip>
  **Buenas prácticas**

  * Preferí **3.6 Flash** para agentes de coding y jobs multimodales complejos.
  * Preferí **3.5 Flash-Lite** para extracción, clasificación y resumen en alto volumen.
  * Mantené prompts claros y limitá el tamaño de la respuesta para reducir consumo.
</Tip>

Ver también: [Modelos y Costos](/es/models-and-cost).
