> ## Documentation Index
> Fetch the complete documentation index at: https://docs.tess.im/llms.txt
> Use this file to discover all available pages before exploring further.

# Gemini Flash

Os modelos Gemini Flash do Google DeepMind estão disponíveis na Tess para chat e agentes com baixa latência e bom custo. Esta página cobre **Gemini 3.6 Flash** (workhorse de produção) e **Gemini 3.5 Flash-Lite** (maior throughput / menor custo da classe 3.5 Flash).

| **Família**<br /><br />Gemini Flash                                                         | **Provider**<br /><br />Google DeepMind | **Contexto**<br /><br />Até 1M de input | **Keys**<br /><br />`gemini-3.6-flash` · `gemini-3.5-flash-lite` |
| :------------------------------------------------------------------------------------------ | :-------------------------------------- | :-------------------------------------- | :--------------------------------------------------------------- |
| **Capacidades**<br /><br /><Icon icon="brain" /><Icon icon="image" /><Icon icon="wrench" /> | **Velocidade**<br /><br />Alta          | **Custo**<br /><br />Baixo–Médio        | **Inteligência**<br /><br />Texto + multimodal                   |

## Quando usar qual

| Necessidade                                          | Modelo recomendado        |
| ---------------------------------------------------- | ------------------------- |
| Coding agêntico e workflows multi-step em produção   | **Gemini 3.6 Flash**      |
| Knowledge work com melhor eficiência de tokens       | **Gemini 3.6 Flash**      |
| Tarefas multimodais (texto + imagem + áudio + vídeo) | **Gemini 3.6 Flash**      |
| Busca, extração, tradução e sumarização em volume    | **Gemini 3.5 Flash-Lite** |
| Menor custo / máxima velocidade de resposta          | **Gemini 3.5 Flash-Lite** |

### Gemini 3.6 Flash

* Melhor qualidade em coding e knowledge work com **menor verbosidade** que o 3.5 Flash (até \~17% menos tokens de output)
* Multimodal nativo: texto, imagem, áudio e vídeo
* Reasoning, tools (function calling / MCP) e computer use
* Contexto grande para workflows de longo horizonte (1M input / até 64K output)

### Gemini 3.5 Flash-Lite

* Opção mais rápida e econômica da classe Gemini 3.5 Flash (até \~350 tokens/s de output)
* Níveis de thinking configuráveis: priorize latência/custo ou profundidade
* Ideal como worker barato em pipelines multiagente

## Preços (créditos Tess)

Valores alinhados a [Modelos e Custos](/pt/models-and-cost) (créditos por 100 tokens):

| Modelo                | Input / 100 tokens | Output / 100 tokens |
| --------------------- | ------------------ | ------------------- |
| Gemini 3.6 Flash      | 0,072              | 0,360               |
| Gemini 3.5 Flash-Lite | 0,0144             | 0,120               |

> **Placeholder de print — seletor de modelos:** Capture o seletor de modelos do chat com **Gemini 3.6 Flash** e **Gemini 3.5 Flash-Lite** visíveis.

<Tip>
  **Boas práticas**

  * Prefira **3.6 Flash** para agentes de coding e jobs multimodais complexos.
  * Prefira **3.5 Flash-Lite** para extração, classificação e sumarização em alto volume.
  * Mantenha prompts objetivos e limite o tamanho da resposta para reduzir consumo.
</Tip>

Veja também: [Modelos e Custos](/pt/models-and-cost).
