Skip to main content
Los modelos Gemini Flash de Google DeepMind están disponibles en Tess para chat y agentes con baja latencia y buen costo. Esta página cubre Gemini 3.6 Flash (workhorse de producción) y Gemini 3.5 Flash-Lite (mayor throughput / menor costo de la clase 3.5 Flash).

Cuándo usar cuál

Gemini 3.6 Flash

  • Mejor calidad en coding y knowledge work con menor verbosidad que 3.5 Flash (hasta ~17% menos tokens de output)
  • Multimodal nativo: texto, imagen, audio y video
  • Reasoning, tools (function calling / MCP) y computer use
  • Contexto grande para workflows de largo horizonte (1M input / hasta 64K output)

Gemini 3.5 Flash-Lite

  • Opción más rápida y económica de la clase Gemini 3.5 Flash (hasta ~350 tokens/s de output)
  • Niveles de thinking configurables: priorizá latencia/costo o profundidad
  • Ideal como worker barato en pipelines multiagente

Precios (créditos Tess)

Valores alineados a Modelos y Costos (créditos por 100 tokens):
Placeholder de captura — selector de modelos: Capturá el selector del chat con Gemini 3.6 Flash y Gemini 3.5 Flash-Lite visibles.
Buenas prácticas
  • Preferí 3.6 Flash para agentes de coding y jobs multimodales complejos.
  • Preferí 3.5 Flash-Lite para extracción, clasificación y resumen en alto volumen.
  • Mantené prompts claros y limitá el tamaño de la respuesta para reducir consumo.
Ver también: Modelos y Costos.