> ## Documentation Index
> Fetch the complete documentation index at: https://docs.tess.im/llms.txt
> Use this file to discover all available pages before exploring further.

# Kimi K3

O Kimi K3 (Moonshot AI) é o maior modelo **open-weight** frontier na Tess: **2,8T** de parâmetros totais (**104B** ativos por token), **visão nativa** e **1M** de contexto. Use para coding de longo horizonte, agentes e knowledge work multimodal.

| **Model IDs**<br /><br />`kimi-k3-low` · `kimi-k3-high` · `kimi-k3-max`                     | **Contexto**<br /><br />1M      | **Provider**<br /><br />Moonshot AI | **API**<br /><br />16 jul 2026                     |
| :------------------------------------------------------------------------------------------ | :------------------------------ | :---------------------------------- | :------------------------------------------------- |
| **Capacidades**<br /><br /><Icon icon="brain" /><Icon icon="image" /><Icon icon="wrench" /> | **Velocidade**<br /><br />Média | **Custo**<br /><br />Médio–Alto     | **Inteligência**<br /><br />Frontier (open-weight) |

## O que mudou em relação ao Kimi K2.6

|                            | Kimi K2.6            | Kimi K3                       |
| -------------------------- | -------------------- | ----------------------------- |
| Params totais / ativos     | —                    | **2,8T / 104B**               |
| Contexto                   | 1M                   | 1M                            |
| Visão                      | Sim                  | Nativa texto + imagem + vídeo |
| Reasoning na Tess          | —                    | low / high / **max**          |
| Créditos Tess / 100 tokens | 0,042 in / 0,196 out | **0,1596 in / 0,798 out**     |

Arquitetura MoE (896 experts, 16 ativos por token). A Tess expõe três níveis de reasoning; **Max** é o mais profundo (default da Moonshot no lançamento).

## Preços (créditos Tess)

Valores alinhados a [Modelos e Custos](/pt/models-and-cost) (créditos por 100 tokens). Mesma tarifa em todos os níveis:

| Modelo       | Input / 100 tokens | Output / 100 tokens |
| ------------ | ------------------ | ------------------- |
| Kimi K3 Low  | 0,1596             | 0,798               |
| Kimi K3 High | 0,1596             | 0,798               |
| Kimi K3 Max  | 0,1596             | 0,798               |

Leituras de contexto em cache são cobradas abaixo de um input completo.

> **Placeholder de print — seletor de modelos:** Capture o seletor do chat com **Kimi K3** (Low / High / Max) visível.

## Casos de uso ideais na Tess

1. Coding de longo horizonte — repositórios grandes, refactors multi-file, agentes de código
2. Workflows agênticos persistentes com tool loops
3. Knowledge work multimodal (documentos, imagens e vídeo no mesmo contexto)
4. Reasoning profundo com **Kimi K3 Max**
5. Workloads open-weight que ainda precisam de capacidade frontier
6. Sessões longas (1M de contexto) sem trocar de modelo

<Tip>
  **Boas práticas**

  * Use **Low** para rascunho e volume; **High** como default; reserve **Max** para tarefas de planejamento pesado.
  * O K3 custa mais que o K2.6 — não troque como default em extração barata.
  * Aproveite cache de contexto em threads longas para reduzir input.
</Tip>

Veja também: [Modelos e Custos](/pt/models-and-cost).
