2× mais inteligente. 10× mais barata.
Metis 1.2 é a engine mais poderosa que a Maytiq já lançou. E a mais barata. As duas ao mesmo tempo, no mesmo modelo, com os números abertos nesta página. Você não muda uma linha de código: só a sua conta muda.
- mais inteligente
- 2x
- índice 24 → 52 (Artificial Analysis v4.1)
- mais barata por run de agente
- 10x
- $0,165 → $0,016 por run de 24 passos
- mais barata por turno de chat
- 14x
- $0,0056 → $0,0004 com cache e thinking ligado
- mais barata por usuário
- 18x
- $42 → $2,30 por mês, 10 chats e 3 runs por dia
Pensa como o GPT-5.6 Luna. Custa menos que o Gemini Flash.
Índice 52 nos dois; preço blended $0,12 contra $0,58 do Flash.
26× mais inteligência por dólar que o Claude Opus 5.
433 pontos por dólar contra 16.
Um mês de agente de código: $42. O mesmo mês na Anthropic: $4.885.
4 bilhões de tokens de cache lidos, 8,8 milhões de saída, uso real de um dev.
A mais poderosa e a mais barata. A mesma engine.
Antes você escolhia: o modelo grátis, fraco, ou um fechado de fronteira a $5 por milhão de tokens no fim da fila. Metis 1.2 acaba com a escolha. Um modelo no patamar dos fechados rápidos (índice 52), a uma fração do preço, em todo turno. OpenAI, Anthropic e Google continuam disponíveis com a sua própria chave. Se um host de inferência cai, outro homologado do mesmo modelo atende: resiliência, não outro produto.
| Modelo | Para que serve | Contexto · velocidade · índice | Preço por 1M tokens |
|---|---|---|---|
| Metis 1.2 | Chat, SDK, bots e agentes. Streaming no chat. Um modelo; a engine escala por baixo só quando a tarefa exige. | Contexto 1M tokens · ~136 tokens/s · índice 52 · thinking no chat, tool calling nativo, JSON | $0,22 entrada · $0,007 cache-hit · $0,66 saída (pico: o dobro) |
Menos tokens, cobrados pelo preço certo.
Não é desconto. É engenharia: o prompt repete, o cache acerta, o medidor cobra o que o fornecedor cobra. Oito mudanças, todas medidas.
Cache de prompt de verdade
Memórias, contexto do SDK e trechos da base de conhecimento agora viajam junto com a mensagem do usuário, não no prompt de sistema. O prefixo (instruções + histórico) fica idêntico entre turnos e o fornecedor devolve cache-hit a 3% do preço.
Medição fiel
Tokens servidos do cache eram cobrados como se fossem novos. Agora o medidor lê os campos de cache dos fornecedores e cobra a taxa de hit. Em um deles, o consumo de entrada nem era registrado; passou a ser.
Tool calling nativo
Agentes em modo código deixam de descrever ações em JSON no texto. O modelo chama a ferramenta pela API, com o histórico convertido para chamadas nativas. Menos erros de protocolo, menos passos perdidos.
Roteamento também no modo código
A engine olha a tarefa pedida, não a saída da última ferramenta. Um snapshot de página com um e-mail dentro não empurra a run inteira para um caminho mais caro.
Cascade que sabe pular
Antes de chamar um host, a cascade confere se ele fala tool calling nativo e se o prompt cabe no limite de tokens por minuto dele. Um host abaixo do teto não recebe mais um passo grande só para falhar.
Jobs no horário barato
Extração de memória, fatos e insights semanais rodam só fora do horário de pico do fornecedor, que custa metade. Sem mudar nada para você.
Juiz no próprio Metis 1.2
A avaliação de qualidade saiu de um tier gratuito limitado a 1.000 chamadas por dia para o Metis 1.2 com cache. As saídas avaliadas podem alimentar o ciclo de destilação da Maytiq.
Código morto removido
O gateway não decide mais o modelo por plano. A cascade completa não usada e o campo de billing legado saíram. Menos código, menos superfície para bug.
Empata com os fechados rápidos. Custa menos que o mais barato deles.
Fonte única: Artificial Analysis Intelligence Index v4.1, nove avaliações que incluem agentes em terminal e atendimento (Terminal-Bench, τ³-Banking) além de raciocínio e código. Variantes com raciocínio no esforço máximo, modelos lançados até setembro de 2026. Metis 1.2 marca 52 com thinking no chat. Em loops de agente o thinking desliga (estimativa AA 29), porque em 24 passos o raciocínio custa mais do que rende. A Maytiq soma memória por tenant e usuário, base de conhecimento com aterramento estrito e protocolo de crise no prompt — sem trocar de modelo.
- Metis 1.2 (Maytiq AI)52
- Claude Opus 5 (Anthropic)63
- Muse Spark 1.3 (Meta)62
- GPT-5.6 Sol (OpenAI)61
- Grok 4.6 (xAI)61
- Kimi K3 (Moonshot)60
- Qwen3.8 Max (Alibaba)58
- GPT-5.6 Terra (OpenAI)57
- Gemini 3.7 Flash (Google)56
- Claude Sonnet 5 (Anthropic)55
- GPT-5.6 Luna (OpenAI)52
- Claude Haiku 4.5 (Anthropic)30
Ver tabela
| Cenário | Índice |
|---|---|
| Metis 1.2 (Maytiq AI) | 52 |
| Claude Opus 5 (Anthropic) | 63 |
| Muse Spark 1.3 (Meta) | 62 |
| GPT-5.6 Sol (OpenAI) | 61 |
| Grok 4.6 (xAI) | 61 |
| Kimi K3 (Moonshot) | 60 |
| Qwen3.8 Max (Alibaba) | 58 |
| GPT-5.6 Terra (OpenAI) | 57 |
| Gemini 3.7 Flash (Google) | 56 |
| Claude Sonnet 5 (Anthropic) | 55 |
| GPT-5.6 Luna (OpenAI) | 52 |
| Claude Haiku 4.5 (Anthropic) | 30 |
- Metis 1.2 (Maytiq AI)433
- Claude Opus 5 (Anthropic)16
- Muse Spark 1.3 (Meta)79
- GPT-5.6 Sol (OpenAI)20
- Grok 4.6 (xAI)45
- Kimi K3 (Moonshot)26
- Qwen3.8 Max (Alibaba)49
- GPT-5.6 Terra (OpenAI)33
- Gemini 3.7 Flash (Google)97
- Claude Sonnet 5 (Anthropic)36
- GPT-5.6 Luna (OpenAI)306
- Claude Haiku 4.5 (Anthropic)39
Ver tabela
| Cenário | Pontos por dólar |
|---|---|
| Metis 1.2 (Maytiq AI) | 433 |
| Claude Opus 5 (Anthropic) | 16 |
| Muse Spark 1.3 (Meta) | 79 |
| GPT-5.6 Sol (OpenAI) | 20 |
| Grok 4.6 (xAI) | 45 |
| Kimi K3 (Moonshot) | 26 |
| Qwen3.8 Max (Alibaba) | 49 |
| GPT-5.6 Terra (OpenAI) | 33 |
| Gemini 3.7 Flash (Google) | 97 |
| Claude Sonnet 5 (Anthropic) | 36 |
| GPT-5.6 Luna (OpenAI) | 306 |
| Claude Haiku 4.5 (Anthropic) | 39 |
- Metis 1.2 (Maytiq AI)136
- Claude Opus 5 (Anthropic)57
- GPT-5.6 Sol (OpenAI)70
- Grok 4.6 (xAI)55
- Kimi K3 (Moonshot)38
- Qwen3.8 Max (Alibaba)39
- GPT-5.6 Terra (OpenAI)98
- Gemini 3.7 Flash (Google)285
- Claude Sonnet 5 (Anthropic)72
- GPT-5.6 Luna (OpenAI)116
- Claude Haiku 4.5 (Anthropic)85
Ver tabela
| Cenário | tokens/s |
|---|---|
| Metis 1.2 (Maytiq AI) | 136 |
| Claude Opus 5 (Anthropic) | 57 |
| GPT-5.6 Sol (OpenAI) | 70 |
| Grok 4.6 (xAI) | 55 |
| Kimi K3 (Moonshot) | 38 |
| Qwen3.8 Max (Alibaba) | 39 |
| GPT-5.6 Terra (OpenAI) | 98 |
| Gemini 3.7 Flash (Google) | 285 |
| Claude Sonnet 5 (Anthropic) | 72 |
| GPT-5.6 Luna (OpenAI) | 116 |
| Claude Haiku 4.5 (Anthropic) | 85 |
Haiku 4.5 aparece com a variante com raciocínio. Muse Spark 1.3 saiu hoje: índice publicado, velocidade ainda não; preço assumido igual ao do 1.2. Teste próprio de 2 de setembro, 6 prompts de CRM em português: thinking ligado custou +0,8 s e +114 tokens por turno; a resposta ficou com o mesmo tamanho. O que a Maytiq soma por cima: memória por tenant e usuário, base de conhecimento com aterramento estrito e protocolo de crise e dado sensível no prompt, sem trocar de modelo.
Cada unidade de trabalho, 10 a 18 vezes mais barata.
Perfis de token vêm de produção: ~15 mil tokens de prompt por passo de agente, ~3,8 mil por turno de chat. Cache-hit assumido em 85% com prefixo estável. Preços oficiais de setembro de 2026, horário fora do pico.
| Unidade | Antes | Metis 1.2 |
|---|---|---|
| 1 turno de chat (thinking ligado) | $0,0056 | $0,0004 |
| 1 run de agente (24 passos) | $0,165 | $0,016 |
| 1 usuário de desktop por mês (10 chats/dia + 3 runs/dia) | $42 | $2,30 |
Latência: Metis 1.2 responde em 1–3 s por passo de agente. Hosts de reserva só entram se o primário falha. Não há modelo fechado de fronteira no caminho.
Contra o nosso passado. E contra todo mundo.
Cenários calibrados com o uso medido de um cliente de 30 pessoas em 5 workspaces, mais uma empresa de 5. Valores em dólares por mês, só custo de modelo, preços oficiais de setembro de 2026 fora do pico, cache-hit de 85% quando o fornecedor oferece.
- Maytiq AI 1.0
- Metis 1.2
- 30 usuários · 23 conversas/dia · 8 dias (uso medido)$22$3
- 30 usuários · 23 conversas/dia · 22 dias$60$8
- 30 usuários · 80 conversas/dia + 5 bots × 4 runs/dia$306$34
- 30 usuários · 106 conversas/dia · 30 dias + 5 bots por hora$967$102
- 5 pessoas · 50 conversas/dia + 2 bots × 8 runs/dia$101$10
- 5 pessoas · 100 conversas/dia · 30 dias + 2 bots por hora$300$30
Ver tabela
| Cenário | Maytiq AI 1.0 | Metis 1.2 |
|---|---|---|
| 30 usuários · 23 conversas/dia · 8 dias (uso medido) | $22 | $3 |
| 30 usuários · 23 conversas/dia · 22 dias | $60 | $8 |
| 30 usuários · 80 conversas/dia + 5 bots × 4 runs/dia | $306 | $34 |
| 30 usuários · 106 conversas/dia · 30 dias + 5 bots por hora | $967 | $102 |
| 5 pessoas · 50 conversas/dia + 2 bots × 8 runs/dia | $101 | $10 |
| 5 pessoas · 100 conversas/dia · 30 dias + 2 bots por hora | $300 | $30 |
- Anthropic Claude (preço de lista)$4.885
- Maytiq AI 1.0$1.790
- Metis 1.2$42
Ver tabela
| Cenário | USD/mês |
|---|---|
| Anthropic Claude (preço de lista) | $4.885 |
| Maytiq AI 1.0 | $1.790 |
| Metis 1.2 | $42 |
- Maytiq AI 1.0 · chat24
- Maytiq AI 1.0 · pago29
- Metis 1.252
Ver tabela
| Cenário | Índice |
|---|---|
| Maytiq AI 1.0 · chat | 24 |
| Maytiq AI 1.0 · pago | 29 |
| Metis 1.2 | 52 |
- Metis 1.2 (Maytiq AI)$3
- Gemini 3.7 Flash (Google)$31
- GPT-5.6 Luna → Sol (OpenAI)$39
- Claude Haiku 4.5 → Sonnet 5 (Anthropic)$59
- Muse Spark 1.3 (Meta)$109
- Grok 4.6 (xAI)$172
- Qwen3.8 Max (Alibaba)$172
- GPT-5.6 Sol direto (OpenAI)$226
Ver tabela
| Cenário | USD/mês |
|---|---|
| Metis 1.2 (Maytiq AI) | $3 |
| Gemini 3.7 Flash (Google) | $31 |
| GPT-5.6 Luna → Sol (OpenAI) | $39 |
| Claude Haiku 4.5 → Sonnet 5 (Anthropic) | $59 |
| Muse Spark 1.3 (Meta) | $109 |
| Grok 4.6 (xAI) | $172 |
| Qwen3.8 Max (Alibaba) | $172 |
| GPT-5.6 Sol direto (OpenAI) | $226 |
- Metis 1.2 (Maytiq AI)$34
- Gemini 3.7 Flash (Google)$142
- GPT-5.6 Luna → Sol (OpenAI)$185
- Claude Haiku 4.5 → Sonnet 5 (Anthropic)$272
- Muse Spark 1.3 (Meta)$686
- Grok 4.6 (xAI)$1.087
- Qwen3.8 Max (Alibaba)$1.087
- GPT-5.6 Sol direto (OpenAI)$1.018
Ver tabela
| Cenário | USD/mês |
|---|---|
| Metis 1.2 (Maytiq AI) | $34 |
| Gemini 3.7 Flash (Google) | $142 |
| GPT-5.6 Luna → Sol (OpenAI) | $185 |
| Claude Haiku 4.5 → Sonnet 5 (Anthropic) | $272 |
| Muse Spark 1.3 (Meta) | $686 |
| Grok 4.6 (xAI) | $1.087 |
| Qwen3.8 Max (Alibaba) | $1.087 |
| GPT-5.6 Sol direto (OpenAI) | $1.018 |
- Metis 1.2 (Maytiq AI)$10
- Gemini 3.7 Flash (Google)$46
- GPT-5.6 Luna → Sol (OpenAI)$55
- Claude Haiku 4.5 → Sonnet 5 (Anthropic)$87
- Muse Spark 1.3 (Meta)$297
- Grok 4.6 (xAI)$473
- Qwen3.8 Max (Alibaba)$473
- GPT-5.6 Sol direto (OpenAI)$325
Ver tabela
| Cenário | USD/mês |
|---|---|
| Metis 1.2 (Maytiq AI) | $10 |
| Gemini 3.7 Flash (Google) | $46 |
| GPT-5.6 Luna → Sol (OpenAI) | $55 |
| Claude Haiku 4.5 → Sonnet 5 (Anthropic) | $87 |
| Muse Spark 1.3 (Meta) | $297 |
| Grok 4.6 (xAI) | $473 |
| Qwen3.8 Max (Alibaba) | $473 |
| GPT-5.6 Sol direto (OpenAI) | $325 |
O mês de agente de código é uso medido de um desenvolvedor em 30 dias: 0,8 milhão de tokens de entrada nova, 35 milhões de escrita de cache, 4,0 bilhões de leitura de cache e 8,8 milhões de saída. Quase tudo é prefixo repetido; é por isso que o preço do cache-hit decide a conta. Cada concorrente foi simulado com a mesma carga e o mesmo desconto de cache que o próprio fornecedor publica. Qualidade não entra na conta: o Metis 1.2 segue em benchmark interno de tool-use com as ferramentas reais da Maytiq.
Você não faz nada. Sua conta faz.
SDK, API e app continuam iguais. O que muda é o que aparece no seu medidor de uso: o mesmo trabalho, com um modelo duas vezes mais inteligente, por um décimo do consumo.
- Um modelo no perfil: Metis 1.2. Crise e dado sensível não trocam de modelo: o protocolo de segurança vai no prompt, como faz a Anthropic.
- Quem tem chave própria (BYOK) continua usando o modelo escolhido no perfil.
- Thinking ligado em todo turno de chat e desligado em modo código.
- Próximo: suíte pública de eval em português, destilação nas tarefas em que o verificador ainda escala, limites por assento.
Entre antes da multidão.
Liberamos acesso em lotes pequenos e a fila anda toda semana. Um e-mail quando chegar a sua vez. Só isso.