← Changelog
Gateway2817a6c

Um modelo só, com resposta mais rápida

Nesta versão, simplificamos o motor do Gateway. Antes havia vários modelos e rotas de escolha, o que deixava o comportamento difícil de prever. Agora temos um único modelo de resposta, com uma camada de reforço que age só quando é preciso.

Um modelo para todas as respostas. O DeepSeek V4 Flash responde a todos os turnos, sem alternância entre modelos. Isso torna as respostas mais consistentes e rápidas. Os modelos Kairos, Logos e Auto foram removidos do Gateway, do Painel e do Site.

Reforço inteligente. Quando a resposta é fraca (por exemplo, conhecimento recuperado abaixo de um limite) ou evasiva, o Gateway aciona um modelo Pro para refinar a resposta. Se esse reforço falhar, a resposta original do Flash é mantida. Isso garante qualidade sem travar o atendimento.

Segurança em primeiro lugar. Em situações de crise ou com dados sensíveis (PII), o turno fica preso ao modelo Flash, evitando que informações críticas sejam processadas por um modelo de reforço. A resposta final é sempre a do Flash nesses casos.

Menos provedores, mais controle. Os provedores GLM, Groq e Gemini saíram da cascata padrão; agora só entram se você configurar sua própria chave (BYOK). Fireworks e DeepInfra ficam como hosts reserva do mesmo modelo Flash, sem mudar o comportamento.

Commits (1)
  • 5ef7dc9 Modelo único metis 1.2, correções no pipeline de aprendizado e limpeza de código morto