Um modelo só, com resposta mais rápida
Nesta versão, simplificamos o motor do Gateway. Antes havia vários modelos e rotas de escolha, o que deixava o comportamento difícil de prever. Agora temos um único modelo de resposta, com uma camada de reforço que age só quando é preciso.
Um modelo para todas as respostas. O DeepSeek V4 Flash responde a todos os turnos, sem alternância entre modelos. Isso torna as respostas mais consistentes e rápidas. Os modelos Kairos, Logos e Auto foram removidos do Gateway, do Painel e do Site.
Reforço inteligente. Quando a resposta é fraca (por exemplo, conhecimento recuperado abaixo de um limite) ou evasiva, o Gateway aciona um modelo Pro para refinar a resposta. Se esse reforço falhar, a resposta original do Flash é mantida. Isso garante qualidade sem travar o atendimento.
Segurança em primeiro lugar. Em situações de crise ou com dados sensíveis (PII), o turno fica preso ao modelo Flash, evitando que informações críticas sejam processadas por um modelo de reforço. A resposta final é sempre a do Flash nesses casos.
Menos provedores, mais controle. Os provedores GLM, Groq e Gemini saíram da cascata padrão; agora só entram se você configurar sua própria chave (BYOK). Fireworks e DeepInfra ficam como hosts reserva do mesmo modelo Flash, sem mudar o comportamento.
Commits (1)
5ef7dc9Modelo único metis 1.2, correções no pipeline de aprendizado e limpeza de código morto