Roteador de modelos para o Claude Code
Daniel San · @dani_avila7178,6 mil visualizações no X
Modificação para o Claude Code que usa o Jev, pela API direta ou por um gateway de IA, para classificar cada pedido e decidir qual subagent ou modelo principal deve atendê-lo. O roteamento acontece sem geração de texto, o que mantém a decisão rápida e barata antes de acionar o modelo escolhido.
O que o Jev decide aqui?
Para cada pedido, o Jev escolhe (Choice) qual subagent ou modelo principal deve atendê-lo.
Por que isso importa?
Nem todo pedido precisa do modelo mais caro. Um roteador que classifica a tarefa antes de chamar o LLM permite mandar perguntas simples para modelos menores e reservar o mais capaz para o que exige raciocínio mais longo.
O padrão se aplica a qualquer produto com vários modelos disponíveis: assistentes de código, chatbots de atendimento e ferramentas de conteúdo. Cuidado: registre as decisões do roteador e acompanhe os casos em que o modelo menor falhou, para ajustar as categorias e evitar economia que piora a qualidade.