Sistemas multi-agente
Tarefa complexa quebra quando você empurra tudo para um agente só com vinte ferramentas e um prompt gigante. A saída é dividir: agentes especializados, um coordenador que decide a ordem, e verificação antes de dar a resposta como boa.
Por que um agente só trava
Conforme você adiciona ferramenta e regra a um único agente, três coisas pioram juntas: ele escolhe a ferramenta errada com mais frequência, o custo por tarefa sobe porque o contexto cresce, e fica impossível saber em que ponto a resposta se perdeu.
Dividir resolve, mas cria um problema novo: coordenação. Sem uma máquina de estados explícita, agentes chamando agentes viram um loop caro e imprevisível. É por isso que a coordenação, aqui, é código determinístico e não mais um modelo decidindo.
Os arranjos que usamos
Coordenador com especialistas
Um orquestrador decide qual especialista atende cada parte, em que ordem, e junta o resultado. Cada especialista tem poucas ferramentas e um objetivo estreito, que é o que faz a escolha certa ficar previsível.
Painel de perspectivas
Vários agentes analisam a mesma coisa por ângulos diferentes e o resultado só passa quando há concordância suficiente. Serve quando errar é caro e vale gastar mais para ter certeza.
Produtor e verificador
Um agente produz, outro tenta derrubar o que o primeiro afirmou, com instruções para desconfiar. O que sobrevive vira resposta. É o que corta a resposta plausível e errada.
Etapas com portão humano
Onde a decisão é sensível, o fluxo para e espera aprovação de gente, com o contexto do que foi feito até ali na tela.
O que vem de série
- Máquina de estados explícita. Transição não declarada levanta erro em vez de passar como criatividade do modelo.
- Teto por etapa e por execução, porque em multi-agente o custo se multiplica silenciosamente.
- Rastro completo: qual agente decidiu o quê, com qual entrada e a que custo.
- Limite de iterações, para que um desacordo entre agentes não vire loop infinito pago por você.
- Isolamento de ferramentas: cada agente só enxerga as funções do próprio escopo, tipadas e declaradas.
- Degradação previsível: se um especialista falha, o coordenador sabe seguir sem ele ou parar, e diz qual dos dois fez.
O agente de pesquisa do portfólio é um sistema de várias etapas em produção: ele planeja as buscas, executa em paralelo, sintetiza citando as fontes, e então revisa a própria resposta e reescreve quando encontra problema. Cada etapa aparece na tela enquanto acontece. Ver funcionando.
O aviso honesto
Multi-agente é mais caro e mais lento que um agente só. Se o seu problema cabe em um agente com quatro ferramentas, é isso que a gente vai recomendar, mesmo sendo o contrato menor.
A pergunta que decide não é quantos agentes, é quantas decisões independentes o processo tem. Duas decisões não justificam quatro agentes.