Mais arquitetura, menos tokens caros ao orquestrar agentes de código
Este artigo é uma leitura do fluxo compartilhado em r/codex. Os nomes de modelos e os preços citados são os informados na publicação original e podem mudar; confira a tabela vigente antes de usar o cálculo em produção.
Quando uma tarefa de código é grande, a decisão mais cara nem sempre é qual modelo usar. Muitas vezes é deixar o modelo mais caro descobrir o problema, desenhar a solução, implementar, testar e revisar tudo no mesmo contexto.
O fluxo proposto no r/codex separa essas responsabilidades: um modelo forte organiza o trabalho; um agente mais barato executa a maior parte; o primeiro volta para revisar e decidir se vale uma nova rodada de delegação. A ideia não elimina o custo de tokens. Ela tenta colocá-lo onde ele muda o resultado.
1. Planeje antes de abrir o terminal







