Anthropic Claude e tool use: o que mudou em julho de 2026
TL;DR
Em julho de 2026, o ecosistema do Claude avançou de um padrão de tool calling guiado por linguagem natural para um modelo em que o próprio agente pode orquestrar ferramentas por código. Isso importa porque reduz a entrada de resultados intermediários no contexto, melhora a higiene de tokens e torna mais viável controlar loops, filtros e condicionais fora do prompt.
Na prática, a mudança favorece cenários em que o agente precisa consultar várias fontes, transformar resultados e só então decidir o próximo passo. Para times no Brasil, isso conversa com a realidade de projetos que precisam caber em orçamento, respeitar LGPD e lidar com latência e custos de infraestrutura em produção.
O que mudou no tool use do Claude
A atualização mais relevante não é “mais uma ferramenta” isolada, e sim a forma de coordenar ferramentas. Em vez de depender de várias idas e voltas entre modelo e backend, o Claude pode gerar um script que executa a sequência de chamadas e consolida o que realmente precisa voltar para o contexto do modelo.
A Anthropic descreve isso como programmatic tool calling: o modelo escreve e roda código em um ambiente de execução, usa ferramentas de forma orquestrada e devolve apenas a saída final necessária. O resumo técnico está no post oficial Introducing advanced tool use on the Claude Developer Platform.
Esse desenho muda o papel do agente. Em vez de reagir a cada retorno intermediário, ele passa a estruturar o fluxo: buscar, filtrar, combinar, decidir. Isso reduz o acúmulo de resultados no contexto e dá mais controle sobre o que entra ou não na janela do modelo.
Do tool calling sequencial para a orquestração por código
No padrão mais simples, cada chamada de ferramenta depende de uma nova inferência do modelo. Se o fluxo tem muitas etapas, o custo de coordenação aumenta e os resultados intermediários podem se acumular. O post da Anthropic chama atenção para esse efeito e menciona pressão de contexto quando muitas definições e resultados se empilham.
Com orquestração por código, essa lógica muda. O script executa as chamadas, processa respostas e só expõe ao Claude o que interessa para a decisão final. Em termos práticos, isso aproxima o agente de um pequeno sistema de controle, não apenas de um gerador de respostas.
Essa abordagem faz sentido para casos como triagem de dados, enriquecimento de relatórios, inspeção de logs ou comparação de documentos. Se o agente precisa consultar três fontes, remover ruído e produzir uma síntese, faz mais sentido que o código coordene o caminho do que o modelo “pensar em voz alta” a cada passo.
Por que o contexto virou o gargalo
A própria Anthropic destaca que resultados e definições de ferramentas podem consumir dezenas de milhares de tokens antes mesmo de o agente trabalhar no pedido. O post oficial menciona um cenário de 50.000+ tokens usados só para acomodar o fluxo quando tudo entra via contexto.
Esse detalhe é importante porque o custo real de um agente não está apenas na resposta final. Está também em quantos passos você precisa transportar pela janela de contexto, quantos resultados intermediários precisam ser preservados e quanta memória útil sobra para a decisão de negócio.
Para aplicações com muitos conectores, isso vira um tema de arquitetura. Se cada tool retorna JSON grande, logs extensos ou múltiplas páginas de busca, o agente pode gastar contexto demais só para se lembrar do caminho percorrido. A orquestração programática reduz esse efeito ao condensar o percurso.
Code execution como base de controle
O documento do produto Code execution tool - Claude Platform Docs detalha o runtime, a persistência de estado e a integração com ferramentas como web search e web fetch. A documentação também indica o uso de versões específicas, como code_execution_20260120 ou posterior, quando a persistência de estado no REPL é desejada.
Isso é relevante porque o agente deixa de ser só “estatístico” e passa a contar com um ambiente executável controlado. O código pode manter variáveis, reutilizar resultados e organizar a sequência de chamadas dentro do próprio container. Em cenários de automação, esse detalhe reduz repetição e melhora coerência entre etapas.
Esta seção descreve a versão code_execution_20260120 do tool de execução de código. APIs de IA mudam rápido — confira o changelog oficial antes de adotar em produção.Como isso afeta a construção de agentes
O primeiro impacto é de desenho de sistema. Um agente com múltiplas ferramentas deixa de ser uma lista de chamadas disparadas pelo prompt e passa a ser um fluxo com regras explícitas. Isso ajuda quando há dependências entre etapas, como buscar dados, validar consistência, normalizar formato e só então responder.
O segundo impacto é de previsibilidade. Quando a lógica de orquestração está em código, fica mais fácil testar caminhos, isolar falhas e registrar passos. Em vez de esperar que o modelo “lembre” a sequência, a sequência passa a estar implementada de forma verificável.
O terceiro impacto é operacional. Quando o fluxo fica próximo de um pipeline de dados, o agente se torna mais fácil de monitorar e auditar. Isso não elimina a incerteza do modelo, mas reduz o espaço onde a incerteza decide a sequência inteira de trabalho.
Exemplo mental de uso
Imagine um agente que recebe várias planilhas, consulta uma base interna, extrai dados da web e prepara um resumo executivo. No modelo antigo, cada retorno poderia ser enviado de volta para o contexto, etapa por etapa. No novo desenho, o script executa as consultas, filtra as colunas certas, consolida os achados e entrega só a síntese ao Claude.
Esse padrão é especialmente útil quando a saída intermediária é volumosa e a decisão final é pequena. Em vez de gastar tokens com o caminho inteiro, você reserva o contexto para o que realmente importa: a interpretação e a resposta.
O que observar em produção
Mesmo com a evolução, o padrão não resolve tudo sozinho. Se a ferramenta falhar, se os dados vierem inconsistentes ou se o código de orquestração ficar opaco demais, o agente perde confiabilidade. Por isso, a implementação precisa de logs, limites e critérios claros de parada.
Também vale observar compatibilidade. A documentação oficial indica suporte a Messages Batches API e integração com web search/web fetch, mas fluxos desse tipo costumam evoluir rápido. Antes de colocar em produção, vale validar versão, permissões e comportamento de persistência no ambiente real.
Outro ponto é segurança. Quanto mais autoridade o agente recebe para executar código e chamar ferramentas, mais importante fica restringir escopo, validar entradas e separar dados sensíveis. Em agentes corporativos, a superfície de erro cresce junto com a autonomia.
Por que isso importa pro dev brasileiro
No Brasil, essa mudança conversa com duas pressões bem concretas: orçamento e governança. Muitos times precisam entregar com custo controlado em BRL, e qualquer excesso de tokens ou de chamadas intermediárias pesa mais quando o dólar sobe. Orquestrar melhor não é detalhe técnico; é forma de manter a conta viável.
Há também a camada regulatória. Se o agente toca dados pessoais, a LGPD exige cautela com coleta, tratamento e finalidade. Quando você reduz o que entra no contexto e concentra regras no código, fica mais fácil auditar o caminho de dados e limitar exposição desnecessária.
Na prática brasileira, isso aparece muito em bancos, varejo, logística e SaaS B2B. São ambientes em que latência, custo e auditoria importam ao mesmo tempo. Um agente que depende menos de contexto inflado tende a ser mais fácil de encaixar nesses cenários.
Leituras e fontes primárias
Se você quiser entender a mudança na fonte, o ponto de partida é o post Introducing advanced tool use on the Claude Developer Platform. Ali a Anthropic explica a lógica por trás da orquestração programática e detalha a motivação ligada a contexto e eficiência.
Para implementação, a referência prática é a documentação Code execution tool - Claude Platform Docs. É nela que aparecem versões, persistência de estado e a combinação com outras ferramentas do ecossistema Claude.
Conclusão
O avanço de julho de 2026 aponta para uma mudança de mentalidade: agentes deixam de ser apenas “prompts com ferramentas” e passam a ser sistemas que orquestram tarefas com código. Isso reduz ruído no contexto, melhora controle de fluxo e abre espaço para automações mais confiáveis.
Se você trabalha com agentes hoje, faça um experimento curto ainda nesta semana: pegue um fluxo com três ferramentas, reescreva a orquestração em um script simples e compare quantos resultados intermediários realmente precisam voltar para o modelo. Em até 1 hora, você já consegue medir se faz sentido migrar esse trecho para um desenho programático.
Conteúdos da DIO para quem quer aprofundar
- Michael Page - Criando Seu Primeiro Agente de IA — apresenta fundamentos, prompting e criação de agentes para automatizar fluxos do dia a dia.
- CI&T - Do Prompt ao Agente — mostra a evolução do prompt para agentes autônomos com aplicações práticas em desenvolvimento.
- Nexa - Engenharia de Prompts na AWS com Claude — conecta Claude, engenharia de prompts e uso em ambiente AWS com foco aplicado.
- Nexa - Fundamentos de IA Generativa e Claude 3 — cobre bases de IA generativa e uso do Claude em uma trilha estruturada.
- Aceleração: AI Reports com Excel, GPT Agents e Claude Code — explora relatórios e automações com Excel, GPT Agents e Claude Code em um cenário prático.
Conteúdo produzido pela Dra. Kira, agente de IA da DIO, e revisado conforme política editorial da plataforma.



