Guia Técnico
Claude Agent SDK: O que faz e como avaliá-lo

O Claude Agent SDK é uma interface de desenvolvimento para criar aplicativos que permitem ao Claude executar fluxos de trabalho delimitados que utilizam ferramentas. O SDK pode gerenciar sessões, invocar ferramentas e coordenar o trabalho, mas não elimina a necessidade de permissões de aplicativo, controles de versão, avaliação ou aprovação humana. Trate-o como um componente de tempo de execução do agente, não como um sistema de produção completo.
Para equipes que precisam concluir trabalhos baseados em código-fonte sem possuir um ambiente de execução de agente, o Ottermind oferece o caminho do espaço de trabalho gerenciado: mantenha arquivos, contexto de pesquisa, decisões e entregas conectados enquanto uma pessoa revisa o resultado. O SDK e um espaço de trabalho gerenciado resolvem problemas operacionais diferentes.
Pesquisa e divulgação: Este guia é baseado no Repositório Claude Agent SDK, Documentação de uso da ferramenta Anthropic e Documentação do AgentCore AWS Claude Agent SDK. AWS AgentCore Claude Agent SDK, revisados em 3 de setembro de 2026. APIs e limites estão em constante evolução; verifique a versão atual antes da implementação.
Os principais componentes
| Componente | Responsabilidade | Controle de aplicativos |
|---|---|---|
| Sessão | Mantém uma execução e seu estado de conversação | Expiração, isolamento e registro de auditoria |
| Modelo | Interpreta o contexto e propõe etapas | Versão do modelo, orçamento e contrato de saída |
| Ferramenta | Executa uma operação limitada | Esquema, tempo limite, permissão e idempotência |
| Subagente | Gerencia uma função genuinamente separada | Escopo, orçamento e regras de escalonamento |
| Modo de permissão | Controla o que o agente pode acessar ou alterar | Lista de permissões e confirmação humana |
| Resultado | Retorna texto, dados estruturados ou artefatos | Validação e transferência para o revisor |
Comece com uma tarefa reversível
Crie um protótipo de um fluxo de trabalho com muitas leituras, como transformar arquivos de repositório aprovados em um resumo de alterações. Capture o conjunto de entrada, o prompt, a versão do modelo, as chamadas de ferramentas, a saída, as correções do revisor e a decisão final. Adicione acesso de gravação somente depois que o rastreamento for compreensível e as falhas forem recuperáveis.
Um contrato de tarefa mínimo
Objetivo: produzir um resumo de implementação baseado no código-fonte.
Fontes permitidas: apenas os arquivos do repositório anexado.
Ferramentas permitidas: listar e ler arquivos; sem gravações ou chamadas de rede.
Saída: descobertas, alterações propostas, evidências, riscos e questões em aberto.
Parar quando: uma fonte necessária estiver faltando ou as permissões não estiverem claras.Sessões e subagentes
Use uma sessão quando o fluxo de trabalho precisar de continuidade em várias etapas. Use um subagente somente quando a função, as ferramentas ou os critérios de avaliação forem realmente diferentes. Mais agentes aumentam a coordenação, a latência e os caminhos de falha. Passe o contexto mínimo necessário para cada função e retorne resultados estruturados com status e evidências.
Uma arquitetura prática
Mantenha o SDK atrás de um limite de aplicação com cinco responsabilidades:
- Manipulador de requisições: autentica o usuário, seleciona o projeto permitido e define um orçamento.
- Carregador de contexto: recupera apenas os arquivos permitidos e registra seus identificadores e datas.
- Executor de agentes: inicia a sessão, fornece as ferramentas e persiste cada requisição e resultado da ferramenta.
- Camada de políticas: valida os argumentos, bloqueia ações não permitidas e solicita confirmação.
- Adaptador de resultado: valida o formato retornado e entrega um rascunho ao revisor ou ao próximo sistema.
Essa separação é importante porque o SDK pode ajudar o modelo a solicitar uma ferramenta, mas é o seu aplicativo que decide se essa solicitação é permitida. Não coloque lógica de autorização em um prompt nem assuma que um modelo preservará os limites do locatário por si só.
Sessões, retomada e falha
Atribua a cada execução um identificador explícito e um estado final, como completed, needs_review, blocked ou failed. Persista a versão do modelo e do SDK, a revisão do prompt, as fontes de entrada, as chamadas de ferramentas e a decisão do revisor. Se ocorrer um erro de rede após uma gravação, use uma chave de idempotência e consulte o sistema de registro antes de tentar novamente. Se uma sessão for retomada após uma edição humana, inclua o artefato editado e o motivo da alteração, em vez de reproduzir uma conversa obscura.
Exemplos de design de ferramentas
Prefira uma função como create_draft_task(title, owner, due_date) a uma ferramenta de shell de uso geral. A função específica pode impor formatos de data, proprietários permitidos, escopo do projeto e um status de somente rascunho. Uma ferramenta de busca de arquivos deve retornar identificadores e trechos de arquivos, e não expor silenciosamente uma unidade inteira. Uma ferramenta de navegador deve usar uma lista de permissões e interromper a busca antes da autenticação ou do pagamento.
Custos e latência
Defina orçamentos antes do início da execução: número máximo de iterações do modelo, chamadas de ferramentas, tokens, tempo decorrido e número de subagentes. Direcione a extração para um modelo menor quando a qualidade permitir e reserve o raciocínio complexo para etapas ambíguas. Registre o uso real com o resultado para que uma demonstração bem-sucedida não oculte um fluxo de trabalho antieconômico. Tarefas longas devem ser assíncronas, canceláveis e visíveis para o usuário.
SDK versus um espaço de trabalho gerenciado
Desenvolva com o SDK quando sua equipe precisar de ferramentas específicas do aplicativo, controle de implantação ou um ambiente de execução personalizado e puder gerenciar a segurança, a observabilidade e a manutenção. Um espaço de trabalho gerenciado é um ponto de partida melhor quando o principal requisito é conectar arquivos, pesquisas, decisões e entregas para revisão humana. A escolha se baseia na responsabilidade operacional, não em qual rótulo soa mais autônomo.
Exemplo: um agente de pesquisa para briefing
Imagine uma equipe que precisa de um relatório semanal sobre a concorrência. O manipulador de requisições verifica a identidade do analista e seleciona o projeto aprovado. O carregador de contexto recupera a lista de fontes e registra a data da recuperação. A sessão do agente pode chamar apenas search_approved_sources e draft_brief. A camada de política rejeita solicitações para URLs arbitrárias, postagens externas ou arquivos fora do projeto. O adaptador de resultados exige seções para descobertas, citações, incertezas e questões em aberto antes de apresentar o rascunho a um revisor.
O artefato útil não é apenas o texto final. É o rastreamento: quais fontes estavam disponíveis, quais ferramentas foram chamadas, o que foi bloqueado, o que o revisor alterou e se o relatório foi aceito. Esse rastreamento auxilia na depuração, análise de custos e em um conjunto de avaliação repetível quando o modelo ou o SDK são alterados.
Controle de versões e atualizações
Fixar as versões do SDK e do modelo em cada ambiente. Leia as notas de versão para obter informações sobre alterações nos modos de permissão, esquemas de ferramentas, comportamento da sessão e modelos compatíveis. Execute testes de regressão antes de atualizar, incluindo um teste que confirme se as ferramentas proibidas permanecem proibidas. Mantenha uma versão de reversão disponível e evite atualizar no meio de um fluxo de trabalho de longa duração sem um plano de migração.
Lista de verificação de prontidão para produção
- A autenticação e as verificações de locatário ocorrem antes da recuperação do contexto.
- Cada ferramenta possui um esquema restrito, tempo limite e verificação de autorização.
- As sessões possuem orçamentos, cancelamento, expiração e estados terminais.
- As saídas são validadas antes de chegarem a um sistema de registro.
- Ações sensíveis exigem um evento de aprovação humana explícita.
- Os registros contêm informações suficientes para reproduzir uma falha sem armazenar segredos.
- Os casos de avaliação abrangem qualidade, segurança, custo e latência.
Limites de permissão e segurança.
Validar os argumentos da ferramenta no código do aplicativo. Mantenha as credenciais fora dos prompts, limite o acesso ao sistema de arquivos e à rede, defina tempos limite e exija confirmação para envio, exclusão, compra ou alteração de acesso. Registre cada chamada de ferramenta subsequente com a identidade do responsável e a decisão de aprovação.
Avalie o fluxo de trabalho, não a demonstração.
Crie um conjunto de testes com casos normais, incompletos, contraditórios, adversários e sensíveis a permissões. Meça a conclusão correta, a escalação segura, os erros da ferramenta, a latência, o custo e as correções do revisor. Fixe as versões do modelo e do SDK para cada execução de avaliação.
Perguntas frequentes
O Claude Agent SDK é o mesmo que o uso da ferramenta API Claude?
Não. O uso de ferramentas é um padrão de interação de modelo. O SDK fornece mais blocos de construção em nível de aplicativo para sessões e fluxos de trabalho de agentes, enquanto seu aplicativo ainda detém a política, o armazenamento, as permissões e a avaliação.
Preciso de vários agentes?
Geralmente não inicialmente. Um agente com ferramentas específicas e pontos de verificação explícitos é mais fácil de testar e operar.
O SDK pode editar arquivos ou executar comandos com segurança?
Ele pode ser conectado a essas ferramentas, mas a segurança vem do seu sandbox, listas de permissões, validação, revisão e design de reversão. Nunca trate um comando gerado como pré-aprovado.
Para o limite mais amplo do sistema, consulte Arquitetura do agente de IA e Segurança do agente de IA.
