IA
Como executar um agente do Claude Agent SDK no WhatsApp (com a MonoChat)
O Claude Agent SDK é o harness por trás do Claude Code. Veja como colocar um agente do Claude Agent SDK diante dos seus clientes no WhatsApp, o que muda quando a conversa acontece em um aplicativo de mensagens e como mantê-lo seguro com modelos de fallback, orçamentos e transferência para uma pessoa.
Equipe MonoChat Atualizado: 7 min de leitura
Nesta página
- O que é o Claude Agent SDK (e por que combina com suporte)
- Três formas de usar agentes Claude na MonoChat
- Passo a passo: um agente do Claude Agent SDK no WhatsApp
- Como escrever instruções para um agente de WhatsApp
- Transferência: a parte que define a confiança
- Custos e controle
- Quando escolher outro harness
O Claude Agent SDK é o agent harness da Anthropic: o mesmo ciclo de raciocínio, uso de ferramentas e autoverificação que alimenta o Claude Code, empacotado para que desenvolvedores criem seus próprios agentes. Para executar um no WhatsApp, você precisa de mais três coisas ao redor dele: uma conexão com a WhatsApp Business Platform, uma forma de dar ao agente as ferramentas do seu negócio e um caminho seguro até uma pessoa quando o agente deve parar. Com o Agent Harness da MonoChat, você adiciona o Claude Agent SDK como um Harness de IA, coloca um nó de Agente de IA em um fluxo, conecta seu número do WhatsApp e testa. Sem servidores para operar.
Este guia explica o que o Claude Agent SDK traz para as conversas com clientes, como a configuração funciona na MonoChat e o que acertar antes de os clientes começarem a escrever.
O que é o Claude Agent SDK (e por que combina com suporte)
A maior parte da IA no WhatsApp hoje é uma única chamada de modelo: chega uma mensagem, o modelo escreve uma resposta e pronto. Isso serve para “Qual é o horário de funcionamento?”. Mas falha em “Meu pedido não chegou e viajo na sexta.”
Um harness executa o modelo em um ciclo. O modelo decide o que fazer em seguida, o harness executa essa etapa (consultar algo, chamar uma ferramenta, ler um arquivo), devolve o resultado e repete até a tarefa terminar ou uma pessoa ser necessária. O Claude Agent SDK é a versão da Anthropic desse ciclo. É a base do Claude Code e traz os blocos de construção em que os desenvolvedores confiam lá: uso de ferramentas, suporte a MCP, subagentes, gerenciamento de contexto para sessões longas e controles de permissão.
No atendimento por mensagens, esse ciclo é o que transforma uma resposta em uma resolução:
- Ele confere antes de prometer. Estoque, status de entrega, horários disponíveis ou uma regra de reembolso são consultados no momento da resposta, em vez de adivinhados.
- Ele conduz um caso em várias etapas. Encontrar o pedido, verificar a transportadora, ver que o pacote está parado, oferecer uma reposição, tudo em uma só conversa.
- Ele sabe quando parar. Um bom harness passa o caso a uma pessoa em vez de improvisar quando chega ao limite do que pode fazer.
Se quiser entender melhor a diferença entre harnesses e inferência simples, leia o que é um agent harness e por que o atendimento pelo WhatsApp precisa de um.
Três formas de usar agentes Claude na MonoChat
A MonoChat oferece três caminhos para um agente com tecnologia Claude. Os três usam o mesmo nó de Agente de IA, os mesmos canais e a mesma transferência.
| Opção | Onde é executado | O que você precisa |
|---|---|---|
| Claude Agent SDK | Agent runner da MonoChat; cada execução é um processo de agente isolado no estilo do Claude Code | Nada extra; seus modelos de IA pelo gateway da MonoChat |
| Claude Managed Agents | Nuvem da Anthropic | Sua chave de API da Anthropic |
| Personalizado (seu próprio serviço do Claude Agent SDK) | Seu próprio servidor | Uma URL de endpoint e um segredo compartilhado |
Para a maioria das equipes, a primeira opção é o melhor começo: você obtém o harness do Claude Agent SDK sem implantar nem manter nada. Escolha o Claude Managed Agents se você já cria com os agentes hospedados da Anthropic e quer mantê-los lá. Escolha o Personalizado se seus desenvolvedores criaram e testaram o próprio agente com o SDK e querem continuar executando-o na própria infraestrutura; nosso guia sobre como conectar seu próprio agente de IA ao WhatsApp cobre esse caminho.
Passo a passo: um agente do Claude Agent SDK no WhatsApp
1. Adicione um Harness de IA
Na MonoChat, um Harness de IA é uma definição de serviço que você adiciona uma vez e reutiliza. Adicione um e escolha o Claude Agent SDK como provedor. Não há mais nada a configurar no provedor em si: ele roda no agent runner da MonoChat e acessa seus modelos de IA pelo gateway da MonoChat.
2. Adicione um nó de Agente de IA a um fluxo
Abra o fluxo que trata as conversas recebidas, ou crie um novo, e adicione um nó de Agente de IA. Selecione o harness que você acabou de criar. É aqui que o agente recebe sua função: escreva instruções que descrevam quem ele atende, o que pode fazer e quando deve passar a conversa adiante.
3. Escolha os modelos principal, de fallback e rápido
Cada nó de Agente de IA tem três funções de modelo:
- Modelo principal: raciocina, decide e escreve as respostas.
- Modelo de fallback: assume após um limite flexível ou quando o modelo principal falha, para que o cliente ainda receba uma resposta.
- Modelo rápido: cuida do trabalho em segundo plano.
Defina também um limite de orçamento por execução. Uma conversa com cliente raramente precisa de uma longa cadeia de etapas, e um orçamento impede que um caso incomum se torne caro. Nosso artigo sobre por que o seu agente que atende clientes precisa de um modelo de fallback explica como escolher a dupla.
4. Dê ferramentas ao agente
Um agente sem ferramentas só consegue conversar. Na MonoChat, o agente pode usar:
- Ferramentas de função de IA para chamar suas APIs com entradas estruturadas, por exemplo “obter status do pedido” ou “criar uma devolução”.
- Servidores MCP para trazer ferramentas de qualquer sistema compatível com MCP.
- A base de conhecimento com IA para respostas baseadas nas suas próprias políticas e documentos.
- Funções personalizadas para lógica de negócio executada dentro da conversa.
Comece com duas ou três ferramentas que cubram as solicitações mais comuns. Cada ferramenta que você adiciona é mais uma coisa que o agente pode fazer e mais uma coisa a testar.
5. Conecte o WhatsApp e seus outros canais
Conecte seu número do WhatsApp Business à MonoChat, se ainda não o fez (a MonoChat é Meta Business Partner oficial e usa a WhatsApp Business Platform oficial). Como o agente vive em um fluxo, você pode associar o mesmo fluxo ao Instagram, ao Messenger, ao TikTok, ao Telegram, ao chat web, ao SMS e à voz sem refazer nada.
6. Teste e depois entre no ar
Envie ao agente as mensagens que seus clientes realmente enviam: curtas, com erros de digitação, em mais de um idioma, três perguntas em uma só mensagem. Verifique se ele usa a ferramenta certa, se respeita suas regras e se transfere no momento certo. Depois ative o fluxo para o tráfego real.
Como escrever instruções para um agente de WhatsApp
O Claude Agent SDK nasceu na programação, onde respostas longas e detalhadas são bem-vindas. O WhatsApp é o oposto. Algumas regras fazem uma grande diferença:
- Mantenha as respostas curtas. Duas ou três frases por mensagem, uma pergunta por vez. Os clientes leem no celular.
- Confirme antes de agir. “Posso cancelar o pedido 4821 e reembolsar €39. Posso continuar?” antes de qualquer coisa que custe dinheiro ou não possa ser desfeita.
- Nomeie a regra de transferência explicitamente. Por exemplo: “Passe para uma pessoa em reclamações sobre funcionários, ameaças jurídicas, reembolsos acima de €100 ou quando o cliente pedir um atendente humano.”
- Fique dentro do seu negócio. Desde 15 de janeiro de 2026, os termos do WhatsApp mantêm assistentes de IA de uso geral fora da plataforma. Um agente que atende os seus próprios clientes é permitido; um que escreve redações sobre qualquer assunto, não. Nosso guia da política de chatbots de IA do WhatsApp explica a regra.
- Respeite a janela de 24 horas. Respostas livres são permitidas dentro de 24 horas após a última mensagem do cliente. Depois disso, uma mensagem precisa de um template aprovado.
Transferência: a parte que define a confiança
Os clientes perdoam um agente que diz “Vou chamar um colega.” Não perdoam um que fica em círculos. Na MonoChat, o agente passa a conversa para sua equipe na caixa de entrada compartilhada com todo o histórico: o que o cliente perguntou, o que o agente consultou e o que já tentou. A pessoa que assume não precisa pedir ao cliente que comece de novo.
Planeje suas regras de transferência antes de planejar suas ferramentas. Decida quais casos o agente nunca deve tratar sozinho, quem os recebe e o que o agente diz ao cliente enquanto ele espera.
Custos e controle
Com um agente, há duas linhas de custo além do seu plano da MonoChat: o uso dos modelos de IA e as tarifas do WhatsApp da Meta. Desde 1º de outubro de 2026, a Meta cobra as respostas de atendimento depois das primeiras 1.000 por número comercial a cada mês; nosso guia de preços da API do WhatsApp traz os detalhes.
Do lado da IA, a MonoChat não acrescenta nenhum valor quando você usa as chaves dos seus próprios provedores. Um limite de orçamento por execução, um modelo de fallback adequado e um modelo rápido para o trabalho em segundo plano mantêm o uso previsível conforme o volume cresce.
Quando escolher outro harness
O Claude Agent SDK é uma excelente opção padrão para agentes que precisam raciocinar em várias etapas. Mas o Agent Harness foi criado para que você não fique preso a um fornecedor. Se sua equipe já trabalha com o OpenAI Agents SDK, o Pi, um agente hospedado da OpenAI ou da Anthropic, ou um framework próprio, você pode adicionar outro Harness de IA e trocar o nó de Agente de IA, sem mexer nos seus canais, nas suas ferramentas nem na transferência. Veja todas as opções na página do Agent Harness.
Coloque isso em prática com o MonoChat