Quando usar cada um, o que a Anthropic diz oficialmente, o que a galera tá descobrindo na prática e por que 90% das vezes skill é o caminho.
Skill é um manual de instruções que o Claude Code lê quando precisa. Agente (subagent) é um Claude separado, com janela de contexto própria, que trabalha num canto e devolve o resumo pro Claude principal.
Pensa numa skill como uma pastinha no teu computador com um arquivo de texto dentro. Esse arquivo tem instruções do tipo "quando o usuário pedir X, faz Y, Z, W". Pronto. É isso.
Quando tu abre o Claude Code, ele olha pra essa pasta, vê o nome e a descrição da skill, e guarda um "índice" na memória. Tipo um garçom que sabe o que tem no cardápio mas só vai buscar o prato quando tu pede.
/nome-da-skill."
— Documentação oficial do Claude Code, abril/2026 (tradução livre)
A definição da Anthropic, traduzindo pra gente: "cria uma skill quando tu percebe que tá colando o mesmo roteiro de instruções no chat várias vezes, ou quando uma seção do teu CLAUDE.md virou um procedimento ao invés de um fato". Ou seja: tudo que vira repetição, vira skill.
Um pedacinho no topo do arquivo dizendo como a skill se chama e quando deve ser usada. Isso fica carregado o tempo todo, mas custa quase nada (uns 30-50 tokens por skill, segundo a Anthropic).
O corpo da skill. Só é carregado quando o Claude decide usar aquela skill. Se tu nunca pede, esse texto nunca entra na conversa.
Templates, exemplos, scripts, documentação extra. Ficam na pasta e só entram na conversa se a skill mandar o Claude ler. Pra coisas grandes, isso é ouro.
Isso aqui tem um nome técnico bonito: progressive disclosure. Em português de gente: "carrega só o que precisa, na hora que precisa". É por isso que tu consegue ter 50 skills instaladas sem estourar o custo da sessão.
Um subagent é outro Claude. Não é uma instrução, é uma instância nova. Ele abre uma conversa separada, com a própria memória, as próprias ferramentas, e as próprias permissões. Faz o trabalho num canto e devolve só o resumo pra conversa principal.
Analogia: se a skill é tipo dar um manual pro estagiário que já tá ali contigo na sala, o subagent é tipo mandar um estagiário pra uma sala separada, explicar o que ele tem que fazer, deixar ele trabalhar, e no final ele volta e te conta o que descobriu. Tu não viu o processo, só o relatório.
Pra que isso serve? Principalmente pra manter a janela de contexto principal limpa. Se tu manda o Claude principal ler 20 arquivos pra fazer code review, aquilo tudo vai parar na conversa e vai inchar. Se tu manda um subagent fazer isso, ele lê os 20 arquivos na conversa dele e só devolve "achei 3 bugs, aqui estão".
Comparação direta, sem enrolação, do que muda entre os dois na hora H:
O ponto crucial que quase ninguém explica direito: skill roda dentro da tua conversa, subagent roda numa conversa separada. Essa é a única distinção que importa pra decidir o que usar em 95% dos casos.
No fim de março de 2026, um dev brasileiro chamado Adriano Viana postou no X um teste simples: trocar um fluxo de code review que ele fazia com subagents por um fluxo equivalente feito com skill. O post viralizou com 565 curtidas e 66 mil visualizações e acabou sendo citado pela própria Anthropic internamente.
Esse último número é importante: a própria documentação da Anthropic sobre fluxos multi-agente reconhece que "fluxos com múltiplos agentes usam aproximadamente 4 a 7 vezes mais tokens que sessões de um único agente". Ou seja, não é firula do Adriano, é característica do próprio sistema.
E não é só o caso dele. Um dos posts mais curtidos do r/ClaudeCode descreve exatamente o mesmo caminho:
"Nas férias eu construí um sistema multi-agente (quase) autônomo como prova de conceito. Tava funcionando muito bem, mas era absurdamente faminto por tokens. Apertei ele nos últimos dias e consegui cortar o uso de tokens em quase dois terços."
"Cada agente que tu abre ganha a própria janela de contexto, o que significa que os tokens se multiplicam rapidamente. Subagents não são de graça. Pra um ajuste rápido ou uma pergunta focada, o peso da delegação é maior que o benefício."
Contexto pra quem não é dev: tokens são basicamente a "moeda" do Claude. Cada palavra lida ou escrita consome tokens. Quanto mais tokens, mais caro e mais lento. Quando tu usa um subagent, ele abre uma conversa nova e precisa entender tudo de novo, o que faz esse gasto multiplicar.
Esse é o núcleo do report. Compilei o que a Anthropic fala oficialmente + o que a galera descobriu na prática. Vai um fluxograma mental que funciona em 95% dos casos:
A regra prática que roda no Twitter da galera mais experiente: "começa sempre com skill. Só vira agente se tu provar que precisa". É o inverso do que muita gente tá fazendo, que é partir de agente porque parece "mais profissional".
Quase toda discussão sobre skills vs agentes é na bolha de dev. Mas o Claude Code não é só pra programador. A própria equipe de marketing da Anthropic usa, e a galera que compra o curso do Dudu usa pra marketing, operação, conteúdo e pesquisa. Pros casos não-dev, a resposta é ainda mais óbvia: skill vence quase sempre.
Num post que bombou com 6.500 curtidas e 1 milhão de views, a equipe interna contou que usou skills + Claude Code pra fazer o trabalho de um time de marketing inteiro. "Escalou uma pessoa pro output de um time, 10x mais rápido." Nada de agente complexo, só pastas com instruções bem feitas.
Thread popular no r/ClaudeAI: "duas pessoas no meu time usam Claude Code em tempo integral. Uma constrói o produto, eu construo a máquina de go-to-market em volta. Nenhum dos dois bate no limite regularmente." O segredo? Um CLAUDE.md de 15 linhas + skills por processo. Nada de agentes.
Reddit post com 2.6k upvotes: um cara construiu um sistema que avaliou 740+ vagas, gerou currículos sob medida e rastreou tudo. A descrição do projeto: "o Claude Code lê um CLAUDE.md com 14 modos de skill e age como o motor de tudo". Outra vez: skills, não agentes.
No vídeo "operação de marketing sem agentes, só skills", o Dudu mostra 7 etapas do fluxo diário dele rodando 100% com skills: planejamento de Google Ads, criativos de Meta Ads, relatórios de tráfego, carrosséis pro Instagram, deploy de LPs, automação de DM. Nenhum agente. Uma sessão do Claude Code só.
Se tu não é dev, pensa assim: tu raramente vai ter uma tarefa que precisa "ler um monte de arquivo num canto limpo antes de decidir". Tuas tarefas são quase sempre procedimentos, tipo "quando eu pedir carrossel, faz assim", "quando eu pedir relatório de ads, traz esses dados nessa ordem". Isso é skill 100% das vezes.
Coletei os posts mais curtidos e mais comentados sobre o tema nos últimos 60 dias. A leitura geral é clara: a comunidade tá migrando de subagents pra skills, especialmente depois que a linha entre os dois ficou borrada (skills agora podem rodar em contexto isolado com context: fork, o que fez muita gente perguntar "então pra que serve subagent mesmo?").
"Skill = adiciona conhecimento de especialista ao contexto do agente principal. Subagent = trabalhador com contexto separado. Usa pra preservar o contexto do agente principal e acelerar buscas com paralelização. Não é tão confuso quanto parece."
"Meu setup tava inchado. Tinha 15 plugins, 8 servidores MCP, 30 slash commands rodando ao mesmo tempo. O Claude começou a agir esquisito, respostas lentas, às vezes confuso sobre quais ferramentas tinha. Aí eu desinstalei tudo e comecei do zero."
"Se tu configura context: fork, define ferramentas específicas e deixa a invocação automática ligada, tu tem uma 'skill' que roda no próprio contexto isolado, com ferramentas específicas, e é chamada automaticamente pelo Claude quando precisa. Que é praticamente o que um subagent é."
"Comparando custo de tokens: agentes são caros (15k só pra inicializar, rodam em paralelo mas sobrecarregam o contexto) vs skills baratas e em fluxo único. Usa skills dentro de agentes pra reaproveitar, evita agente pra tarefa simples."
"Heavy users no plano de US$ 200/mês batendo US$ 5 mil/mês em custos equivalentes de API. Os subsídios vão acabar. Setups pesados em agentes são o principal suspeito."
Do outro lado, tem gente defendendo subagents pra casos específicos. O post oficial do perfil @claudeai mostrando o novo Code Review feature teve 62 mil curtidas e 23 milhões de views, e é justamente sobre "um time de subagents caçando bugs em PRs grandes". Ou seja: tem uso legítimo, só não é 90% dos casos.
Nem tudo são flores. Cada abordagem tem armadilha. Se tu for decidir, precisa saber das duas.
Se tu precisa rodar 3 análises ao mesmo tempo, skill não resolve, porque tudo roda na mesma conversa em sequência. Aí agente ganha.
Uma vez que a skill é invocada, o conteúdo dela fica na conversa. Se tu carrega muitas skills grandes, vai inchar. Segundo a doc: 25k tokens de budget após compaction. Usa skill focada, não monstro.
Isso pega muita gente. Se tu configurou 10 skills pro teu projeto, o subagent chega "zerado". Tem que listar as skills explicitamente no frontmatter dele. A coordenação fica mais trabalhosa.
Limitação explícita da Anthropic pra evitar loop infinito. Se tu quer orquestração complexa de vários níveis, precisa de "agent teams", que é um recurso separado e bem mais caro.
Como ele trabalha num canto, tu não vê o raciocínio ao vivo. Só o resultado. Pra iterar e ajustar, tem que ficar abrindo a sessão dele, o que quebra o flow.
Em 2026 a Anthropic uniu slash commands com skills, adicionou context: fork que faz skill virar quase-subagent, e tem atualizações semanais. Qualquer tutorial de 3 meses atrás já tá desatualizado. Prefere as docs oficiais.
A posição da Anthropic ficou mais clara depois do blog post "Skills explained" de março/2026, que saiu justamente porque a comunidade tava confusa. Resumindo o que eles dizem:
context: fork. A arquitetura é flexível.Esse é o "cola" que tu pode printar e deixar do lado do monitor. Da próxima vez que tu pensar "hmm, vou criar um agente pra isso", passa por essas perguntas primeiro:
Eu já tinha postado dois vídeos sobre times de agentes no Claude Code que explodiram e foram os que fizeram o canal decolar. E em todos esses vídeos eu disse: apesar de estar mostrando agentes, não é assim que eu faço meu fluxo no dia a dia. Faço com skills e pastas. Esse report só veio confirmar por que.
A conta não fecha pra agente na maioria dos casos. O Adriano mostrou 93% de economia de token num teste isolado, mas o mais impressionante pra mim não é o número, é o tempo: 10x mais rápido. Na prática, isso significa que enquanto o cara do agente ainda tá esperando o sistema terminar, tu já fez, revisou, ajustou e publicou. Velocidade é produto, não só economia.
Pra quem não é dev, o caso é ainda mais fácil: tuas tarefas são procedimentos. "Quando eu pedir carrossel, faz assim. Quando eu pedir relatório de ads, traz isso. Quando eu pedir pra publicar, roda esse script." Isso é o DNA de uma skill. Criar um agente pra fazer carrossel é tipo mandar um funcionário pra uma sala separada só pra ele escrever 3 parágrafos. Não faz sentido.
Os casos que realmente pedem agente existem, e eu uso às vezes: quando o Claude vai ler o repositório inteiro antes de propor uma refatoração, ou quando eu quero um "code review" com visão limpa. Mas isso é 5% das minhas sessões, não 90%. A regra que eu sigo: começa skill, só vira agente se a conta do token doer ou se a conversa começar a ficar confusa pela quantidade de arquivo lido. Tu vai descobrir na marra que quase nunca é o caso.
5 módulos, 21 aulas, do zero ao operacional completo rodando dentro do Claude Code. Marketing, criativos, tráfego, publicação, automação. Nada de agente complicado.
Ver o curso →Começando agora? Leia o guia de como aprender a usar o Claude Code no trabalho.