Record a Skill: como o Claude aprende a usar qualquer programa só de assistir você trabalhar

Renê Fraga
13 min de leitura

Principais destaques

  • 🎥 Anunciado em 21 de julho de 2026, o recurso “Record a Skill” (ensinar uma habilidade), dentro do Claude Cowork, transforma uma gravação de tela narrada em uma Skill reutilizável, sem exigir conexão via API ou MCP com o programa envolvido.
  • 🖱️ Isso resolve um problema real: a maioria dos softwares de negócio, especialmente sistemas corporativos mais antigos e muitas ferramentas de marketing, não tem API nem servidor MCP, o que sempre foi o teto rígido para automação com IA.
  • 💬 A narração falada durante a gravação é o que dá durabilidade à Skill: dizer em voz alta “se o campo estiver vazio, pule esta linha” ensina uma exceção que uma simples sequência de cliques jamais capturaria sozinha.

Um dos recursos mais recentes do Claude Cowork mira um problema que a IA generativa nunca resolveu direito: como automatizar tarefas em softwares que não têm API, nem servidor MCP, nem qualquer forma programática de acesso.

O recurso, chamado Record a Skill, anunciado pela Anthropic em 21 de julho de 2026, permite ensinar o Claude a repetir uma tarefa simplesmente gravando a tela enquanto você a executa, narrando seu raciocínio em voz alta ao longo do caminho. Se uma tarefa pode ser feita clicando pela tela, ela agora pode, em princípio, ser ensinada ao Claude.

Este artigo explica como o recurso funciona, por que ele importa para softwares sem integração, e traz sugestões de prompts e narrações para gravar suas próprias Skills.

🎬 Como o Record a Skill funciona, na prática

O fluxo de trabalho tem três etapas: gravar, refinar e executar.

Gravar. Você abre o recurso pelo menu “+” do aplicativo desktop do Claude, dentro do Cowork, concede acesso ao sistema, e inicia uma gravação. Enquanto você executa a tarefa (clicando em menus, digitando valores, trocando de janela), o Claude registra cada ação como um passo discreto. Ao mesmo tempo, o microfone capta sua explicação falada, que se torna o contexto que a captura de tela sozinha não conseguiria transmitir: por que você está escolhendo uma linha específica em uma tabela, o que um determinado campo significa, ou qual condição deveria interromper o processo.

Refinar. O Claude revisa a gravação e redige um arquivo de Skill (um documento SKILL.md) descrevendo os passos de forma estruturada. Crucialmente, ele não apenas transcreve os cliques: faz perguntas de acompanhamento quando algo parece ambíguo ou parece um erro na demonstração, ajudando a capturar exceções e regras de negócio que não estavam visíveis apenas nos cliques.

Executar. Uma vez que a Skill é salva, ela pode ser invocada em uma nova conversa ou transformada em uma tarefa agendada (por exemplo, “verifique diariamente se há um vídeo novo, e rode esta automação se houver”). Na execução, o Claude assume o controle do navegador através do Claude in Chrome, trabalhando a partir de capturas de tela para decidir o que clicar em seguida com base na Skill escrita, em vez de simplesmente reproduzir coordenadas gravadas ao pé da letra.

🧩 Por que isso importa para softwares sem API

Uma parcela grande do software de negócio, especialmente sistemas corporativos mais antigos e muitas ferramentas de marketing, não tem API nem servidor MCP. Esse sempre foi o teto rígido da automação com IA: sem um gancho programático, um agente de IA não tinha forma confiável de agir dentro daquele software.

O Record a Skill contorna essa limitação tratando a própria interface visual como o ponto de entrada. Em vez de se conectar a um backend, o Claude aprende o padrão visual e procedural da tarefa: qual botão, qual menu, qual sequência. Isso significa que qualquer ferramenta que um humano consiga operar com mouse e teclado se torna candidata à automação, independente de o fornecedor ter construído algum suporte a integração. Isso é particularmente relevante para times presos a softwares corporativos legados que dificilmente ganharão acesso moderno via API, oferecendo um caminho para automatizar tarefas repetitivas sem depender do roteiro de desenvolvimento de um fornecedor.

Vale mencionar, para contexto: a OpenAI oferece um recurso parecido dentro de sua ferramenta Codex, que também consegue gravar fluxos de trabalho e reproduzi-los como Skills reutilizáveis, então essa não é uma abordagem exclusiva do Claude.

⚖️ O Record a Skill substitui completamente o MCP?

Não exatamente, e a distinção importa. MCP e APIs dão à IA acesso direto, estruturado e rápido aos dados e funções subjacentes de um sistema. O Record a Skill dá ao Claude um procedimento aprendido para operar uma interface, o que é mais lento e depende de a interface permanecer visualmente consistente. Como a execução acontece por meio de capturas de tela analisadas passo a passo pelo Claude in Chrome, o processo é mais lento do que uma automação programada ou baseada em API, mesmo eliminando completamente a necessidade de trabalho manual.

O enquadramento prático é este: MCP e APIs continuam sendo a melhor opção sempre que existirem, por serem mais rápidos e menos frágeis a mudanças de interface. O Record a Skill preenche a lacuna para o software que jamais terá esse tipo de acesso, transformando “impossível de automatizar” em “automatizável, ainda que mais devagar”.

🎙️ O papel da narração ao gravar

Dizer em voz alta seu raciocínio enquanto executa a tarefa, como qual linha selecionar ou qual condição checar primeiro, dá ao Claude informação que a captura pura de tela não consegue fornecer. É essa narração que dá durabilidade à Skill gravada: uma frase como “se o total da fatura estiver em branco, pule esta linha” ensina uma exceção que uma sequência muda de cliques jamais capturaria.

Sugestão de roteiro de narração para gravar uma Skill de qualidade:

Ao gravar sua tela, narre em voz alta, com frases curtas, cobrindo:
1. O que você está prestes a fazer e por quê ("agora vou verificar se
   este pedido já foi processado antes de continuar")
2. Como você decide entre opções ambíguas ("estou escolhendo esta linha
   porque a data é mais recente que a outra")
3. Qualquer condição que deveria interromper o processo ("se o campo de
   status estiver vazio, eu paro aqui e sinalizo manualmente")
4. O que "sucesso" significa ao final da tarefa

Grave uma execução completa e realista da tarefa, não uma versão
simplificada, para que o Claude capture exceções e casos reais.

🧪 O que acontece quando você testa a Skill em um exemplo novo

O verdadeiro teste de uma Skill gravada não é se ela repete exatamente a demonstração original, mas se ela generaliza para uma entrada nova. Relatos de uso já publicados sobre o recurso descrevem casos em que, depois de salva uma Skill para automatizar uma tarefa de marketing em uma ferramenta sem API nem MCP, o usuário apagou o exemplo de teste e pediu ao Claude para rodar a mesma Skill contra um dado de entrada diferente do que foi usado na gravação original. O Claude conseguiu identificar corretamente a linha certa em uma tabela de referência (inclusive resolvendo uma ambiguidade entre dois registros com datas parecidas), duplicar o modelo correto, renomear com o novo identificador, casar o item certo em vez de simplesmente pegar o mais recente, e marcar o registro de origem como atualizado ao final. Essa sequência sugere que a Skill capturou a lógica subjacente da tarefa, não apenas memorizou os cliques gravados.

Prompt para testar se sua Skill generalizou bem:

Rode a Skill "[nome da sua Skill]" usando os seguintes dados de entrada,
diferentes dos que foram usados na gravação original. Antes de executar,
explique brevemente qual linha ou item você identificou como
correspondente, e por quê.

Novos dados de entrada:
[DESCREVA UM EXEMPLO DIFERENTE DO USADO NA GRAVAÇÃO]

⚠️ Limitações atuais

O recurso é novo, e alguns pontos merecem atenção prática. Ele está disponível apenas para assinantes dos planos Pro, Max e Team, o que significa que usuários do plano gratuito conseguem usar Skills já existentes, mas não gravar novas. A execução depende de dar ao Claude acesso ao Chrome especificamente, já que as etapas baseadas em navegador rodam através do Claude in Chrome. A abordagem de raciocínio por captura de tela é perceptivelmente mais lenta do que uma integração nativa seria, o que importa para qualquer tarefa sensível ao tempo. E, como a Skill é construída a partir de uma única demonstração, casos de borda não cobertos naquela gravação (dados incomuns, estados diferentes de interface) podem exigir refinamento posterior, em vez de funcionar perfeitamente já na primeira tentativa.

Vale um alerta adicional, levantado por análises independentes do recurso: os detalhes exatos de privacidade e retenção de dados das gravações ainda não estão totalmente documentados pela Anthropic. Como uma gravação de tela pode conter informação bem mais sensível do que um prompt escrito com cuidado, o mais prudente é começar testando o recurso em uma tarefa de baixo risco, repetitiva e fácil de verificar, usando dados fictícios ou sanitizados, antes de considerar seu uso em um fluxo de trabalho com dados reais.

Prompt para revisar uma Skill gravada antes de confiar nela em produção:

Revise o arquivo SKILL.md gerado a partir da minha gravação abaixo.
Aponte:
1. Qualquer passo que dependa de dados sensíveis capturados durante a
   demonstração (senhas, dados de cliente, informações financeiras)
2. Casos de borda que a gravação provavelmente não cobriu
3. Se a lógica descrita depende de uma condição visual muito específica
   da interface, que poderia quebrar se o software mudar

Conteúdo do arquivo SKILL.md:
[COLE O CONTEÚDO GERADO]

O Record a Skill ataca diretamente um dos maiores gargalos da automação com IA: softwares sem API, sem servidor MCP, e sem nenhum caminho programático de acesso, algo comum em sistemas corporativos legados e em muitas ferramentas de marketing.

Ao tratar a própria interface como ponto de entrada, e usar a narração falada para capturar contexto e exceções que uma simples sequência de cliques jamais revelaria, o recurso transforma tarefas antes “impossíveis de automatizar” em tarefas “automatizáveis, ainda que mais lentas”.

Ele não substitui integrações via API ou MCP quando elas existem, mas preenche uma lacuna real para o software que provavelmente nunca terá esse tipo de acesso.

Vale lembrar que, sendo um recurso recém-lançado e restrito aos planos pagos, o caminho mais seguro é testá-lo primeiro em tarefas de baixo risco, com dados sanitizados, antes de confiar nele para processos que envolvam informação sensível.

Apoie o Eurisko
Este conteúdo é independente, sem anúncios e feito por pessoas.
A inteligência artificial e as mudanças recentes do Google reduziram significativamente o alcance dos sites independentes. Se este conteúdo foi útil para você, considere apoiar o Eurisko e todo o ecossistema de projetos com qualquer valor.
Quero apoiar
Seguir
Renê Fraga é fundador e editor-chefe do Eurisko, ecossistema editorial independente dedicado à inteligência artificial, código aberto, tecnologia e cultura digital. Atuando com projetos online desde 1996, escreve há mais de 20 anos sobre tecnologia e inovação, acompanhando a evolução da internet e o impacto das novas tecnologias na forma como vivemos, trabalhamos e pensamos.
Nenhum comentário