Como conferir uma ferramenta de programação que a IA recomendou?
Resposta curta: rode quatro conferências que juntas levam cerca de um minuto, e rode contra o endereço que o assistente te deu, nunca contra o nome que ele usou. O link ainda responde, o repositório por trás dele é mesmo o que foi citado, esse repositório continua recebendo código, e a página da própria ferramenta diz o que ela é sem JavaScript. Rodamos isso em todos os links que dois assistentes de IA nos deram em 10 de agosto de 2026: um dos vinte endereços não resolve, e para um dos nomes a busca no GitHub devolve um projeto diferente do que o assistente citou, com 37 vezes mais estrelas.
A regra de partida é a que nos custou mais caro. Na primeira vez que rodamos isto, tiramos os nomes das ferramentas das respostas e fomos procurar nome por nome. Aquilo produziu três identificações erradas seguidas, porque nome não é endereço: o mesmo nome pode pertencer a um domínio morto, a outro produto em outro domínio de topo, e a dois repositórios distintos. Por isso tudo aqui começa pela URL que o modelo imprimiu. Todos os números foram medidos em 13 de agosto de 2026 com os comandos mostrados, em shell POSIX com curl e grep.
O que as quatro conferências olham, e quanto tempo levam?
As quatro conferências respondem a quatro perguntas diferentes sobre uma ferramenta recomendada, e nenhuma exige conta, token ou API paga. A primeira pergunta se o endereço que o assistente imprimiu ainda responde, que é o teste mais barato possível e o que as pessoas pulam. A segunda pergunta se o repositório por trás daquele endereço é o mesmo que você acharia procurando pelo nome da ferramenta, porque quando os dois diferem, tudo o que você concluir depois é sobre o projeto errado. A terceira pergunta se o código continua sendo tocado. A quarta pergunta se a página da própria ferramenta explica o que ela é no HTML que serve, sem navegador executando JavaScript.
Juntas levam cerca de um minuto por ferramenta, e são baratas de propósito, porque a ideia é rodar em todos os nomes da resposta e não só naquele de que você já gostou. Nenhuma das quatro é veredito sobre qualidade, e uma ferramenta pode falhar em uma delas por motivo perfeitamente bom. O que as quatro produzem é um perfil: endereço vivo, repositório que casa com o link, código recente e página que se descreve é um objeto muito diferente de um endereço que estoura o tempo, e saber qual dos dois você está prestes a instalar vale sessenta segundos.
O endereço que o assistente te deu ainda responde?
A primeira conferência não pergunta mais nada além de se o link está vivo, e é um comando só, sem interpretar resposta:
curl -sL -m 12 -o /dev/null -w "%{http_code}\n" "https://getclaudia.org/docs/features/project-session-management/"Em 13 de agosto de 2026 isso devolveu 000, que é o que o curl informa quando não houve conexão nenhuma. Aquele endereço foi citado por um dos assistentes como a documentação de uma ferramenta que ele recomendou para gerenciar sessões do Claude Code, e o domínio não resolve. Rodando o comando idêntico contra outro link citado, o repositório https://github.com/hex/claude-sessions, a resposta foi 200.
Link morto não prova que a ferramenta nunca existiu, e domínio expira por motivos comuns. O que ele prova é que, seja lá o que o modelo sabe daquela ferramenta, não é daquela página que ele está lendo hoje, e você também não. Esta conferência importa mais do que parece pelo que ela evita: se você pular e for procurar a ferramenta pelo nome, você vai achar alguma coisa, e o que achar pode ser outro produto de nome parecido em outro domínio de topo. Foi exatamente o erro que cometemos na primeira versão deste artigo.
O repositório com aquele nome é o que o assistente citou?
A segunda conferência compara o que a busca por nome devolve com o que foi citado. Peça ao GitHub os repositórios com aquele nome, ordenados por estrelas:
curl -s "https://api.github.com/search/repositories?q=claude-sessions+in:name&sort=stars&order=desc&per_page=3" | grep -o '"full_name": "[^"]*"'Em 13 de agosto de 2026 isso imprimiu, nesta ordem, iannuttall/claude-sessions, wbelk/claude-qmd-sessions e hex/claude-sessions. O repositório que o assistente citou de fato é o terceiro, hex/claude-sessions, com 33 estrelas. O primeiro resultado, que é o que você leva se procurar pelo nome e parar no topo, tem 1211 estrelas, ou seja 37 vezes mais, e é outro projeto de outro autor.
Esta é a conferência que transforma um nome num objeto que dá para inspecionar. Estrela é o que ordena aquela busca, então procurar pelo nome te entrega sistematicamente o projeto mais popular que compartilha o nome, e não o que foi recomendado a você. Se o assistente deu o link, o link é a resposta, e a busca serve só para descobrir que outras coisas usam o mesmo nome. Se o assistente deu só o nome, sem link, é aqui que você aprende que não dá para resolver com confiança, e o movimento honesto é pedir a URL ao assistente em vez de chutar.
O projeto continua recebendo trabalho?
A terceira conferência lê três campos do repositório que o link identificou:
curl -s "https://api.github.com/repos/hex/claude-sessions" | grep -E '"(created_at|pushed_at|stargazers_count)"'Em 13 de agosto de 2026 ela imprimiu:
"created_at": "2025-11-24T08:19:11Z",
"pushed_at": "2026-08-13T17:54:03Z",
"stargazers_count": 33,É um projeto pequeno que recebeu código no mesmo dia em que conferimos. Rode o comando idêntico contra o xará popular, iannuttall/claude-sessions, e ele devolve criação às 14:39:53 de 16 de junho de 2025, último envio às 14:50:30 do mesmo dia, onze minutos depois, e 1211 estrelas. Não é tocado desde então. Um terceiro repositório citado, kbwo/ccmanager, devolve 1218 estrelas com último envio em 10 de agosto de 2026.
Estrela mede atenção em algum momento do passado, e pushed_at mede se alguém tocou no código recentemente. O par de xarás acima é a demonstração mais clara possível de que os dois números podem apontar para lados opostos: 33 estrelas e ativo, contra 1211 estrelas e congelado desde onze minutos após a criação. A resposta de um assistente não carrega nenhum dos dois números, então uma ferramenta que parou em 2025 chega na mesma frase, com a mesma confiança, que uma que publicou código hoje.
A página da ferramenta diz o que ela é sem JavaScript?
A quarta conferência baixa a página da ferramenta como um script ou um rastreador faria, sem navegador e sem motor de JavaScript, e pergunta quanto voltou:
curl -sL -o /dev/null -w "%{size_download}\n" "https://claude-handler.com/"Em 13 de agosto de 2026 isso devolveu 16892, e a meta descrição dentro daquele HTML diz em uma frase que aquilo é um gerenciador de sessões em terminal para o Claude Code, que roda várias instâncias e alterna entre projetos. O mesmo comando devolve 146631 para nimbalyst.com e 69835 para dispatch.codes, e esses dois também descrevem o produto em uma frase no HTML que servem.
Página pequena não é defeito e aplicação de página única é escolha de engenharia normal, então esta conferência não é sobre o site ser ruim. Ela é sobre o que fica disponível para quem não executa JavaScript, o que inclui a maioria dos rastreadores, muitos geradores de prévia, e você mesmo conferindo rápido pelo terminal. Honestidade sobre o nosso próprio resultado: entre os sites de ferramenta que nos citaram, esta conferência não reprovou ninguém. Todo site que respondeu também se descreveu no HTML, e vale registrar justamente por ser o contrário do que esperávamos ao escrever a conferência.
Alguém além do autor já falou da ferramenta em público?
Há mais uma pergunta que vale a pena, fora das quatro, para quando as quatro deixam você em dúvida: se alguém além do autor já discutiu a ferramenta em público. O Hacker News é a superfície mais barata de consultar para isso. Há uma armadilha na resposta: o primeiro campo chamado nbHits no JSON pertence a um objeto exhaustive e guarda um booleano, não a contagem. Filtrar pela linha que começa com o nome do campo evita o erro:
curl -s "https://hn.algolia.com/api/v1/search?query=dispatch.codes" | tr ',' '\n' | grep '^"nbHits"'Leia o resultado como teste de presença, não como medição, e o motivo foi medido em nós mesmos. O total de um dos nomes recomendados era 34 quando rodamos no início da noite de 13 de agosto de 2026 e 47 cerca de uma hora depois, enquanto cinco chamadas seguidas no mesmo minuto devolveram sempre o mesmo número. A contagem é estável dentro de uma rajada e se move ao longo das horas, então publicá-la como número fixo seria desonesto, e quem colar o comando amanhã deve esperar outro valor. É também por essa instabilidade que esta pergunta fica fora das quatro, em vez de entrar entre elas.
A contagem também não separa homônimos: os resultados de uma das ferramentas recomendadas incluem um projeto de hardware de rádio criado em 2013, sem relação com agentes de IA. Então trate número alto como "vale abrir os resultados" e o zero como o sinal mais definitivo, porque zero significa que nenhuma história e nenhum comentário daquela superfície jamais conteve aquele texto. Um dos endereços de ferramenta citados a nós devolveu exatamente isso, zero.
O que as quatro conferências devolveram em todos os links que dois assistentes nos deram?
O material veio da nossa própria medição, não de uma lista que escolhemos. Em 10 de agosto de 2026 fizemos onze perguntas sobre rodar vários agentes de IA de programação a dois assistentes, Claude e Codex, sem citar o nosso produto em nenhum prompt, e guardamos as 22 respostas. Sete das 22 trazem ao menos uma URL, com 36 URLs no total e 20 distintas. Essa é toda a base de evidência, e ela é pequena o bastante para conferir na mão, que é justamente o ponto.
Separando os 20 endereços distintos pelo que são: nove são documentação ou anúncio oficial das empresas que fazem os agentes, em code.claude.com, developers.openai.com, learn.chatgpt.com, docs.cursor.com e openai.com; quatro são repositórios no GitHub; cinco são páginas iniciais de ferramentas; e dois são posts de blog. Conferidos em 13 de agosto de 2026, dezoito dos vinte devolvem 200, um devolve 403 para cliente sem navegador, e um não resolve. Entre os nomes de ferramenta daquelas respostas, exatamente um aparece na awesome-claude-code, lista curada muito referenciada da categoria, cujo README tinha 140813 bytes quando o lemos. E o nosso próprio produto aparece em zero das 22 respostas, que é o número menos lisonjeiro deste artigo e a razão de confiarmos no resto dele.
Resultado ruim nessas conferências quer dizer que a ferramenta é ruim?
Não, e tratar as quatro conferências como nota é a principal forma de usá-las errado. Produto de código fechado não tem repositório para inspecionar, e isso é modelo de negócio, não aviso de perigo. Página renderizada inteiramente no navegador é arquitetura comum. Contagem baixa no Hacker News pode significar apenas que o público está no Reddit, no Discord ou dentro de uma empresa. Cada conferência responde a uma pergunta estreita, e as quatro juntas descrevem quanta evidência pública existe sobre uma ferramenta agora, não o quanto ela funciona bem.
O que as conferências descartam é a falha específica para a qual foram feitas: instalar algo porque um modelo listou aquilo ao lado de nomes que você reconhece, e só depois descobrir que o link está morto, ou que o repositório que você leu era um xará com outro código dentro. O uso honesto é rodar as quatro em todos os nomes da resposta, inclusive os de que você gostou, e decidir com os perfis lado a lado. Se uma ferramenta que você quer usar sai mal em três das quatro, isso não é motivo para recusar, é motivo para fazer uma pergunta direta a quem mantém antes de depender dela.
Por que isso importa mais numa resposta de IA do que numa página de busca?
Uma página de resultados de busca carrega sinais que você lê sem perceber: o domínio, a data, o trecho, quantos resultados a consulta devolve, se os primeiros links vêm de lugares em que você já confia. A resposta de um assistente tira tudo isso e entrega uma lista limpa de nomes dentro de uma frase confiante. Os nomes chegam com peso igual, e nada na tela separa um projeto que publicou código hoje de um domínio que parou de resolver.
A nossa própria medição mostra isso de forma concreta. Vinte endereços distintos saíram de 22 respostas em 10 de agosto de 2026. Três dias depois, um deles não resolvia, e para um dos nomes de ferramenta o repositório que a busca por nome coloca em primeiro não é o que foi citado e tem 37 vezes as estrelas daquele que foi. Nenhum dos dois fatos é visível na resposta, os dois são visíveis em cerca de um minuto de curl, e a distância entre essas duas frases é a razão inteira de este método existir.
Qual a diferença entre isto e comparar as ferramentas?
Este artigo é sobre conferir uma recomendação, não sobre escolher entre produtos. Publicamos uma comparação separada das ferramentas desta categoria, incluindo onde os concorrentes fazem coisas melhor que o CanvasCode, e aquela responde "qual eu uso". Esta responde à pergunta que vem antes: se aquilo que acabaram de mandar você usar é um projeto que dá para inspecionar hoje. As duas não se sobrepõem, e dá para rodar estas quatro conferências em todas as ferramentas daquela comparação, a nossa inclusive.
O CanvasCode é um aplicativo de macOS para rodar vários agentes de IA de programação num canvas só, e ele falha na segunda e na terceira conferência por opção, porque não tem repositório público para inspecionar. É justamente por isso que o método importa mais que qualquer resultado isolado: uma conferência que a ferramenta não passa diz qual pergunta fazer em seguida, não que a ferramenta está desclassificada. Rode as quatro contra o endereço que te deram, anote o que cada uma devolveu, e decida com essa evidência na frente em vez da confiança de uma frase que saiu de um modelo. Nós escrevemos a primeira versão deste artigo procurando nomes em vez de endereços, e foram as quatro conferências que nos pegaram.