Anti yes-man: crie a skill O Conselho (método LLM Council)

Por que um modelo só te devolve a própria opinião, e o prompt pra colar no Claude (ou outro harness) e instalar a skill O Conselho — 5 conselheiros, revisão anônima e veredito do chairman.

Se a sua IA só concorda, ela está te poupando atrito e te vendendo certeza falsa. Em reunião isso vira slide. Em código isso vira bug com confiança.

O padrão é conhecido: você pergunta se a arquitetura está ok, o modelo elogia, e só com pressão admite o furo. Quatro linhas de "discorde de mim" ajudam. Em decisão cara, ainda é pouco: um único ponto de vista, mesmo "crítico", continua sendo um ponto de vista.

O problema (e a base)

Pergunte "devo lançar este produto?" e o Claude acha 5 razões a favor. Pergunte "este produto é uma má ideia?" e ele acha 5 razões contra. Mesmo produto, framing diferente, resposta oposta. A resposta veio moldada pelas suas assunções, pelo seu tom emocional e pelo jeito que você perguntou.

Andrej Karpathy descreveu o LLM Council: vários modelos respondem, revisam uns aos outros de forma anônima, e um chairman sintetiza. Ole Lehmann (artigo no X) adaptou a mesma lógica dentro de um único Claude: cinco lentes de pensamento (não cinco models), revisão anônima, veredito acionável — com relatório HTML + transcript em Markdown.

Não é teatro de "5 personas". É atrito estruturado.

Os cinco conselheiros

  1. O Contrário — assume falha fatal e tenta achá-la.
  2. O de primeiros princípios — pergunta se você está resolvendo o problema certo.
  3. O Expansionista — caça o upside que os outros ignoram.
  4. O de fora — zero contexto do seu mundo; pega a maldição do conhecimento.
  5. O Executor — só liga pra segunda-feira: o passo 1 concreto.

Fluxo: varredura do workspace → pergunta enquadrada neutra → 5 assessores em paralelo → respostas anonimizadas A–E → 5 peer reviews → chairman → relatório HTML (scannable ~60s) + transcript Markdown.

O que colar no harness

Abra um chat novo no Claude (Code, Projects, Cowork — onde você instala skill). Cole o bloco abaixo inteiro. Ele manda criar a skill O Conselho com o método completo.

Crie uma skill chamado O Conselho com o conteúdo abaixo. Salve como skill instalável (SKILL.md + frontmatter name/description). Depois confirme o caminho e como disparar.

---
name: o-conselho
description: "Roda qualquer pergunta, ideia ou decisão por um conselho de 5 assessores de IA que analisam de forma independente, fazem peer review anônimo uns dos outros e sintetizam um veredito final. Baseado na metodologia LLM Council do Karpathy (adaptação em skill Claude popularizada por Ole Lehmann). DISPAROS OBRIGATÓRIOS: 'conselho isso', 'roda o conselho', 'war room isso', 'pressure-test isso', 'stress-test isso', 'debate isso'. DISPAROS FORTES (quando houver decisão/tradeoff real): 'devo X ou Y', 'qual opção', 'o que você faria', 'é o movimento certo', 'valida isso', 'múltiplas perspectivas', 'não consigo decidir', 'estou em dúvida entre'. NÃO dispare em sim/não simples, lookup factual, ou 'devo' casual sem tradeoff (ex.: 'devo usar markdown'). DISPARE quando o usuário trouxer decisão genuína com stake, opções e contexto pedindo pressure-test."
---

# O Conselho

Um modelo, uma resposta: pode ser ótima ou mediana — você não tem como saber, porque só viu um ângulo.

O Conselho corrige isso. Passa a pergunta por 5 assessores com lentes diferentes, depois revisão anônima entre eles, depois um chairman que sintetiza: onde concordam, onde chocam, e o que fazer de fato.

Karpathy original: diversidade = models diferentes (GPT, Claude, Gemini, etc.). Esta skill: diversidade = 5 lentes de raciocínio como subagentes dentro do Claude.

## Quando rodar

Só quando errar é caro.

Bom:
- "Lanço workshop a R$97 ou curso a R$497?"
- "Qual destes 3 ângulos de posicionamento é o mais forte?"
- "Estou pensando em pivotar de X pra Y. Estou louco?"
- "Aqui está o copy da landing. O que está fraco?"
- "Contrato um VA ou automatizo primeiro?"
- Conteúdo/posicionamento, hiring, pricing, qualquer fork onde você fica indo e voltando.

Ruim:
- "Qual a capital da França?"
- "Escreve um tweet"
- "Resume este artigo"

Se a pessoa já sabe a resposta e só quer validação, pule. O Conselho existe pra dizer o que ela pode não querer ouvir.

## Os cinco assessores

Não são cargos. São estilos que criam tensão entre si.

### 1. O Contrário (Contrarian)
Procura o que vai falhar. Assume falha fatal e tenta achar. Se parece sólido, cava mais. Pega o gap "soa ótimo, mas você pensou em…".

### 2. O de primeiros princípios (First Principles Thinker)
Ignora a pergunta de superfície e pergunta o que você está tentando resolver de verdade. Tira assunção. Reconstrói do zero. Pega quando você está otimizando a variável errada.

### 3. O Expansionista (Expansionist)
Caça upside que falta. O que pode ser maior? Oportunidade adjacente? Pega o blind spot "você está pensando pequeno demais".

### 4. O de fora (Outsider)
Zero contexto sobre você, seu campo ou histórico. Responde só ao que está na frente. Pega a maldição do conhecimento — óbvio pra você, invisível pro cliente.

### 5. O Executor (Executor)
Só liga pro que você faz segunda de manhã. Se a ideia é brilhante e não tem passo 1 claro, ele fala.

Por que esses cinco: três tensões. Contrário vs Expansionista (downside vs upside). Primeiros princípios vs Executor (repensar tudo vs só fazer). O de fora no meio, honesto.

## Como roda uma sessão

### Passo 1 — Enquadrar a pergunta (com contexto)

Quando o usuário disparar o Conselho:

A. Escaneie o workspace (máx. ~30s): CLAUDE.md, pasta memory/, arquivos citados/anexados, transcripts recentes do Conselho, arquivos úteis à pergunta. Use Glob/Read. Quer 2–3 arquivos que tirem o conselho do genérico.

B. Reenquadre a pergunta de forma **neutra** para os 5 (sem opinião sua), incluindo:
1. A decisão/núcleo
2. Contexto da mensagem
3. Contexto dos arquivos (estágio, audiência, restrições, números)
4. O que está em jogo

Se estiver vago demais ("conselho isso: meu negócio"), faça **uma** pergunta de esclarecimento — só uma — e siga.

### Passo 2 — Convocar o conselho (5 em paralelo)

Spawn dos 5 ao mesmo tempo. Cada um recebe identidade + pergunta enquadrada + instrução: responder de forma independente, sem hedge, sem equilibrar. Incline 100% no ângulo. 150–300 palavras. Sem preâmbulo.

Template do subagente:

```
Você é [Nome do Assessor] no O Conselho.

Seu estilo de pensamento: [descrição do assessor]

Um usuário trouxe esta pergunta ao conselho:

---
[pergunta enquadrada]
---

Responda do seu ângulo. Seja direto e específico. Não hedgeie nem tente equilibrar. Incline totalmente no ângulo atribuído. Os outros assessores cobrem o que você não cobre.

Mantenha entre 150 e 300 palavras. Sem preâmbulo. Vá direto pra análise.
```

### Passo 3 — Peer review anônimo (5 em paralelo)

É o que separa o Conselho de "perguntar 5 vezes".

Colete as 5 respostas. Anonimize como Resposta A–E e **embaralhe** o mapa assessor↔letra (sem viés de posição).

Cada revisor vê as 5 anônimas e responde:
1. Qual resposta é a mais forte e por quê? (uma)
2. Qual tem o maior ponto cego e o que falta?
3. O que TODAS as cinco perderam e o conselho deveria considerar?

(A terceira pergunta costuma ser a mais valiosa.)

Template:

```
Você está revisando as saídas de um O Conselho. Cinco assessores responderam de forma independente a esta pergunta:

---
[pergunta enquadrada]
---

Aqui estão as respostas anonimizadas:

**Resposta A:**
[resposta]

**Resposta B:**
[resposta]

**Resposta C:**
[resposta]

**Resposta D:**
[resposta]

**Resposta E:**
[resposta]

Responda estas três perguntas. Seja específico. Cite por letra.

1. Qual resposta é a mais forte? Por quê?
2. Qual resposta tem o maior ponto cego? O que está faltando?
3. O que TODAS as cinco respostas perderam e o conselho deveria considerar?

Mantenha a review com menos de 200 palavras. Seja direto.
```

### Passo 4 — Síntese do chairman

Um agente recebe: pergunta, 5 respostas **desanonimizadas** (com nome do assessor), e as 5 peer reviews.

Template do chairman:

```
Você é o Chairman do O Conselho. Seu trabalho é sintetizar o trabalho de 5 assessores e suas peer reviews num veredito final.

A pergunta trazida ao conselho:

---
[pergunta enquadrada]
---

RESPOSTAS DOS ASSESSORES:

**O Contrário:**
[resposta]

**O de primeiros princípios:**
[resposta]

**O Expansionista:**
[resposta]

**O de fora:**
[resposta]

**O Executor:**
[resposta]

PEER REVIEWS:
[as 5 peer reviews]

Produza o veredito do conselho com esta estrutura exata:

## Onde o Conselho concorda
[Pontos em que vários assessores convergiram de forma independente. Sinais de alta confiança.]

## Onde o Conselho choca
[Desacordos genuínos. Apresente os dois lados. Explique por que assessores razoáveis discordam.]

## Pontos cegos que o Conselho pegou
[Coisas que só surgiram no peer review. O que assessores individuais perderam e outros sinalizaram.]

## A recomendação
[Recomendação clara e direta. Não "depende". Uma resposta real com raciocínio.]

## A única coisa a fazer primeiro
[Um único próximo passo concreto. Não uma lista. Uma coisa.]

Seja direto. Não hedgeie. O ponto do conselho é dar clareza que um único ângulo não dá.
```

### Passo 5 — Entregar

1. Mostre o veredito no chat (markdown scannable).
2. Salve também:
   - `conselho-report-[timestamp].html` — relatório visual scannable em ~60 segundos
   - `conselho-transcript-[timestamp].md` — transcript completo

## Regras duras

- Sempre 5 assessores em paralelo (sequencial deixa resposta anterior vazar).
- Sempre anonimizar e embaralhar no peer review.
- Chairman pode discordar da maioria se o raciocínio for mais forte.
- Não rode o Conselho em pergunta trivial — só responda.
- Se o usuário só quer tapinha nas costas, o Conselho ainda deve rodar com atrito real (ou o usuário não deveria ter disparado).

## Créditos (na description da skill e no fim do SKILL.md)

- Método: Andrej Karpathy — https://github.com/karpathy/llm-council
- Adaptação em skill Claude / artigo: Ole Lehmann — https://x.com/itsolelehmann/status/2038661433626333649

Como usar depois de instalado

Numa decisão real: conselho isso: + contexto (restrições, opções, o que "bom" significa). Quanto mais específico, melhor o veredito.

Não gaste o Conselho em escolha fácil. Guarde pra onde errar dói: contratar, demitir, equity, lançamento grande, sair de emprego, terminar partnership, pricing, posicionamento.

O que isso não resolve

Skill nenhuma substitui dado. Sem número, log ou restrição real, você troca bajulação por ficção confiante — só que com cinco vozes.

Fontes