Habilidade de Código Claude /conselho Executa Prompts em 4 Modelos de IA em Paralelo

Um desenvolvedor criou uma habilidade do Claude Code chamada /council que envia qualquer prompt para quatro modelos de IA de ponta simultaneamente, depois usa o modelo menos tendencioso para sintetizar uma resposta vencedora com melhorias específicas dos outros.
Como Funciona
Quando você digita /council seguido de um prompt no Claude Code (por exemplo: /council devo adicionar um plano freemium?), a habilidade:
- Envia seu prompt para GPT, Claude, Gemini e Grok em paralelo (leva cerca de 7 segundos)
- Usa o Gemini para sintetizar os resultados: escolhe a melhor resposta e lista melhorias específicas que "roubaria" dos outros três modelos
- Mostra todas as cinco saídas (quatro respostas dos modelos mais a síntese) em linha e as salva em um arquivo
Por que o Gemini Sintetiza
O criador escolheu o Gemini como sintetizador com base em um estudo de LLMs-como-juízes que descobriu:
- GPT tem 70% de autopreferência ao julgar
- Claude é quase neutro (-0,83 pontos percentuais de viés)
- Gemini é o menos tendencioso (-2,08 pontos percentuais de viés)
Valor Principal: Formato Vencedor + Delta
O verdadeiro valor vem do formato "vencedor + delta". Em vez de apenas dizer "a resposta do GPT foi a melhor", a síntese pode dizer: "GPT vence, mas roube a estruturação de custos do Gemini e a crítica arquitetural do Claude." Essa abordagem produz uma resposta melhor do que qualquer modelo único poderia produzir sozinho.
Em um exemplo de teste mostrado na fonte, Claude foi o único modelo que identificou uma meta-falha — "você adicionou complexidade sem adicionar segurança real" — enquanto os outros modelos apenas descreveram sintomas. Claude descreveu por que a correção não funciona.
O criador está perguntando a outros desenvolvedores que constroem habilidades multi-modelo do Claude Code quais fluxos de trabalho podem se beneficiar de obter quatro perspectivas em vez de uma.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Gemma-4 26B-A4B com Opencode funciona de forma eficiente no MacBook Air M5
Um MacBook Air M5 de 32GB pode executar o modelo Gemma-4-26B-A4B-it-UD-IQ4_XS a 300 tokens/segundo no processamento de prompts e 12 tokens/segundo na geração em modo de baixo consumo, usando apenas 8W de energia sem esquentar ou fazer barulho.

AgentWorkingMemory: Um Sistema de Memória Local para Agentes de IA de Codificação
AgentWorkingMemory (AWM) é um sistema de memória local que resolve o problema de amnésia entre sessões em agentes de codificação de IA. Ele usa um banco de dados SQLite, três modelos de ML locais (~124MB no total) e se integra automaticamente via MCP para fornecer memória persistente e contextualizada entre sessões do Claude Code.

TestThread: Framework de Teste de Código Aberto para Agentes de IA
TestThread é uma estrutura de testes de código aberto para agentes de IA que executa testes contra endpoints ativos, fornece resultados de aprovação/reprovação com diagnóstico de IA e inclui recursos como correspondência semântica, detecção de PII e integração CI/CD.

PageAgent: Agente de IA para Navegador que Opera Dentro de Páginas Web com Suporte a Ollama
PageAgent é uma biblioteca JavaScript que executa agentes de IA diretamente dentro de páginas web, lendo o DOM ao vivo como texto em vez de usar capturas de tela. Funciona com qualquer endpoint compatível com OpenAI, incluindo Ollama, permitindo chamadas de LLM locais diretamente do navegador.