Testes de Benchmark de Bobagens Avaliam a Resistência de LLMs a Prompts Sem Sentido

✍️ OpenClawRadar📅 Publicado: February 25, 2026🔗 Source
Testes de Benchmark de Bobagens Avaliam a Resistência de LLMs a Prompts Sem Sentido
Ad

O que o Bullshit Benchmark Mede

O Bullshit Benchmark é uma ferramenta para testar se os grandes modelos de linguagem (LLMs) identificam e contestam prompts sem sentido, em vez de respondê-los com confiança. Ele mede o quanto um modelo está disposto a concordar com obviedades sem sentido, abordando preocupações de que os modelos possam induzir alucinações ao tentar ser úteis em vez de apontar prompts problemáticos.

Principais Resultados do Benchmark

De acordo com o material de origem, os modelos Claude apresentam um desempenho significativamente melhor do que os modelos Gemini na detecção de nonsense. Os resultados apoiam a intuição de que os modelos Claude são melhores nessa capacidade específica.

Um exemplo do benchmark mostra o Claude identificando com sucesso uma pergunta sem sentido, enquanto o Gemini falhou. Especificamente, o Gemini 3.1 Pro não conseguiu detectar uma pergunta obviamente sem sentido, mesmo com o esforço de pensamento alto ativado, gerando em vez disso uma resposta sem sentido.

A fonte sugere que a abordagem de pós-treinamento da Anthropic contribui para o melhor desempenho do Claude, observando que os LLMs naturalmente tendem a um pensamento associativo superficial que gera relações espúrias entre conceitos. A Anthropic parece ter abordado essa questão em seu pipeline de pós-treinamento.

Ad

Por que Isso Importa para Agentes de IA de Codificação

Para desenvolvedores que usam assistentes de codificação de IA, a capacidade de um modelo de reconhecer prompts sem sentido é crucial. Quando os modelos respondem com confiança a perguntas sem sentido em vez de contestá-las, eles podem enganar os usuários e gerar código ou explicações incorretos. Este benchmark fornece uma maneira concreta de avaliar esse comportamento de segurança específico em diferentes modelos.

Você pode visualizar os resultados completos do benchmark em https://petergpt.github.io/bullshit-benchmark/viewer/index.html.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

cldctrl: Painel de Terminal para Gerenciar Sessões de Código do Claude
Tools

cldctrl: Painel de Terminal para Gerenciar Sessões de Código do Claude

cldctrl é um pacote npm que fornece um painel de terminal para iniciar e gerenciar sessões do Claude Code em diferentes projetos. Ele lê os dados existentes de ~/.claude, descobre projetos automaticamente e mostra o uso de tokens com barras de limite de taxa.

OpenClawRadar
Jan-Code-4B: Um Modelo Leve Ajustado para Código para Desenvolvimento Local
Tools

Jan-Code-4B: Um Modelo Leve Ajustado para Código para Desenvolvimento Local

A equipe Jan lançou o Jan-Code-4B, um modelo ajustado para código com 4 bilhões de parâmetros, baseado no Jan-v3-4B-base-instruct. Ele foi projetado como uma substituição direta do Haiku no Claude Code, oferecendo assistência de codificação aprimorada enquanto é executado localmente.

OpenClawRadar
Servidor MCP Adiciona Memória Persistente com Pontuação de Recuperação ao Claude Code
Tools

Servidor MCP Adiciona Memória Persistente com Pontuação de Recuperação ao Claude Code

Um desenvolvedor criou um servidor MCP chamado engram-mcp que dá ao Claude Code memória persistente entre sessões e projetos, apresentando pontuação automática de recuperação baseada no sucesso dos resultados e detecção de desvio para conhecimento desatualizado.

OpenClawRadar
Desenvolvedor solo usa Claude + Blender MCP para criar vídeo da App Store em 90 minutos
Tools

Desenvolvedor solo usa Claude + Blender MCP para criar vídeo da App Store em 90 minutos

O usuário do Reddit Positive_Camel2086 detalha como usou o Claude com o servidor MCP do Blender para gerar um vídeo vertical de lançamento de 10 segundos, automatizando rigging de câmera, materiais, névoa e sistemas de partículas por meio de prompts conversacionais.

OpenClawRadar