O formato WCY reduz a sobrecarga de tokens de LLM em 50-71% e adiciona marcadores estruturais de "não sei".

✍️ OpenClawRadar📅 Publicado: March 17, 2026🔗 Source
O formato WCY reduz a sobrecarga de tokens de LLM em 50-71% e adiciona marcadores estruturais de "não sei".
Ad

WCY (Watch → Compute → Yield) é um formato orientado a linhas projetado para reduzir a sobrecarga de tokens em LLMs e fornecer marcadores estruturais para incerteza no raciocínio. Ele substitui colchetes, aspas e vírgulas do JSON por uma sintaxe de um marcador por linha.

Benchmarks de redução de tokens

De testes em 10-500 linhas e tipos de troca MCP:

  • Dados estruturados vs JSON: redução de -50 a -54% de tokens
  • Esquemas de chamada de ferramentas: redução de -65 a -71%
  • Troca completa do protocolo MCP: redução de -61%
  • Tokens de saída multiagente: redução de -40%

Nenhum ajuste fino é necessário—três exemplos de poucas amostras são suficientes para que os modelos mudem de formato. A métrica parse_r vai de 0,29 para 1,00 em tarefas complexas com essa abordagem.

Ad

O marcador ? para incerteza

WCY introduz uma forma estrutural para LLMs marcarem o que não sabem durante o raciocínio. O slot ? (void-B) permite que os modelos indiquem incerteza em linha:

: ?diagnosis hint=labs+imaging conf_range=0.4..0.8
    order CT_scan reason=from=3 . CT_result mass_in_RUL size=2.3cm : diagnosis=adenocarcinoma conf=0.82 from=3,5

Testes mostraram:

  • Zero-shot: modelos usam marcadores ? 0% do tempo, mesmo com a especificação no prompt
  • Com 3 exemplos: 5,4 marcadores por traço, 67-97% resolvidos
  • 48 traços de pipeline em 8 domínios: 95% de resolução, 100% de aprovação no gate de qualidade

O slot from= rastreia quais observações suportam quais conclusões em linha, o que ajuda a detectar cadeias de alucinação.

Recursos disponíveis

  • wcy_parser.py — Python puro, sem dependências externas
  • wcy_eval.py — pontuação de 3 eixos (Estrutural / Significado / Procedência)
  • 60 traços de raciocínio com ciclos void-B (licença CC BY 4.0, para experimentos de ajuste fino)
  • Script de pipeline para gerar mais traços

Até agora testado apenas no Claude Sonnet. O autor está curioso se o resultado de 0% → 5,4 marcadores se mantém no Qwen, Llama e Mistral com os mesmos exemplos de poucas amostras.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Extensão Local AI do VS Code bloqueia geração de código inseguro durante salvamentos
Tools

Extensão Local AI do VS Code bloqueia geração de código inseguro durante salvamentos

Um desenvolvedor criou uma extensão do VS Code que executa o modelo llama3.1:8b-instruct-q4 localmente para interceptar salvamentos, mapear fluxos de execução de origem para destino e bloquear código inseguro gerado por IA, como vulnerabilidades de injeção de logs CWE-117.

OpenClawRadar
Pangolin: VPN de Identidade de Código Aberto como uma Alternativa ao ZTNA
Tools

Pangolin: VPN de Identidade de Código Aberto como uma Alternativa ao ZTNA

Pangolin é uma VPN de código aberto focada em acesso remoto baseado em identidade, oferecendo uma alternativa ao ZTNA da Cloudflare, Zscaler e Twingate.

OpenClawRadar
Habilidades do Claude Silenciosamente Substituem Instruções: Armadilhas Não Documentadas Expostas
Tools

Habilidades do Claude Silenciosamente Substituem Instruções: Armadilhas Não Documentadas Expostas

Usuário descobre que Claude Skills silenciosamente impõe limites rígidos na entrada do usuário via `ask_user_input_v0` (máximo 3 perguntas, 4 opções cada), `Write` sobrescreve arquivos enquanto `create_file` recusa no Claude.ai, e caminhos relativos em `references/` não resolvem. Um repositório da comunidade cataloga descobertas.

OpenClawRadar
read-once: Um Gancho de Código do Claude que Evita Leituras Redundantes de Arquivos
Tools

read-once: Um Gancho de Código do Claude que Evita Leituras Redundantes de Arquivos

Um desenvolvedor criou um hook PreToolUse chamado read-once que rastreia os arquivos que o Claude Code já leu em uma sessão, bloqueando releituras de arquivos inalterados e usando diffs para arquivos modificados. A ferramenta economiza milhares de tokens por sessão ao impedir que o Claude leia repetidamente o mesmo conteúdo de arquivo.

OpenClawRadar