Sentido: Go SDK para asserções de teste com LLM e extração de texto estruturado

✍️ OpenClawRadar📅 Publicado: March 28, 2026🔗 Source
Sentido: Go SDK para asserções de teste com LLM e extração de texto estruturado
Ad

O que o Sense faz

Sense é um SDK Go que aproveita o Claude para dois casos de uso principais: avaliar saídas não determinísticas em testes e extrair dados estruturados de textos não estruturados.

Funcionalidades principais

1. Asserções de testes com LLM:

  • Escreva expectativas em inglês simples em vez de asserções rígidas
  • Obtenha feedback estruturado sobre falhas incluindo o que passou, o que falhou, por quê, com evidências e pontuações de confiança
  • Exemplo de uso: s.Assert(t, agentOutput).Expect("produz código Go válido").Expect("lida com erros de forma idiomática").Run()

2. Extração de texto estruturado:

  • Extraia structs tipadas de textos não estruturados
  • Defina uma struct, passe um ponteiro, e o esquema é gerado via reflexão
  • A imposição do esquema ocorre no lado do servidor através do tool_use forçado do Claude
  • Exemplo de uso: var m MountError s.Extract("dispositivo /dev/sdf já montado com vol-0abc123", &m).Run() fmt.Println(m.Device) // "/dev/sdf"
  • Útil para análise de logs, tickets de suporte e normalização de APIs além de apenas testes
Ad

Funcionalidades adicionais

  • Eval para resultados programáticos
  • Compare para testes A/B
  • Suporte a processamento em lote com 50% de economia de custo
  • Interfaces Evaluator e Extractor para simulação
  • Inclui mais de 135 testes

Contexto de desenvolvimento

Todo o SDK foi construído usando o Claude Code, desde o design inicial até a implementação, testes e documentação. O criador está buscando feedback sobre o design da API e o que tornaria isso útil para fluxos de trabalho de desenvolvedores.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

Apresentando o operate.txt: Uma especificação YAML para agentes de IA que navegam por produtos SaaS
Tools

Apresentando o operate.txt: Uma especificação YAML para agentes de IA que navegam por produtos SaaS

Um desenvolvedor criou operate.txt, um arquivo YAML hospedado em yourdomain.com/operate.txt que documenta detalhes da tela, estados de carregamento, ações irreversíveis e caminhos passo a passo para agentes de IA usando recursos de uso do computador. A especificação aborda problemas como o Claude perguntar 'isso está quebrado?' durante telas de carregamento legítimas.

OpenClawRadar
Modelos Qwen Locais Alcançam Automação de Navegador com Planejamento Passo a Passo e DOM Compacto
Tools

Modelos Qwen Locais Alcançam Automação de Navegador com Planejamento Passo a Passo e DOM Compacto

Um desenvolvedor descobriu que LLMs locais pequenos como Qwen 8B e 4B conseguem automatizar navegadores usando planejamento passo a passo em vez de planos multi-etapas antecipados, combinado com uma representação DOM semântica compacta que reduz o uso de tokens de 50-100K+ para ~15K em fluxos completos.

OpenClawRadar
Porto de Habilidades do Agente: Gerenciamento de habilidades nativo do GitHub para equipes de agentes de IA
Tools

Porto de Habilidades do Agente: Gerenciamento de habilidades nativo do GitHub para equipes de agentes de IA

Agent Skill Harbor é uma plataforma de código aberto para equipes compartilharem, rastrearem e governarem habilidades de agentes de IA usando fluxos de trabalho nativos do GitHub. Ela coleta habilidades de repositórios do GitHub, rastreia proveniência, suporta verificações de segurança e publica um site de catálogo estático com GitHub Actions e Pages.

OpenClawRadar
🦀
Tools

Estagiário de física da Hugging Face: Framework multiagente dobra Gemini no benchmark CritPt

Hugging Face lançou physics-intern, um framework multiagente para pesquisa em física teórica que dobra o desempenho dos modelos Gemini no benchmark CritPt e estabelece um novo SOTA em relação ao GPT-5.5 Pro com custo mais baixo.

OpenClawRadar