Sentido: Go SDK para asserções de teste com LLM e extração de texto estruturado

O que o Sense faz
Sense é um SDK Go que aproveita o Claude para dois casos de uso principais: avaliar saídas não determinísticas em testes e extrair dados estruturados de textos não estruturados.
Funcionalidades principais
1. Asserções de testes com LLM:
- Escreva expectativas em inglês simples em vez de asserções rígidas
- Obtenha feedback estruturado sobre falhas incluindo o que passou, o que falhou, por quê, com evidências e pontuações de confiança
- Exemplo de uso:
s.Assert(t, agentOutput).Expect("produz código Go válido").Expect("lida com erros de forma idiomática").Run()
2. Extração de texto estruturado:
- Extraia structs tipadas de textos não estruturados
- Defina uma struct, passe um ponteiro, e o esquema é gerado via reflexão
- A imposição do esquema ocorre no lado do servidor através do tool_use forçado do Claude
- Exemplo de uso:
var m MountError s.Extract("dispositivo /dev/sdf já montado com vol-0abc123", &m).Run() fmt.Println(m.Device) // "/dev/sdf" - Útil para análise de logs, tickets de suporte e normalização de APIs além de apenas testes
Funcionalidades adicionais
Evalpara resultados programáticosComparepara testes A/B- Suporte a processamento em lote com 50% de economia de custo
- Interfaces
EvaluatoreExtractorpara simulação - Inclui mais de 135 testes
Contexto de desenvolvimento
Todo o SDK foi construído usando o Claude Code, desde o design inicial até a implementação, testes e documentação. O criador está buscando feedback sobre o design da API e o que tornaria isso útil para fluxos de trabalho de desenvolvedores.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Apresentando o operate.txt: Uma especificação YAML para agentes de IA que navegam por produtos SaaS
Um desenvolvedor criou operate.txt, um arquivo YAML hospedado em yourdomain.com/operate.txt que documenta detalhes da tela, estados de carregamento, ações irreversíveis e caminhos passo a passo para agentes de IA usando recursos de uso do computador. A especificação aborda problemas como o Claude perguntar 'isso está quebrado?' durante telas de carregamento legítimas.

Modelos Qwen Locais Alcançam Automação de Navegador com Planejamento Passo a Passo e DOM Compacto
Um desenvolvedor descobriu que LLMs locais pequenos como Qwen 8B e 4B conseguem automatizar navegadores usando planejamento passo a passo em vez de planos multi-etapas antecipados, combinado com uma representação DOM semântica compacta que reduz o uso de tokens de 50-100K+ para ~15K em fluxos completos.

Porto de Habilidades do Agente: Gerenciamento de habilidades nativo do GitHub para equipes de agentes de IA
Agent Skill Harbor é uma plataforma de código aberto para equipes compartilharem, rastrearem e governarem habilidades de agentes de IA usando fluxos de trabalho nativos do GitHub. Ela coleta habilidades de repositórios do GitHub, rastreia proveniência, suporta verificações de segurança e publica um site de catálogo estático com GitHub Actions e Pages.
Estagiário de física da Hugging Face: Framework multiagente dobra Gemini no benchmark CritPt
Hugging Face lançou physics-intern, um framework multiagente para pesquisa em física teórica que dobra o desempenho dos modelos Gemini no benchmark CritPt e estabelece um novo SOTA em relação ao GPT-5.5 Pro com custo mais baixo.