Título: Spec27: Validação Orientada por Spec para Agentes de IA – Testes em Nível de API Sem Acesso Interno

A Safe Intelligence lançou o Spec27, uma ferramenta de validação orientada por especificações para agentes de IA. Diferente de frameworks tradicionais de avaliação de LLM que pontuam o comportamento geral do modelo, o Spec27 permite que as equipes definam especificações reutilizáveis para a missão específica que um agente deve cumprir. Os testes são gerados automaticamente a partir dessas especificações e executados apenas nas interfaces primárias do agente — sem suposições sobre a pilha interna, sem necessidade de SDKs ou gateways.
Principais Recursos
- Testes de fora para dentro: Todos os testes são executados contra a API ou interface de usuário exposta do agente. Não é necessário instrumentar os componentes internos do agente, o que é crucial para agentes construídos em plataformas de terceiros onde você não controla a pilha.
- Geração de testes orientada por especificações: Defina especificações em termos de comportamento esperado (por exemplo, “quando perguntado X, deve fazer Y e não Z”). O Spec27 gera automaticamente verificações adversariais e de robustez, revelando sensibilidades e regressões à medida que modelos, prompts ou ferramentas mudam.
- Acesso antecipado: Atualmente mais forte para validação de agentes e aplicações de interação única. Interações de múltiplas etapas e integração mais rica de telemetria/chamadas de ferramentas estão no roteiro.
Para Quem É
Equipes que implantam agentes internos, agentes de terceiros ou qualquer sistema de IA onde a confiabilidade importa mais do que pontuações de benchmark. Se você está testando agentes em plataformas que não expõem componentes internos, a abordagem de caixa-preta do Spec27 aborda diretamente essa lacuna.
Primeiros Passos
O Spec27 está aberto para teste por leitores do HN. O site de lançamento oferece um fluxo de amostra para que você possa explorar sem configuração. Cadastre-se em spec27.ai/launch.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

ClawCall adiciona chamadas recebidas — seu agente OpenClaw ganha seu próprio número
ClawCall agora suporta chamadas recebidas — seu agente OpenClaw ganha um número dedicado, atende em segundos e fala com seu tom. Configuração mais fácil de saudação e personalidade via linguagem natural.

Arquiteto de Agentes: Ferramenta Gratuita Gera Arquivos Completos de Espaço de Trabalho para Agentes de IA
Agent Architect é uma ferramenta interativa gratuita que guia os usuários por mais de 40 perguntas sobre seu agente de IA, depois compila tudo em um prompt formatado para gerar sete arquivos de workspace de nível de produção: SOUL.md, IDENTITY.md, AGENTS.md, OPERATIONS.md, TOOLS.md, MEMORY.md e HEARTBEAT.md.

Claude-voice: TTS Local com Destaque de Palavras para Código Claude
Claude-voice é uma ferramenta Python que adiciona conversão de texto em voz local com destaque de palavras em tempo real ao modo de voz do Claude Code. Ela usa Kokoro TTS (82 milhões de parâmetros) rodando totalmente localmente sem chaves de API.

Usando o OpenAI Codex IDE com Modelos Locais do Ollama no VSCodium
O OpenAI Codex IDE pode ser configurado para funcionar com modelos locais do Ollama no VSCodium usando configurações específicas no arquivo config.toml.