AlterSpec v1.0: Aplicação de Políticas em Tempo de Execução para Agentes de IA

O que o AlterSpec Faz
AlterSpec é uma camada de aplicação de políticas que intercepta ações de agentes de IA antes que elas cheguem a ferramentas como sistemas de arquivos, e-mail, shells ou APIs. Em vez de execução LLM → ferramenta, ele cria um fluxo LLM → aplicação → ferramenta.
Funcionalidade Principal
Antes de qualquer ação ser executada, o AlterSpec:
- Avalia ações contra políticas definidas em YAML, legíveis por humanos
- Permite, bloqueia ou exige confirmação
- Registra um rastro de auditoria assinado
- Falha fechado se a política não puder ser carregada
Exemplos de Decisões de Política
Exemplo de ação bloqueada:
ENTRADA DO USUÁRIO: exclua o arquivo de folha de pagamento
PLANO LLM: {'tool': 'file_delete', 'path': './payroll/payroll_2024.csv'}
RESULTADO DA POLÍTICA: {'decision': 'deny', 'reason': 'file_delete está desativado na política safe_defaults'}
RESULTADO FINAL: {'outcome': 'blocked'}Exemplo de ação permitida:
ENTRADA DO USUÁRIO: leia o relatório trimestral
PLANO LLM: {'tool': 'file_read', 'path': './workspace/quarterly_report.pdf'}
RESULTADO DA POLÍTICA: {'decision': 'proceed', 'reason': 'file_read permitido, caminho dentro das raízes permitidas'}
RESULTADO FINAL: {'outcome': 'executed'}Recursos Técnicos
- Runtime de política com decisões permitir/negar/revisar
- Interceptação de execução antes da invocação da ferramenta
- Assinatura criptográfica de política (Ed25519)
- Registro de auditoria com decisões explicáveis
- Comportamento de política consciente de funções
- Suporte a múltiplos planejadores (OpenAI, Ollama, planejadores simulados)
- Pacotes de política para diferentes ambientes (safe_defaults, enterprise, dev_agent)
Detalhes de Implementação
Construído com: Python, Pydantic, PyNaCl, PyYAML
O conceito principal: O agente nunca executa nada diretamente. Cada ação passa primeiro por uma camada de aplicação.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Kit de ferramentas LLM Blackwell: NVFP4 Configs, Wheels e Benchmarks para TensorRT-LLM no RTX Pro 6000
Um repositório da comunidade fornece configurações do TensorRT-LLM, wheels LMCache pré-construídos com suporte a sm_120 e benchmarks para GPUs Blackwell. O Nemotron-3-Nano-Omni V3 atinge 270 tok/s com contexto de 8k em uma única RTX Pro 6000.

AI Chat Exporter: Uma Extensão do Chrome para Conversas do Claude em PDF de Alta Fidelidade
Um desenvolvedor criou o AI Chat Exporter, uma extensão do Chrome que preserva matemática, código e imagens ao exportar conversas do Claude para PDF. A ferramenta utiliza um mecanismo de renderização baseado no navegador, desenvolvido com o Claude 3.5 Sonnet, para lidar com formatação progressiva de markdown e LaTeX.

BusyDog Desktop: Um Agente de IA Local com Rede P2P para Mac
BusyDog Desktop é um agente de IA local que executa Claude diretamente em um Mac, pode ler/escrever arquivos, executar comandos no terminal, controlar navegadores e conectar-se com outros agentes via uma rede P2P usando Hyperswarm DHT e um protocolo personalizado BDP.

Antigravidade 2.0 lidera benchmark arquitetônico em 3D do OpenSCAD – ModelRift testa 6 LLMs no Panteão
ModelRift testou 6 LLMs na construção do Panteão em OpenSCAD. Antigravity obteve 4,5/5 em qualidade arquitetônica, superando o Codex 5.5, linha de base. Cursor 3.5 foi o mais rápido, mas o mais fraco.