FixAI Dev: Um Jogo de Direitos do Consumidor Usando Claude Haiku com Contratos JSON Estritos

Um desenvolvedor criou o FixAI Dev, um jogo de navegador que usa o Claude Haiku para simular uma IA corporativa negando indevidamente solicitações de consumidores. Os jogadores argumentam de volta usando leis reais de proteção ao consumidor, com a confiança da IA caindo quando os argumentos são juridicamente sólidos.
Arquitetura e Implementação
O sistema usa uma separação rigorosa de responsabilidades: o Claude Haiku lida apenas com a geração de linguagem, enquanto o servidor define quais argumentos legais reduzem a resistência e em quanto. Há um contrato JSON rigoroso entre os dois componentes, garantindo que a lógica do jogo nunca toque a saída livre do LLM.
Detalhes do Jogo
- 37 casos na UE, EUA, Reino Unido e Austrália
- Cenários incluem reembolsos de voos, cartões bancários bloqueados, rejeições de visto e reclamações de seguro
- ~700 jogadores no primeiro mês
- Grátis sem necessidade de conta
Desafios Atuais e Planos Futuros
O desenvolvedor está encontrando um problema onde, em valores altos de resistência (85-95), o Haiku ocasionalmente dá redução parcial a argumentos fortes em vez da queda total esperada. Atualmente, eles lidam com isso com faixas de resistência explícitas no prompt do sistema e estão buscando abordagens mais limpas.
Direções futuras incluem:
- Sistema de certificado para trilhas de aprendizado concluídas
- Editor de níveis B2B onde empresas constroem seus próprios cenários de treinamento no mesmo mecanismo
- Possível rebranding do FixAI Dev para apelo empresarial
O desenvolvedor está procurando colaboradores com experiência em simulações de IA adversariais ou engenharia de prompt para cenários de roleplay para tornar o comportamento do bot mais realista.
📖 Read the full source: r/ClaudeAI
👀 See Also

mistral.rs Adiciona Suporte ao Gemma 4 12B: Multimodal, Agentivo e MTP
mistral.rs agora suporta o Gemma 4 12B com integração multimodal, agentiva e MTP. Instalação em um passo e execução com pesquisa web, execução de código e interface integrada.

Comparação no mundo real: Opus 4.6 vs MiMo-V2-Pro vs GLM-5 na configuração OpenClaw
Um desenvolvedor testou três modelos de IA em tarefas práticas, incluindo tradução de expressões idiomáticas turcas, codificação em Python, raciocínio espacial e automação de navegador. O MiMo-V2-Pro superou o Opus 4.6 em tarefas de codificação e custou 20 vezes menos, enquanto o Opus manteve vantagens na compreensão de idiomas não ingleses.

htmLLM-124M v2 Lançado: Modelo Especializado de Autocompletar HTML/Bootstrap
A LH-Tech-AI lançou o htmLLM-124M v2, um modelo de 124 milhões de parâmetros especializado em autocompletar HTML/Bootstrap que alcança 0.91 de perda de validação e treina em ~8 horas em uma única GPU T4.

ClaudeOrb: Extensão do Chrome Monitora o Uso da API Claude em Tempo Real
Um desenvolvedor criou o ClaudeOrb, uma extensão gratuita do Chrome que exibe a porcentagem da sessão do Claude, limites semanais, temporizadores de contagem regressiva, custos do Claude Code e tendências de gastos de 7 dias. A ferramenta foi criada usando o Claude Code após atingir limites de taxa sem aviso.