O modelo de IA Mythos da Anthropic, Claude, foi revelado em vazamento de dados, descrito como 'mudança de paradigma' em capacidades

O que foi vazado
Um vazamento de dados de um armazenamento de dados não seguro e publicamente pesquisável revelou que a Anthropic está desenvolvendo e testando um novo modelo de IA chamado Claude Mythos. O vazamento incluiu aproximadamente 3.000 ativos não publicados vinculados ao blog da Anthropic, incluindo o que parecia ser um rascunho de postagem no blog anunciando o novo modelo.
Detalhes do modelo da fonte
De acordo com os documentos vazados:
- O modelo é chamado "Claude Mythos" e também é referido como "Capybara", que a Anthropic descreve como "um novo nome para um novo nível de modelo: maior e mais inteligente do que nossos modelos Opus".
- Capybara representa um novo nível acima do Opus na hierarquia de modelos da Anthropic (que atualmente inclui Opus como o maior/mais capaz, Sonnet como mais rápido/barato e Haiku como o menor/mais rápido).
- Comparado ao Claude Opus 4.6, o Capybara obtém "pontuações dramaticamente mais altas em testes de codificação de software, raciocínio acadêmico e cibersegurança, entre outros".
- O rascunho da postagem no blog descreve o Claude Mythos como "de longe o modelo de IA mais poderoso que já desenvolvemos".
- A Anthropic considera este modelo "uma mudança de patamar e o mais capaz que já construímos até hoje".
Status atual e lançamento
O modelo está atualmente em teste por "clientes de acesso antecipado" como parte de uma estratégia de lançamento cautelosa. De acordo com o material fonte:
- O modelo é caro para executar e ainda não está pronto para lançamento geral
- A Anthropic está "sendo deliberada sobre como o lançamos" devido à força de suas capacidades
- A empresa está trabalhando com "um pequeno grupo de clientes de acesso antecipado para testar o modelo"
- O vazamento também revelou detalhes de uma cúpula de CEOs planejada, apenas por convite, na Europa, como parte do esforço da Anthropic para vender modelos de IA para grandes clientes corporativos
Implicações de segurança
O rascunho da postagem no blog indicou que a empresa acredita que o Claude Mythos "representa riscos de cibersegurança sem precedentes". O próprio vazamento resultou do que a Anthropic descreveu como "erro humano" na configuração de seu sistema de gerenciamento de conteúdo, que tornou o conteúdo de rascunho publicamente acessível.
Contexto para desenvolvedores que usam agentes de IA para codificação
Para desenvolvedores que dependem de assistentes de IA para codificação, este vazamento sugere que melhorias significativas nas capacidades de codificação podem estar chegando da Anthropic. A menção específica de "pontuações dramaticamente mais altas em testes de codificação de software" indica avanços potenciais que podem afetar ferramentas e fluxos de trabalho que se integram com a API do Claude.
📖 Read the full source: HN AI Agents
👀 See Also

Claude Code v2.1.228: Detecção de Git Corrigida, Reversões de Modelo na TUI e Segurança de Skills
Claude Code v2.1.228 corrige a detecção de Git no Windows, reversões de modelo /tui, problemas de limpeza de sessão e reforça habilidades sincronizadas contra comandos de sombra ou execução de comandos locais !.

Codificadores de IA andam por aí com laptops abertos para manter os agentes funcionando
Tecnólogos estão carregando laptops no modo clamshell para que agentes de codificação de IA como Claude Code e OpenAI Codex não parem. Dicas incluem usar 'caffeinate' no Mac.
Conflito Sem Perdas do Claw com OpenClaw 2.0; Desativar Restaura a Estabilidade de Tarefas Longas
Um usuário relata que a atualização para o OpenClaw 2.0 causou a paralisação de fluxos de trabalho de 8 horas. Desativar o Lossless Claw restaurou a estabilidade, mas destacou sua importância para tarefas de longa duração.

Arquitetura de Memória Inspirada na Neurociência para Agentes de IA Validada pelo Auto-sonho do Claude
Uma arquitetura de memória inspirada na neurociência para agentes de IA, desenvolvida por um programador, com consolidação em ciclos de sono e três agentes especializados, alinha-se de perto com o recurso Auto-dream do Claude, recentemente lançado, que realiza passagens reflexivas sobre arquivos de memória.