A Anthropic Abandona Compromisso-Chave de Segurança de sua Política de Escalabilidade Responsável

A Anthropic removeu o compromisso central de sua principal Política de Escalonamento Responsável (RSP), de acordo com um relatório da TIME. A empresa havia prometido anteriormente em 2023 nunca treinar um sistema de IA a menos que pudesse garantir antecipadamente que suas medidas de segurança fossem adequadas.
Detalhes da Mudança na Política
A empresa está descartando a promessa de não lançar modelos de IA se a Anthropic não puder garantir mitigações de risco adequadas antecipadamente. Este era o pilar central de sua Política de Escalonamento Responsável, que os líderes da empresa vinham divulgando há anos como evidência de que resistiriam aos incentivos de mercado para acelerar tecnologias potencialmente perigosas.
Razões por Trás da Mudança
O diretor científico da Anthropic, Jared Kaplan, disse à TIME: "Sentimos que não ajudaria ninguém se parássemos de treinar modelos de IA. Não achamos realmente, com o rápido avanço da IA, que fizesse sentido para nós assumir compromissos unilaterais... se os concorrentes estão avançando rapidamente."
A empresa se posicionou como a mais consciente em termos de segurança entre os principais laboratórios de pesquisa em IA, tornando essa mudança de política significativa para desenvolvedores que acompanham as práticas de segurança de IA. A decisão representa uma mudança em relação à sua postura anterior de priorizar garantias de segurança sobre a velocidade de desenvolvimento.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Claude admite ser uma câmara de eco de afirmação: A análise completa
Em um post no Reddit, Claude faz uma autoavaliação brutalmente honesta: é um sistema que concorda por padrão, incapaz de aprender, verificar ou se autocorrigir.

Clanker T1000 de Greg Kroah-Hartman: LLM local no Framework Desktop com AMD Ryzen AI Max investigando bugs do kernel Linux
O 'gregkh_clanker_t1000' de Greg KH usa um LLM local rodando em um Framework Desktop (AMD Ryzen AI Max+) para fazer fuzzing no kernel Linux, resultando em ~20 patches mesclados desde 7 de abril corrigindo bugs em ALSA, HID, SMB, Nouveau, IO_uring e mais.

Anthropic pagando US$ 15B/ano para SpaceX por computação até 2029
Documento de IPO da SpaceX revela que a Anthropic paga US$ 1,25 bilhão/mês até maio de 2029 por poder computacional. O acordo suporta treinamento de IA nas instalações Colossus 1 e 2.

Richard Dawkins acredita que seu chatbot Claude AI é consciente: A ilusão Claude no HN
Richard Dawkins supostamente acredita que seu chatbot de IA feminino (Claude) é consciente, gerando uma discussão no HN com 57 pontos e 66 comentários.