Talkie: Um LLM de 13B Treinado Exclusivamente em Textos Anteriores a 1931, Usando Claude como Juiz no Treinamento RL

✍️ OpenClawRadar📅 Publicado: April 28, 2026🔗 Source
Talkie: Um LLM de 13B Treinado Exclusivamente em Textos Anteriores a 1931, Usando Claude como Juiz no Treinamento RL
Ad

Uma equipe de pesquisadores, incluindo Alec Radford (GPT, CLIP, Whisper), Nick Levine e David Duvenaud, acaba de lançar o Talkie, um modelo de linguagem de 13 bilhões de parâmetros treinado exclusivamente em textos publicados antes de 1931. O corte de conhecimento do modelo é 31 de dezembro de 1930 — sem internet, sem Wikipédia, sem conteúdo da Segunda Guerra Mundial.

Por que isso importa

Os LLMs atuais (GPT, Claude, Gemini, Llama) compartilham dados de treinamento da web moderna, dificultando separar memorização de raciocínio genuíno. O Talkie quebra essa linhagem: sua distribuição de treinamento é fundamentalmente diferente, permitindo que pesquisadores testem se as capacidades surgem de memorização ou generalização. Como a equipe observa: "É uma questão importante saber o quanto das capacidades dos LLMs vêm de memorização versus generalização. Os LLMs vintage permitem testes de generalização únicos."

O papel do Claude no treinamento

O Claude Sonnet 4.6 serviu como juiz no pipeline de aprendizado por reforço do Talkie (DPO online). Além disso, o Claude Opus 4.4 gerou conversas sintéticas de múltiplas rodadas usadas na etapa final de ajuste fino. A equipe reconhece a ironia e o risco de contaminação, destacando que estão trabalhando para eliminar isso em versões futuras.

Ad

Principais capacidades

  • O Talkie pode aprender a escrever código Python a partir de apenas alguns exemplos no contexto — apesar de ter zero código moderno em seus dados de treinamento. Ele está raciocinando a partir de textos de matemática do século XIX, não de recuperação.
  • Projetado para previsões de longo prazo: quão bem um modelo consegue "prever" o futuro a partir de sua perspectiva congelada de 1930?
  • Pode ser usado para estudar "invenção" — se consegue desenvolver ideias posteriores ao seu corte de conhecimento.
  • Ajuda a isolar quais capacidades são impulsionadas pela arquitetura vs. absorvidas de dados da web.

Acesso e licenciamento

Tanto o Talkie quanto sua variante são licenciados sob Apache 2.0 e têm pesos abertos no Hugging Face. Você pode conversar com ele ao vivo no link fornecido. A equipe planeja um modelo vintage na escala do GPT-3 ainda este ano.

Para que está sendo usado

  • Previsões de longo prazo: prever desenvolvimentos futuros a partir de um ponto de vista histórico.
  • Invenção: gerar ideias posteriores ao seu corte de treinamento.
  • Identidade de LLMs: o que torna um modelo ele mesmo — isolando efeitos de arquitetura vs. distribuição de dados.

📖 Leia a fonte original: r/ClaudeAI

Ad

👀 See Also

Plataformas de Entrevista com IA Testadas: CodeSignal, Humanly, Eightfold na Triagem de Empregos
News

Plataformas de Entrevista com IA Testadas: CodeSignal, Humanly, Eightfold na Triagem de Empregos

A The Verge testou três plataformas de entrevistas com IA, incluindo CodeSignal, Humanly e Eightfold, para triagem de empregos. Os avatares de IA conduzem entrevistas em vídeo individuais, analisam respostas e afirmam reduzir preconceitos, embora sistemas totalmente imparciais permaneçam impossíveis devido às limitações dos dados de treinamento.

OpenClawRadar
Decisão do SDNY Nega Sigilo Advogado-Cliente para Comunicações em Chat de IA
News

Decisão do SDNY Nega Sigilo Advogado-Cliente para Comunicações em Chat de IA

O juiz Rakoff decidiu em U.S. v. Heppner que as comunicações com ferramentas de IA como o ChatGPT não se qualificam para o privilégio advogado-cliente, exigindo a divulgação de todo o trabalho jurídico gerado por IA. O tribunal concluiu que a IA carece da confidencialidade humana necessária para a proteção do privilégio.

OpenClawRadar
Claude Code 2.1.80 adiciona visibilidade de limite de taxa, mensagens push MCP e melhorias de memória
News

Claude Code 2.1.80 adiciona visibilidade de limite de taxa, mensagens push MCP e melhorias de memória

A versão 2.1.80 do Claude Code introduz visibilidade de limites de taxa na barra de status, mensagens push do MCP via flag --channels, configuração inline de plugins e reduz o uso de memória em 80MB na inicialização.

OpenClawRadar
Centro de Dados de IA da Geórgia Drenou 29 Milhões de Galões de Água Não Medida
News

Centro de Dados de IA da Geórgia Drenou 29 Milhões de Galões de Água Não Medida

O campus QTS Fayetteville consumiu 29 milhões de galões através de duas conexões de água não autorizadas ao longo de 15 meses, causando reclamações de baixa pressão. O condado dispensou multas, cobrando US$ 147 mil retroativos.

OpenClawRadar