Talkie : Un LLM de 13B entraîné exclusivement sur des textes antérieurs à 1931, utilisant Claude comme juge dans l'entraînement RL

✍️ OpenClawRadar📅 Publié: April 28, 2026🔗 Source
Talkie : Un LLM de 13B entraîné exclusivement sur des textes antérieurs à 1931, utilisant Claude comme juge dans l'entraînement RL
Ad

Une équipe de chercheurs comprenant Alec Radford (GPT, CLIP, Whisper), Nick Levine et David Duvenaud vient de publier Talkie, un modèle de langage de 13 milliards de paramètres entraîné exclusivement sur des textes publiés avant 1931. La date limite de connaissance du modèle est le 31 décembre 1930 — pas d'internet, pas de Wikipédia, pas de contenu sur la Seconde Guerre mondiale.

Pourquoi c'est important

Les LLM actuels (GPT, Claude, Gemini, Llama) partagent tous des données d'entraînement issues du Web moderne, ce qui rend difficile la séparation entre mémorisation et raisonnement véritable. Talkie brise cette lignée : sa distribution d'entraînement est fondamentalement différente, permettant aux chercheurs de tester si les capacités proviennent de la mémorisation ou de la généralisation. Comme le note l'équipe : « C'est une question importante de savoir dans quelle mesure les capacités des LM proviennent de la mémorisation par rapport à la généralisation. Les LM vintage permettent des tests de généralisation uniques. »

Rôle de Claude dans l'entraînement

Claude Sonnet 4.6 a servi de juge dans le pipeline d'apprentissage par renforcement de Talkie (DPO en ligne). De plus, Claude Opus 4.4 a généré des conversations multi-tours synthétiques utilisées dans l'étape finale de fine-tuning. L'équipe reconnaît l'ironie et le risque de contamination, signalant qu'elle travaille à éliminer cela dans les versions futures.

Ad

Capacités clés

  • Talkie peut apprendre à écrire du code Python à partir de seulement quelques exemples en contexte — malgré l'absence totale de code moderne dans ses données d'entraînement. Il raisonne à partir de textes mathématiques du 19e siècle, pas d'une récupération d'informations.
  • Conçu pour les prévisions à long terme : dans quelle mesure un modèle peut-il « prédire » l'avenir à partir de sa perspective figée de 1930 ?
  • Peut être utilisé pour étudier l'« invention » — s'il peut développer des idées postérieures à sa date limite de connaissance.
  • Aide à isoler les capacités qui viennent de l'architecture par rapport à celles absorbées des données Web.

Accès et licence

Talkie et sa variante sont sous licence Apache 2.0 et en poids ouverts sur Hugging Face. Vous pouvez discuter avec lui en direct via le lien fourni. L'équipe prévoit un modèle vintage à l'échelle GPT-3 plus tard cette année.

Ce qu'il est utilisé pour étudier

  • Prévisions à long terme : prédire les développements futurs à partir d'un point de vue historique.
  • Invention : générer des idées postérieures à sa date limite d'entraînement.
  • Identité du LLM : ce qui fait qu'un modèle est lui-même — isoler les effets de l'architecture par rapport à la distribution des données.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Sandbox externe pour agents : Exécution durable et démarrages à froid
News

Sandbox externe pour agents : Exécution durable et démarrages à froid

Exécuter la boucle de l'agent en dehors du sandbox isole les identifiants, permet la suspension du sandbox et simplifie le partage multi-utilisateur, mais nécessite de résoudre l'exécution durable et la latence de démarrage à froid.

OpenClawRadar
La bulle de l'IA est en train d'éclater ; nous ne le savons tout simplement pas encore.
News

La bulle de l'IA est en train d'éclater ; nous ne le savons tout simplement pas encore.

Les résultats du T2 des géants de la tech révèlent des fluctuations sauvages des actions, une baisse du free cash flow et des dépenses massives en IA. Le podcast de The Register analyse ce que cela signifie pour les équipes IT.

OpenClawRadar
Bogue non documenté découvert dans le code de l'ordinateur de guidage d'Apollo 11 grâce à l'IA et à un langage de spécification
News

Bogue non documenté découvert dans le code de l'ordinateur de guidage d'Apollo 11 grâce à l'IA et à un langage de spécification

Des chercheurs ont découvert un bogue de verrouillage de ressource dans le code de contrôle gyroscopique de l'ordinateur de guidage Apollo, passé inaperçu pendant 57 ans, en utilisant l'IA Claude et le langage de spécification Allium pour analyser 130 000 lignes de code assembleur.

OpenClawRadar
Deux défaillances de l'IA dans une même démo : Claude Code corrige l'orthographe au lieu de l'erreur de schéma, OpenAI brouille le mappage de champs personnalisés
News

Deux défaillances de l'IA dans une même démo : Claude Code corrige l'orthographe au lieu de l'erreur de schéma, OpenAI brouille le mappage de champs personnalisés

Lors d'un atelier en direct, Claude Code a ignoré une erreur de validation de schéma JSON pour corriger des avertissements orthographiques, et OpenAI a renvoyé des données incohérentes lors de sa première tentative de mappage de champs Salesforce personnalisés étranges.

OpenClawRadar