Sakana AI lance le laboratoire RSI : amélioration récursive de soi avec des modèles fondamentaux

✍️ OpenClawRadar📅 Publié: June 6, 2026🔗 Source
Sakana AI lance le laboratoire RSI : amélioration récursive de soi avec des modèles fondamentaux
Ad

Sakana AI a officiellement établi son laboratoire d'auto-amélioration récursive (RSI Lab), un groupe de recherche dédié chargé de repenser le processus même de développement de l'IA en utilisant l'IA. Plutôt que de forcer des modèles monolithiques, le laboratoire construit des architectures ouvertes et adaptatives qui s'améliorent collectivement – en s'appuyant sur une lignée de jalons publiés.

Principaux jalons de recherche soutenant le RSI

  • LLM-Squared (2024) : Développé avec Oxford et Cambridge, ce cadre permet aux LLMs d'inventer de meilleures façons d'entraîner les LLMs (LLM²). Il a produit DiscoPOP, un algorithme d'optimisation des préférences découvert et écrit entièrement par un LLM à travers une boucle évolutive générationnelle.
  • Darwin Gödel Machine (2025) : En collaboration avec UBC, DGM maintient une lignée évolutive de variantes d'agents qui réécrivent de manière autonome leur propre code. Sur SWE-bench, il a plus que doublé les performances de base – une amélioration absolue de 30 points de pourcentage.
  • ShinkaEvolve (2025) : Cadre open-source démontrant une évolution de programme efficace en échantillons. A résolu des problèmes d'optimisation complexes en utilisant seulement 150 échantillons et a généré une nouvelle fonction de perte d'équilibrage de charge améliorant les modèles Mixture-of-Experts (MoE).
  • ALE-Agent (2025) : Agent d'optimisation qui a obtenu la 1ère place sur 804 participants humains au concours heuristique AtCoder 058. Il exploite le passage à l'échelle massif lors de l'inférence et l'auto-apprentissage par essais-erreurs pour dériver de manière autonome de nouveaux algorithmes.
  • Digital Red Queen (2026) : Collaboration avec le MIT établissant une coévolution antagoniste ouverte dans Core War. Les LLMs écrivent des codes concurrents, générant des stratégies logicielles complexes émergentes et une évolution convergente – fondamental pour le RSI en cybersécurité.
  • The AI Scientist (2024–2026) : Découverte scientifique entièrement automatisée et ouverte, de la génération d'idées à l'exécution d'expériences, en passant par la rédaction complète d'articles et l'évaluation par les pairs.
Ad

Pourquoi cela est important pour les développeurs

Le RSI représente un passage d'une R&D statique menée par l'homme à des moteurs d'intelligence autonomes et auto-améliorants. L'approche du laboratoire – boucles d'optimisation évolutive, agents auto-réécrivants et science automatisée – a un impact direct sur la construction et l'amélioration des agents de codage IA. Plutôt que d'attendre un réglage manuel, ces systèmes affinent continuellement leurs propres architectures.

📖 Lire la source complète : HN AI Agents

Ad

👀 See Also

Deux projets de recherche remettent en cause l'apprentissage par imitation pour les agents web
News

Deux projets de recherche remettent en cause l'apprentissage par imitation pour les agents web

Deux projets de recherche démontrent les limites de l'entraînement par imitation seule pour les agents web : 'Browser in the Loop' utilise l'apprentissage par renforcement avec un modèle de 8 milliards de paramètres pour améliorer le succès de la soumission de formulaires, tandis que 'Concentrate or Collapse' montre que l'apprentissage par renforcement standard échoue avec les modèles de langage par diffusion, nécessitant une optimisation au niveau de la séquence.

OpenClawRadar
Problèmes d'accès LAN de l'interface de contrôle dans les réseaux Docker OpenClaw Bridge
News

Problèmes d'accès LAN de l'interface de contrôle dans les réseaux Docker OpenClaw Bridge

Un utilisateur signale des problèmes persistants d'accès à l'interface de contrôle d'OpenClaw via des connexions LAN dans des réseaux pont Docker, la version 2026.3.14 ayant brièvement pris en charge l'accès basé sur des jetons avant que les versions ultérieures ne reviennent à exiger un appairage et ne génèrent des erreurs de portée.

OpenClawRadar
L'IA maîtrise l'« art sombre » de la conception RFIC — des puces plus rapides, sans intuition humaine requise
News

L'IA maîtrise l'« art sombre » de la conception RFIC — des puces plus rapides, sans intuition humaine requise

Des chercheurs de Princeton utilisent l'apprentissage par renforcement et la conception inverse pour créer des circuits intégrés RF à partir de zéro. Les modèles de diffusion génèrent des mises en page originales avec des performances record, réduisant considérablement le temps de conception.

OpenClawRadar
L'application Claude en tête des classements de l'App Store américain, les assistants IA dominent le top 10
News

L'application Claude en tête des classements de l'App Store américain, les assistants IA dominent le top 10

Claude par Anthropic est actuellement l'application numéro 1 du classement des meilleures applications de l'App Store américain, avec ChatGPT à la 2e place et Google Gemini à la 4e. Le top 10 comprend trois assistants IA parmi des applications de shopping, de réseaux sociaux et d'utilitaires.

OpenClawRadar