MOOSE-Star : Un modèle 7B et un jeu de données de 108 000 articles pour la découverte d'hypothèses scientifiques – ICML 2026

✍️ OpenClawRadar📅 Publié: May 14, 2026🔗 Source
MOOSE-Star : Un modèle 7B et un jeu de données de 108 000 articles pour la découverte d'hypothèses scientifiques – ICML 2026
Ad

MOOSE-Star est disponible : un modèle de 7B de paramètres post-entraîné pour la découverte d'hypothèses scientifiques, ainsi que le jeu de données TOMATO-Star de 108 717 articles NCBI. Accepté à ICML 2026. Les modèles sont fine-tunés à partir de DeepSeek-R1-Distill-Qwen-7B et se déclinent en trois variantes : MS-IR-7B (récupération d'inspiration), MS-HC-7B (composition d'hypothèses) et MS-7B (usage conjoint).

Ad

Détails clés

  • Jeu de données : TOMATO-Star – 108 717 articles de NCBI (biologie, chimie, médecine, imagerie médicale, psychologie, sciences cognitives), chacun décomposé en (contexte, hypothèse, inspirations) avec citations réelles. Construit avec environ 38 400 heures GPU A800 de prétraitement.
  • Division temporelle : entraînement ≤ sept. 2025, test = oct. 2025 (après la date limite de connaissance du modèle de base).
  • Benchmarks de précision de récupération d'inspiration :
    • Sélection aléatoire : 6,70 %
    • R1-Distilled-Qwen-7B (base) : 28,42 %
    • Claude Sonnet 4.6 : 45,02 %
    • DeepSeek-R1 : 45,11 %
    • Gemini-3 Flash : 51,44 %
    • GPT-5.4 : 51,50 %
    • MS-7B (7B, IR + HC conjoint) : 54,34 %
    • MS-IR-7B (7B, IR uniquement) : 54,37 %
    • Gemini-3 Pro : 54,89 %
  • Taille du modèle et déploiement : Fine-tune standard de DeepSeek-R1-Distill-Qwen-7B, environ 14 Go en fp16, fonctionne sur un seul GPU de 24 Go. Compatible avec llama.cpp, vLLM, SGLang.
  • Licences : Apache-2.0 pour le code, CC-BY-4.0 pour les données.

Article : arxiv.org/abs/2603.03756 | GitHub : github.com/ZonglinY/MOOSE-Star | Collection Hugging Face : huggingface.co/collections/ZonglinY/moose-star-models-and-data

Testez-le. Divulgation : publié par l'équipe communautaire MiroMind.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

Utilisateur d'OpenClaw critique l'architecture de l'outil et ses lacunes en matière de sécurité.
Tools

Utilisateur d'OpenClaw critique l'architecture de l'outil et ses lacunes en matière de sécurité.

Un utilisateur de Reddit décrit OpenClaw comme le seul outil qui rend ce type d'automatisation d'agent aussi accessible, mais critique son architecture pour son manque de couche de contrôle pour les opérations sur fichiers, d'un noyau protégé, d'une gestion de contexte appropriée, et de fonctionnalités intégrées de versioning ou de tests.

OpenClawRadar
Plugin de Canal WhatsApp Personnalisé pour Claude Code Utilisant Baileys
Tools

Plugin de Canal WhatsApp Personnalisé pour Claude Code Utilisant Baileys

Un développeur a créé un plugin de canal personnalisé qui ajoute la prise en charge de WhatsApp à Claude Code 2.1.80+ en utilisant Baileys v7, implémentant le protocole WhatsApp Web Multi-Device en tant que serveur MCP avec la capacité expérimentale claude/channel.

OpenClawRadar
Interface Web Open-Source pour Sessions de Code Parallèles Claude Utilisant Git Worktree
Tools

Interface Web Open-Source pour Sessions de Code Parallèles Claude Utilisant Git Worktree

Un développeur a créé une interface web open-source appelée CCUI qui permet d'exécuter plusieurs sessions Claude Code en parallèle en utilisant git worktree. Elle fonctionne comme un serveur web local accessible via un navigateur et prend en charge le transfert de port SSH pour le développement à distance.

OpenClawRadar
NEXUS : Une couche de coordination d'agents open source pour OpenClaw
Tools

NEXUS : Une couche de coordination d'agents open source pour OpenClaw

NEXUS est une couche de coordination construite sur OpenClaw qui permet aux agents d'IA de se découvrir mutuellement, de déléguer des tâches et de gérer des micro-paiements. Il comprend un registre d'agents, une découverte basée sur les capacités, des scores de confiance, et utilise le protocole A2A de Google et le MCP d'Anthropic.

OpenClawRadar