MOOSE-Star: Ein 7B-Modell und 108K-Papierdatensatz für die wissenschaftliche Hypothesenentdeckung – ICML 2026

✍️ OpenClawRadar📅 Veröffentlicht: 14. Mai 2026🔗 Source
MOOSE-Star: Ein 7B-Modell und 108K-Papierdatensatz für die wissenschaftliche Hypothesenentdeckung – ICML 2026
Ad

MOOSE-Star ist da: ein 7B-Parametermodell, nachtrainiert für die Entdeckung wissenschaftlicher Hypothesen, plus der TOMATO-Star-Datensatz mit 108.717 NCBI-Papieren. Angenommen auf der ICML 2026. Die Modelle basieren auf DeepSeek-R1-Distill-Qwen-7B und sind in drei Varianten erhältlich: MS-IR-7B (Inspirationsabruf), MS-HC-7B (Hypothesenaufstellung) und MS-7B (kombiniert).

Ad

Wichtige Details

  • Datensatz: TOMATO-Star – 108.717 Papers von NCBI (Biologie, Chemie, Medizin, medizinische Bildgebung, Psychologie, Kognitionswissenschaft), jeder aufgeteilt in (Hintergrund, Hypothese, Inspirationen) mit echten Zitaten. Erstellt mit ca. 38.400 A800-GPU-Stunden Vorverarbeitung.
  • Zeitliche Aufteilung: Trainingsdaten ≤ Sep. 2025, Testdaten = Okt. 2025 (nach dem Wissensende des Basismodells).
  • Benchmarks zur Inspirationstrefferquote:
    • Zufallsauswahl: 6,70 %
    • R1-Distilled-Qwen-7B (Basis): 28,42 %
    • Claude Sonnet 4.6: 45,02 %
    • DeepSeek-R1: 45,11 %
    • Gemini-3 Flash: 51,44 %
    • GPT-5.4: 51,50 %
    • MS-7B (7B, kombiniert IR + HC): 54,34 %
    • MS-IR-7B (7B, nur IR): 54,37 %
    • Gemini-3 Pro: 54,89 %
  • Modellgröße & Bereitstellung: Standard-DeepSeek-R1-Distill-Qwen-7B-Feintuning, ~14 GB bei fp16, läuft auf einer einzelnen 24-GB-GPU. Kompatibel mit llama.cpp, vLLM, SGLang.
  • Lizenzen: Apache-2.0 für Code, CC-BY-4.0 für Daten.

Paper: arxiv.org/abs/2603.03756 | GitHub: github.com/ZonglinY/MOOSE-Star | Hugging Face-Sammlung: huggingface.co/collections/ZonglinY/moose-star-models-and-data

Testen Sie es. Offenlegung: Gepostet vom MiroMind-Community-Team.

📖 Lesen Sie die vollständige Quelle: r/LocalLLaMA

Ad

👀 Siehe auch

ACO-System: Open-Source Multi-Agent-Pipeline von GitHub Issue zu gemergtem PR
Werkzeuge

ACO-System: Open-Source Multi-Agent-Pipeline von GitHub Issue zu gemergtem PR

ACO System ist ein Open-Source-Multi-Agenten-Framework, das autonom eine vollständige Software-Pipeline durchläuft – von GitHub Issue bis zum gemergten PR – mit sechs spezialisierten KI-Agenten. Es verfügt über ein deterministisches Architect-Gate, das Halluzinationen blockiert.

OpenClawRadar
Claude Code-Fähigkeit erstellt App Store-Screenshots mit Gemini AI
Werkzeuge

Claude Code-Fähigkeit erstellt App Store-Screenshots mit Gemini AI

Eine neue Claude Code-Fähigkeit namens /aso-cosmicmeta-ss erstellt App Store- und Google Play-Screenshots über einen 6-Phasen-Workflow, der Codebasen analysiert und Gemini AI zur Verbesserung nutzt. Die Fähigkeit enthält eine Freigabestufe, um Layoutprobleme zu erkennen, bevor API-Guthaben verwendet werden.

OpenClawRadar
Claude TimeTrack: macOS-Menüleisten-App, die Claude Code JSONL-Dateien liest, um Entwicklungszeit pro Projekt automatisch zu erfassen
Werkzeuge

Claude TimeTrack: macOS-Menüleisten-App, die Claude Code JSONL-Dateien liest, um Entwicklungszeit pro Projekt automatisch zu erfassen

Open-Source-macOS-Menüleisten-App, die Claude-Code-Sitzungs-JSONL-Dateien und Git-Verlauf parst, um die Zeit pro Projekt automatisch zu erfassen – keine manuellen Timer nötig.

OpenClawRadar
ATLAS: Open-Source-Testzeit-Berechnungspipeline für Qwen3-14B erreicht Spitzenleistung im Bereich Coding
Werkzeuge

ATLAS: Open-Source-Testzeit-Berechnungspipeline für Qwen3-14B erreicht Spitzenleistung im Bereich Coding

Ein College-Student hat ATLAS entwickelt, eine Open-Source-Testzeit-Rechenpipeline, die auf Qwen3-14B basiert und 74,6 % pass@1 bei LiveCodeBench v5-Problemen erreicht, bei Stromkosten von etwa 0,004 $ pro Aufgabe. Das System ist bei komplexen Problemen langsam, bietet aber eine vergleichbare Leistung wie Spitzenmodelle wie GPT-5 (84,6 %) und Claude 4.5 Sonnet (71,4 %).

OpenClawRadar