MOOSE-Star: Um Modelo de 7B e um Conjunto de Dados de 108K Artigos para Descoberta de Hipóteses Científicas – ICML 2026

✍️ OpenClawRadar📅 Publicado: May 14, 2026🔗 Source
MOOSE-Star: Um Modelo de 7B e um Conjunto de Dados de 108K Artigos para Descoberta de Hipóteses Científicas – ICML 2026
Ad

MOOSE-Star foi lançado: um modelo de 7B parâmetros pós-treinado para descoberta de hipóteses científicas, além do conjunto de dados TOMATO-Star com 108.717 artigos do NCBI. Aceito no ICML 2026. Os modelos são fine-tuned a partir do DeepSeek-R1-Distill-Qwen-7B e vêm em três variantes: MS-IR-7B (recuperação de inspiração), MS-HC-7B (composição de hipóteses) e MS-7B (uso conjunto).

Ad

Detalhes Principais

  • Conjunto de dados: TOMATO-Star – 108.717 artigos do NCBI (biologia, química, medicina, imagem médica, psicologia, ciência cognitiva), cada um decomposto em (contexto, hipótese, inspirações) com citações reais. Construído com ~38.400 horas de GPU A800 em pré-processamento.
  • Divisão temporal: treino ≤ Setembro de 2025, teste = Outubro de 2025 (após o corte de conhecimento do modelo base).
  • Benchmarks de precisão na recuperação de inspiração:
    • Seleção Aleatória: 6,70%
    • R1-Distilled-Qwen-7B (base): 28,42%
    • Claude Sonnet 4.6: 45,02%
    • DeepSeek-R1: 45,11%
    • Gemini-3 Flash: 51,44%
    • GPT-5.4: 51,50%
    • MS-7B (7B, IR + HC conjunto): 54,34%
    • MS-IR-7B (7B, apenas IR): 54,37%
    • Gemini-3 Pro: 54,89%
  • Tamanho do modelo e implantação: Fine-tune padrão do DeepSeek-R1-Distill-Qwen-7B, ~14GB em fp16, roda em uma única GPU de 24GB. Compatível com llama.cpp, vLLM, SGLang.
  • Licenças: Apache-2.0 para código, CC-BY-4.0 para dados.

Paper: arxiv.org/abs/2603.03756 | GitHub: github.com/ZonglinY/MOOSE-Star | Coleção Hugging Face: huggingface.co/collections/ZonglinY/moose-star-models-and-data

Teste-o. Divulgação: postado pela equipe da comunidade MiroMind.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Skales: Um Agente de IA de Desktop que se Conecta ao Ollama Sem Docker
Tools

Skales: Um Agente de IA de Desktop que se Conecta ao Ollama Sem Docker

Skales é um agente de IA para desktop que se conecta ao Ollama localmente, sem necessidade de configuração Docker. Oferece recursos como gerenciamento de e-mail via IMAP do Gmail, automação de navegador e chat de voz usando Whisper através do Groq.

OpenClawRadar
Aplicativo Hyper iOS: Gravador de Voz com Transcrição em Tempo Real e Extração de Ações
Tools

Aplicativo Hyper iOS: Gravador de Voz com Transcrição em Tempo Real e Extração de Ações

Hyper é um aplicativo de gravação de voz para iOS que transcreve conversas em tempo real, fornece resumos e itens de ação, e permite consultas durante a conversa por meio de detecção de palavra de ativação. Foi projetado para reuniões não estruturadas como conversas individuais, bate-papos de café e reuniões rápidas.

OpenClawRadar
Codesight: Motor de Contexto de IA Reduz 30K-60K Tokens das Sessões de Código do Claude
Tools

Codesight: Motor de Contexto de IA Reduz 30K-60K Tokens das Sessões de Código do Claude

Codesight é uma ferramenta de código aberto que analisa bases de código para fornecer contexto estruturado a agentes de IA de programação, reduzindo o desperdício de tokens. Um desenvolvedor colaborou com o mantenedor para adicionar análise AST para Next.js e Prisma, um conjunto de avaliação, telemetria de tokens e perfis para Claude Code e Cursor.

OpenClawRadar
InsForge: Backend Postgres Autônomo com Integração MCP para Agentes de IA de Codificação
Tools

InsForge: Backend Postgres Autônomo com Integração MCP para Agentes de IA de Codificação

InsForge é uma alternativa de backend auto-hospedada e de código aberto ao Supabase que se conecta ao Claude Code via MCP, permitindo que agentes de IA vejam esquema, políticas e estado do serviço. Inclui PostgreSQL 16.4, PostgREST, Deno Runtime, autenticação, armazenamento e funções de borda.

OpenClawRadar