antirez DS4: Executando DeepSeek V4 Flash com Contexto de 1M no Mac Metal e DGX

✍️ OpenClawRadar📅 Publicado: May 10, 2026🔗 Source
antirez DS4: Executando DeepSeek V4 Flash com Contexto de 1M no Mac Metal e DGX
Ad

O criador do Redis, Salvatore Sanfilippo (antirez), acabou de lançar um novo projeto chamado DS4 no GitHub. O objetivo: fazer o DeepSeek V4 Flash rodar com uma janela de contexto de 1M tokens em hardware Apple Silicon (Metal). Ele também postou um vídeo do sistema rodando em um NVIDIA DGX.

O que o DS4 faz

O DS4 utiliza técnicas inovadoras para encaixar uma janela de contexto de 1M tokens do DeepSeek V4 Flash em hardware Mac Metal (por exemplo, chips da série M). Também foi demonstrado em um DGX, sugerindo que pode funcionar em GPUs de alto desempenho como a Pro 6000 com janelas de contexto um pouco menores e maior velocidade. Há especulações sobre suporte futuro para AMD.

O que está incluído

  • Endpoints de servidor: O servidor DS4 já fornece endpoints de API compatíveis com OpenAI e Anthropic, facilitando a integração com ferramentas de codificação agêntica como Cursor, Continue.dev ou agentes personalizados.
  • Repositório GitHub: https://github.com/antirez/ds4/ — confira o README para instruções de configuração, que provavelmente envolvem compilar com suporte Metal e baixar os pesos do DeepSeek V4 Flash.
  • Demonstração em vídeo: Há algumas horas, antirez postou um vídeo no X mostrando o sistema rodando em um DGX: https://x.com/antirez/status/2053381973226184749
Ad

Para quem é

Desenvolvedores com hardware Mac de alto desempenho (por exemplo, Mac Studio, MacBook Pro com M1 Max/Ultra ou M2/M3) ou GPUs NVIDIA que desejam executar um LLM local poderoso com uma janela de contexto muito grande para agentes de codificação ou pesquisa.

Chamado à ação da comunidade

O autor do post no Reddit incentiva qualquer pessoa com hardware potente a conferir o projeto e contribuir — seja testando, relatando bugs ou otimizando para GPUs AMD. O projeto está em estágio inicial, então o envolvimento da comunidade pode acelerar a compatibilidade.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Indicação de Assistente de Burocracia Alemã para Claude: Correspondência Jurídica Estruturada
Tools

Indicação de Assistente de Burocracia Alemã para Claude: Correspondência Jurídica Estruturada

Um prompt de sistema detalhado para o Claude que transforma a IA em um assistente estruturado para burocracia alemã, contratos, disputas de seguros e cartas oficiais, com verificação rigorosa de fatos e formatação DIN 5008.

OpenClawRadar
Modelo Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2 Lançado com Configuração LM Studio
Tools

Modelo Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2 Lançado com Configuração LM Studio

Um modelo não censurado combinado, que une a arquitetura Qwen3.5-9B com dados de treinamento do Claude 4.6 Opus, está agora disponível, com configurações específicas do LM Studio 0.4.7 fornecidas para desempenho ideal, incluindo temperatura 0.7 e amostragem top K 20.

OpenClawRadar
O Painel de Código do Claude Rastreia Mais de 19 Milhões de Commits Gerados por IA no GitHub
Tools

O Painel de Código do Claude Rastreia Mais de 19 Milhões de Commits Gerados por IA no GitHub

Um desenvolvedor criou um painel que rastreia mais de 19 milhões de commits gerados pelo Claude Code em repositórios públicos do GitHub, mostrando TypeScript (35,3%), Python (19,2%) e JavaScript (10,3%) como as principais linguagens. O sistema usa Next.js com Recharts e PostgreSQL, com um pipeline ETL que contorna os limites de taxa da API do GitHub.

OpenClawRadar
OpenHelm: Um Aplicativo macOS para Automatizar Tarefas de Código do Claude
Tools

OpenHelm: Um Aplicativo macOS para Automatizar Tarefas de Código do Claude

OpenHelm é um aplicativo gratuito e local para macOS que automatiza tarefas repetitivas de codificação com o Claude, executando trabalhos em um cronograma, repetindo automaticamente falhas e dividindo o trabalho em partes para evitar limites de sessão. Ele usa sua assinatura existente do Claude para chamadas de LLM.

OpenClawRadar