Anthropic sécurise 300 MW de capacité de calcul au Colossus 1 avec 220 000 GPU NVIDIA via un partenariat avec SpaceX

Anthropic a conclu un partenariat majeur avec SpaceX pour utiliser exclusivement toute la capacité de calcul du centre de données Colossus 1. Selon l'annonce, cet accord fournit à Anthropic plus de 300 mégawatts de capacité supplémentaire, comprenant plus de 220 000 GPU NVIDIA — le tout disponible dans le mois.
Points clés
- Partenaire : SpaceX (opérateur du centre de données)
- Installation : Centre de données Colossus 1 (toute la capacité de calcul réservée)
- Capacité : Plus de 300 mégawatts de puissance de calcul supplémentaire
- Matériel : Plus de 220 000 GPU NVIDIA
- Calendrier : Disponible dans le mois (aucune date précise donnée)
Cet accord élargit considérablement les ressources de calcul d'Anthropic, probablement pour entraîner et servir des modèles de pointe (par exemple, Claude). L'ampleur — 300 MW et 220 000 GPU — place cet accord parmi les plus importants accords de calcul IA monotenant. L'implication de SpaceX suggère une utilisation potentielle de Starlink pour la mise en réseau ou des solutions d'alimentation hors réseau, bien que cela reste spéculatif. Les modèles exacts de GPU (H100, B200, etc.) n'ont pas été précisés.
Pour les développeurs : plus de calcul pour Anthropic pourrait signifier une itération plus rapide des modèles, des fenêtres de contexte plus grandes ou une inférence moins coûteuse. Aucun impact immédiat sur les prix ou la disponibilité de l'API Claude n'a été annoncé.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Enquête sur le bogue ACP : une incompatibilité de protocole provoque l'erreur 'metadata is missing' avec Ollama local
Un bug confirmé dans l'intégration ACP/OpenClaw empêche les commandes de lancement acpx de fonctionner avec les modèles Ollama locaux en raison d'une incompatibilité de protocole où acpx attend du JSON mais reçoit une sortie texte.

Qwen 3 8B surpasse des modèles plus volumineux lors d'évaluations en aveugle par les pairs sur des tâches difficiles.
Lors d'une évaluation en aveugle par les pairs de 10 petits modèles de langage sur 13 tâches difficiles de niveau frontière, Qwen 3 8B a remporté 6 évaluations et s'est classé dans le top 3 dans 12 des 13 tâches, surpassant des modèles ayant jusqu'à 4 fois plus de paramètres. L'évaluation couvrait le débogage de verrous distribués, les bogues de concurrence en Go, l'optimisation SQL, le diagnostic médical bayésien, le paradoxe de Simpson, le théorème de vote d'Arrow et l'analyse du biais du survivant.

Stratégie des poids ouverts de Mistral : valorisation à 14 milliards de dollars sur la souveraineté, pas sur les benchmarks
Mistral a bâti un empire de l'IA de 14 milliards de dollars en proposant des modèles open-weight aux gouvernements et aux entreprises cherchant une indépendance vis-à-vis des technologies américaines et chinoises. Le chiffre d'affaires a atteint 200 millions de dollars en 2025, avec un objectif de 80 millions de dollars par mois d'ici décembre 2026.

La quantification Q8_0 de llama.cpp obtient une accélération de 3,1x sur les GPU Intel Arc grâce au correctif de réorganisation SYCL.
Une correction apportée au backend SYCL de llama.cpp améliore la quantification Q8_0 sur les GPU Intel Arc, passant de 21 % à 66 % de la bande passante mémoire théorique, atteignant 15,24 tokens/seconde contre 4,88 tokens/seconde auparavant sur un Arc Pro B70 avec Qwen3.5-27B.