Exploration de Step 3.5 Flash : Modèle Open-Source pour un Raisonnement Profond Rapide

Step 3.5 Flash est un modèle de base open-source axé sur la fourniture de capacités de raisonnement profond rapides et fiables. Il utilise une architecture éparse de Mélange d'Experts (MoE), activant seulement 11 milliards de ses 196 milliards de paramètres par token. Cette activation sélective lui confère une haute "densité d'intelligence", lui permettant de rivaliser avec les meilleurs modèles propriétaires tout en restant agile pour les interactions en temps réel.
Raisonnement profond et vitesse
Le modèle intègre une Prédiction Multi-Token à 3 voies (MTP-3), lui permettant de traiter 100 à 300 tokens par seconde, avec un pic à 350 pour les tâches de codage en flux unique—idéal pour un raisonnement complexe et multi-étapes avec une réactivité rapide.
Performance en codage et tâches d'agent
Step 3.5 Flash excelle dans les tâches agentiques, soutenu par un cadre d'apprentissage par renforcement évolutif qui assure une amélioration continue. Il a obtenu un score de 74,4 % sur le benchmark SWE-bench Verified et 51,0 % sur Terminal-Bench 2.0, reflétant sa capacité à gérer des tâches sophistiquées et à long terme.
Traitement efficace de contexte long
Il prend en charge une grande fenêtre de contexte de 256K en utilisant un ratio d'Attention à Fenêtre Glissante (SWA) de 3:1, intégrant trois couches SWA pour chaque couche d'attention complète. Cette méthode réduit considérablement la charge de calcul par rapport aux modèles de contexte long traditionnels.
Déploiement local et accessibilité
Conçu pour un déploiement local facile, Step 3.5 Flash peut fonctionner en toute sécurité sur du matériel grand public haut de gamme, tel que le Mac Studio M4 Max et le NVIDIA DGX Spark, garantissant la confidentialité des données sans compromettre les performances.
📖 Lire la source complète : HN AI Agents
👀 See Also

Notes de version de Claude Desktop 1.1.4498 : Rebond du Dock, Extension de l'environnement Shell et Prise en charge du Cloud Gouvernemental
Claude Desktop 1.1.4498 ajoute des notifications de rebond dans le dock pour attirer l'attention de l'utilisateur, étend l'extraction de l'environnement shell pour inclure des variables spécifiques à Claude, et introduit la détection des déploiements gouvernementaux/personnalisés. La mise à jour réduit également le délai d'expiration des appels d'outils du pont Chrome de 120 à 10 secondes.

Talents Connect d'Amazon : des agents IA automatisent les entretiens d'embauche en masse
Amazon lance Connect Talent, un agent IA qui mène des entretiens d'embauche automatisés pour le recrutement à grande échelle. Le logiciel gère le tri, l'entretien et la prise de notes sans intervention humaine, et s'inscrit dans une stratégie plus large de développement d'agents IA autonomes.
Deloitte admet que l'IA a rédigé des parties du rapport du conseil de Wellington — mais maintient ses conclusions
Le maire de Wellington affirme que « de grandes parties » d'un rapport de Deloitte à 435 000 $ ont été rédigées par IA. Le rapport prétendait 330 employés en trop, mais des erreurs de données révèlent des hypothèses erronées.

Explorer n8n comme alternative aux compétences OpenClaw pour l'automatisation
La communauté OpenClaw sur Reddit débat des avantages et inconvénients de l'utilisation de n8n par rapport aux compétences OpenClaw pour les tâches d'automatisation. Les points clés de discussion incluent la facilité d'utilisation, la flexibilité et des exemples d'applications concrètes.