Employés d’Amazon utilisant des agents IA MeshClaw pour « tokenmaxxer » et atteindre leurs objectifs d’utilisation
Amazon a déployé un outil d'agent IA interne appelé MeshClaw qui permet aux employés de créer des agents se connectant aux logiciels de travail. Selon trois sources proches du dossier, certains développeurs utilisent MeshClaw pour automatiser des tâches non essentielles uniquement pour augmenter la consommation de tokens — une pratique surnommée "tokenmaxxing".
Amazon a fixé des objectifs pour que plus de 80% des développeurs utilisent l'IA chaque semaine et a commencé à suivre la consommation de tokens dans des classements internes. Bien que l'entreprise affirme que les statistiques de tokens n'affecteront pas les évaluations de performance, plusieurs employés rapportent que les managers surveillent ces données. "Quand ils suivent l'utilisation, cela crée des incitations perverses", a déclaré un employé. Les employés de Meta se sont également livrés au tokenmaxxing.
MeshClaw s'inspire d'OpenClaw, un outil viral qui permet aux utilisateurs d'exécuter des agents localement. La version d'Amazon peut initier des déploiements de code, trier les e-mails et interagir avec Slack. Un mémo interne décrit MeshClaw comme quelque chose qui "rêve la nuit pour consolider ce qu'il a appris, surveille vos déploiements pendant que vous êtes en réunion et trie vos e-mails avant votre réveil." Plus de trois douzaines d'employés d'Amazon ont travaillé sur l'outil.
Certains employés ont soulevé des préoccupations de sécurité concernant l'octroi de permissions à un agent IA pour agir en leur nom. "La posture de sécurité par défaut me terrifie", a déclaré un employé. Amazon prévoit de dépenser 200 milliards de dollars en dépenses d'investissement cette année, principalement pour l'IA et l'infrastructure des centres de données.
📖 Lire la source complète : HN AI Agents
👀 See Also
La limite d'utilisation de Claude Max 20x ne s'applique qu'à une fenêtre de 5 heures, pas à une limite hebdomadaire.
Le plan Claude Max 20x d'Anthropic multiplie l'utilisation par session de 5 heures, et non par semaine. Les utilisateurs signalent un marketing trompeur et une plainte en cours.

La communauté NVIDIA DGX Spark lance Spark Arena pour des benchmarks LLM reproductibles
La communauté NVIDIA DGX Spark a lancé Spark Arena, un classement reproductible pour les performances des LLM à poids ouvert utilisant des outils et une méthodologie standardisés, avec les meilleurs résultats actuels incluant gpt-oss-120b et Qwen3-Coder-Next.

Prouver l'identité du modèle avec la technologie Modelwrap de Tinfoil
Tinfoil's Modelwrap garantit que les fournisseurs d'inférence servent exactement les poids de modèle qu'ils prétendent, en utilisant des engagements cryptographiques vérifiés par des enclaves sécurisées.

Claude Code v2.1.81 ajoute l'option bare pour le scripting, corrige les problèmes d'authentification et de mode vocal.
Claude Code v2.1.81 introduit un drapeau --bare pour les appels scriptés -p qui ignore les crochets, LSP et la synchronisation des plugins, nécessitant ANTHROPIC_API_KEY ou apiKeyHelper via --settings. La version corrige également les problèmes d'authentification de sessions multiples simultanées, la gestion des erreurs en mode vocal, et ajoute la relance d'autorisation --channels.