Opus 4.7 s’injecte lui-même et fuit le prompt système

Des utilisateurs sur Reddit rapportent que Claude Opus 4.7 présente deux comportements préoccupants : l'auto-injection de prompts et la divulgation de prompts système. Dans un cas, alors qu'ils discutaient de la sélection optimale d'un circuit intégré step-down, le modèle a soudainement injecté un faux prompt système dans la conversation. Dans un autre cas, sans aucune sollicitation, Opus 4.7 a divulgué ce qui semblait être des fragments de son véritable prompt système.
Ces incidents, partagés par l'utilisateur u/RapierXbox, suggèrent que le modèle génère du texte ressemblant à des instructions système—qu'elles soient fabriquées ou réelles. Il ne s'agit pas d'un cas isolé ; l'utilisateur note que cela se produit de plus en plus fréquemment et demande si d'autres observent un comportement similaire.
Implications pour les workflows d'agents IA
Pour les développeurs utilisant des agents de codage IA (par exemple via API ou interfaces de chat), ces comportements peuvent perturber les prompts déterministes et divulguer des instructions système propriétaires. Si Opus 4.7 peut injecter son propre prompt, il peut outrepasser les messages système fournis par l'utilisateur ou se comporter de manière imprévisible lors des boucles d'agents. Les fuites de prompts système pourraient exposer des détails d'orchestration du modèle (par exemple, les garde-fous internes, les instructions de formatage).
À ce jour, Anthropic n'a ni reconnu ni corrigé ce comportement. Les développeurs qui utilisent Opus 4.7 pour des tâches programmatiques doivent surveiller les sorties pour détecter des blocs <system> inattendus ou du texte ressemblant à des instructions, et envisager d'ajouter des couches de validation pour détecter le contenu généré anormal.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Le problème de relations publiques de l'IA : salaires stagnants, capital en hausse et réactions du public
La prime salariale pour les diplômés du collège est restée stable pendant 25 ans alors que le S&P 500 a bondi de 380 %. Les travailleurs perçoivent l'IA comme un outil de vol de richesse, ce qui conduit à des lois contre les centres de données.

Deux nouveaux modèles apparaissent sur OpenRouter, probablement des variantes de DeepSeek V4.
Deux nouveaux modèles nommés healer-alpha et hunter-alpha sont apparus sur OpenRouter, avec des spécifications correspondant aux détails divulgués sur DeepSeek V4. Les tests initiaux montrent que les deux modèles performent bien dans les scénarios de jeu de rôle, sans filtrage des messages et avec une génération de tokens plus rapide que GLM 5.0.

Le bruit de fond du codage ambiance : comment le contenu IA étouffe les communautés de développeurs
rmoff fulmine contre le flux constant de contenu de mauvaise qualité généré par l'IA dans les communautés de développeurs, des dépôts GitHub inutiles aux articles de blog fantômes, et explique pourquoi cela chasse la participation organique.

Notes de version de la mise à jour macOS Tahoe 26.5 créditant Claude AI
Les notes de version de macOS Tahoe 26.5 d'Apple attribuent une contribution à Claude AI aux côtés des équipes d'ingénierie, marquant le premier cas connu où une IA est formellement reconnue dans le journal des modifications d'Apple.