Google fait don du Protocole de paiement d'agents (AP2) à l'Alliance FIDO et publie la v0.2 avec des paiements « Humain non présent »

Google a fait don du protocole de paiement pour agents (AP2) à la FIDO Alliance, une association industrielle axée sur les normes de sécurité ouvertes. Parallèlement à ce transfert, Google a publié AP2 v0.2 sur GitHub, qui introduit des mises à jour cruciales pour les transactions autonomes, notamment le support des paiements « Humain non présent » — permettant aux agents d'IA d'exécuter des paiements de manière sécurisée sans intervention directe de l'utilisateur, sur la base d'instructions pré-autorisées.
La fonctionnalité « Humain non présent » permet aux agents d'effectuer de manière autonome des transactions urgentes, comme l'achat de billets en édition limitée dès leur mise en vente, sans que l'utilisateur n'ait besoin d'être présent pour approuver chaque étape. Cela repose sur des instructions pré-autorisées de l'utilisateur, garantissant que l'agent agit dans des limites définies.
AP2 v0.2 contribue également à la norme d'intention vérifiable, co-développée avec Mastercard et également proposée à la FIDO Alliance. L'intention vérifiable crée un journal infalsifiable des actions de l'agent autorisées par l'utilisateur, offrant responsabilité et auditabilité pour les transactions autonomes.
En transférant la propriété à la FIDO Alliance, Google vise à garantir qu'AP2 reste indépendant de la plateforme et piloté par la communauté, accélérant ainsi l'adoption de paiements sécurisés par agents dans l'industrie. Le protocole est conçu pour servir d'infrastructure ouverte pour le shopping et le commerce basés sur l'IA, avec le soutien des leaders de l'industrie.
📖 Read the full source: HN AI Agents
👀 See Also

Titre : Modèles locaux vs cloud : Qwen-3.6-27B, Gemma-4-31B, Claude Haiku, Codex-Spark sur la génération de code difficile
Un utilisateur a testé Qwen-3.6-27B (q4_k_m) localement sur une RTX 5080 par rapport à Gemma-4-31B, Claude Haiku 4.5 et Codex-Spark via API sur une tâche de code complexe. Seul Codex-Spark a produit un code complet (mais avec des erreurs d'import) ; tous les autres ont partiellement échoué. Coût : Gemma a utilisé 0,112 $ pour 803 000 tokens d'entrée.

Utilisateur de Claude Pro signale que sa fenêtre d'utilisation de 5 heures a été consommée par une seule invite sans aucun résultat
Un utilisateur de Claude Pro rapporte qu'une seule invite a consommé la totalité de sa fenêtre d'utilisation de 5 heures, ne retournant qu'un texte de planification sans livrable. L'incident met en lumière les problèmes de consommation de jetons lors du raisonnement interne et l'absence de garde-fous.

La recherche montre que les utilisateurs d'IA acceptent souvent les réponses des LLM sans vérification.
Une recherche de l'Université de Pennsylvanie a révélé que les utilisateurs d'IA s'engagent dans une 'reddition cognitive', acceptant les réponses des LLM avec un examen minimal. Dans les expériences, les utilisateurs ont accepté les réponses correctes de l'IA 93 % du temps et les réponses incorrectes 80 % du temps, même lorsque l'IA se trompait la moitié du temps.

Benchmark Open Source contre Modèles de Frontière : Scène de Voiture sur Toile en Fichier Unique
Un développeur a testé 12 modèles, dont GPT-5.5, Claude Opus 4.7 et Qwen 3.6 Plus, sur une tâche d'animation de conduite de voiture en un seul fichier HTML Canvas, avec résultats comparés publiquement.