Annotations Amazon S3 : 1 Go de métadonnées par objet pour les workflows d'agents IA

AWS a annoncé aujourd'hui Amazon S3 annotations, une nouvelle capacité de métadonnées qui vous permet d'attacher jusqu'à 1 000 annotations nommées par objet, chacune jusqu'à 1 Mo, pour un total allant jusqu'à 1 Go par objet. Les annotations prennent en charge JSON, XML, YAML ou texte brut, et peuvent être modifiées ou supprimées sans réécrire l'objet. Cette fonctionnalité est conçue pour les workflows d'agents IA qui nécessitent un contexte riche et évolutif à grande échelle.
Détails clés
- Échelle : 1 000 annotations par objet, chacune de 1 Mo max, total de 1 Go par objet.
- Formats : JSON, XML, YAML, texte brut.
- Mutabilité : Ajoutez, modifiez ou supprimez des annotations à tout moment sans toucher aux données de l'objet.
- Cycle de vie : Les annotations suivent l'objet lors de la copie, de la réplication et des transferts inter-régions ; supprimées lors de la suppression de l'objet.
- Interrogeabilité : Lorsque S3 Metadata est activé, les annotations sont versées dans des tables d'annotations interrogeables via Amazon Athena et d'autres moteurs d'analyse. Les agents IA peuvent découvrir des données en langage naturel via le serveur S3 Tables MCP.
- Classes de stockage : Interrogez les annotations sur des objets dans n'importe quelle classe de stockage, y compris Glacier, sans restaurer les objets ni payer de frais de récupération.
Utilisation de la CLI
Créez une annotation JSON sur un objet existant :
# Créez un fichier JSON avec des métadonnées techniques
cat > mediainfo.json << 'EOF'
{"codec":"H.265","resolution":"3840x2160","audio_tracks":8,"frame_rate":29.97}
EOF
Attachez-la en tant qu'annotation
aws s3api put-object-annotation
--bucket my-media-bucket
--key videos/documentary-2026.mp4
--annotation-name mediainfo
--annotation-payload ./mediainfo.json
Attachez un résumé généré par IA en texte brut en tant qu'annotation séparée :
echo "Un documentaire nature de 90 minutes..." > summary.txt aws s3api put-object-annotation
--bucket my-media-bucket
--key videos/documentary-2026.mp4
--annotation-name ai-summary
--annotation-payload ./summary.txt
Cas d'usage
- Médias et divertissement : Suivez les transcriptions, les résultats de modération de contenu, les sous-titres et les métadonnées de licence en tant qu'annotations distinctes sur les actifs vidéo.
- Services financiers : Attachez des résumés d'investissement générés par IA aux documents de recherche pour les agents de recherche autonomes.
- Sciences de la vie : Annotez les données d'essais cliniques avec le statut réglementaire, les détails de cohorte de patients et les chaînes d'approbation — accessibles même dans Glacier sans frais de récupération.
Permissions
Les politiques IAM nécessitent les actions s3:PutObjectAnnotation et s3:GetObjectAnnotation. Aucune modification de l'objet lui-même n'est requise.
Comparaison avec les métadonnées existantes
| Capacité | Taille max | Modifiable ? | Idéal pour |
|---|---|---|---|
| Métadonnées système | Fixe | Non | Propriétés de l'objet (taille, classe de stockage, date de création) |
| Métadonnées utilisateur | 2 Ko | Non (définies lors du chargement) | Petites paires clé-valeur personnalisées |
| Balises d'objet | 10 balises, 128/256 caractères par clé/valeur | Oui | Contrôle d'accès, règles de cycle de vie, répartition des coûts |
| Annotations | 1 Go (1 000 × 1 Mo) | Oui | Contexte métier riche (JSON, XML, YAML, texte brut) |
📖 Lisez la source complète : HN AI Agents
👀 See Also

L'affinage de Phi-4-mini en n'entraînant que les paramètres de LayerNorm ne parvient pas à améliorer les performances.
Un amateur a testé l'entraînement uniquement des valeurs γ de LayerNorm sur Phi-4-mini dans les domaines Python et médical avec différents taux d'apprentissage et formats de données. Les performances se sont légèrement dégradées sur tous les benchmarks par rapport à la ligne de base, l'auteur concluant que les transformers acheminent déjà l'information dynamiquement via l'attention.

Yann LeCun à l'ONU : l'IA open-source est la seule voie à suivre pour la souveraineté mondiale
Lors de l'Open Source Week des Nations Unies, Yann LeCun a soutenu que l'IA propriétaire est trop coûteuse et centralisée, proposant une plateforme open-source fédérée appelée Project Tapestry où les nations contribuent via des vecteurs de paramètres sans partager de données brutes.

Sous-Q : Premier LLM entièrement sous-quadratique avec un contexte de 12 millions de tokens et une précision RULER de 95 %
Subquadratic lance SubQ 1M-Preview, un LLM sous-quadratique à mise à l'échelle linéaire du calcul, contexte de 12 millions de tokens, attention sparse 52 fois plus rapide que FlashAttention, et 95 % sur RULER 128K. Disponible via API, agent de code en ligne de commande (SubQ Code) et outil de recherche (SubQ Search).

Le prompt système complet de Claude Opus 4.6 a fuité sur GitHub.
L'intégralité du prompt système pour Claude Opus 4.6 a été publiée sur GitHub, révélant les instructions internes d'Anthropic.