Révision : Éditeur IA conçu avec des outils de codage agentique et Y.js CRDT

Implémentation technique
Revise a été développé sur 10 mois à l'aide d'outils de codage agentique, le développeur rapportant n'avoir jamais travaillé aussi rapidement dans sa carrière de développement. L'architecture comprend un moteur de traitement de texte et une couche de rendu entièrement construits à partir de zéro. La seule bibliothèque tierce utilisée est Y.js pour la pile CRDT (Conflict-Free Replicated Data Type).
Fonctionnalités IA
L'éditeur intègre plusieurs modèles d'IA pour le traitement de documents :
- GPT-5.4 Mini
- GPT-5.4
- GPT-5.4 Pro
- Claude Haiku 4.5
- Claude Sonnet 4.6
- Claude Opus 4.6
L'agent IA travaille côte à côte avec les utilisateurs dans la même interface, fournissant des suggestions de relecture et de révision en ligne. Il peut détecter les incohérences dans les documents, telles que les décalages de chronologie ou les déclarations contradictoires concernant les changements de revenus.
Capacités de traitement de documents
- Importer des documents Word et Google Docs
- Extraire le contenu des PDF à l'aide de LLM multimodaux
- Relire, réviser et perfectionner les documents existants
- Fonctionnalité d'exportation avec divers paramètres
Personnalisation utilisateur
Revise apprend les préférences des utilisateurs au fil du temps, notamment :
- Préférences de pronoms (par exemple, ils/elles)
- Préférences de style de feedback (direct vs. éloges fleuries)
- Préférences orthographiques (États-Unis vs. autres variantes)
- Préférences de formatage (APA 7, utilisation de la virgule d'Oxford)
- Préférences de ton (chaleureux et précis, évitant les points d'exclamation)
- Considérations d'accessibilité
- Préférences de structure de document (paragraphes courts, brouillons concis)
Préférences de rédaction technique
Le système prend en charge des exigences spécifiques de documentation technique :
- Les affirmations de performance doivent inclure la configuration des benchmarks, la forme de la charge de travail, la taille de l'échantillon et les comparaisons de base
- Préférence pour des contrats API concrets avec des charges utiles de requête/réponse, des règles de pagination et une sémantique d'idempotence
- Les changements cassants doivent être signalés (changements d'API, rétro-remplissage de données, migrations d'index, portes de version client)
- Les exigences comme critères d'acceptation numérotés avec cas limites, comportement de nouvelle tentative et détails d'expiration
- Confiance dans les métriques comme les p95, budgets d'erreur, profondeur de file d'attente et nombre d'incidents plutôt que dans les adjectifs
📖 Read the full source: HN AI Agents
👀 See Also

Le Benchmark OpenClaw Montre que Qwen3.5:27B Surpasse les Autres LLMs Locaux pour les Tâches d'Agent
Un benchmark de 7 LLM locaux sur 22 tâches d'agent réelles utilisant OpenClaw a révélé que qwen3.5:27b-q4_K_M a obtenu 59,4 %, tandis que le deuxième, qwen3.5:35b, n'a obtenu que 23,2 %. La plupart des modèles n'ont pas pu trouver des outils de base comme les fonctions de messagerie.

Artifactr : Outil CLI local-first pour gérer les artefacts des agents d'IA de codage
Artifactr est un outil CLI gratuit et open-source pour gérer les artefacts LLM comme les compétences, commandes et définitions d'agents. Il stocke les fichiers dans des coffres portables sans connexion réseau et prend en charge la synchronisation automatique via des liens symboliques.

Wolfram Tech désormais disponible en tant qu'outil de base pour les systèmes LLM
Stephen Wolfram annonce que le langage Wolfram est désormais disponible en tant qu'outil fondamental pour les systèmes LLM, fournissant un calcul approfondi et des connaissances précises pour compléter les capacités des LLM. Cette annonce fait suite à trois ans de développement depuis la sortie initiale du plugin Wolfram pour ChatGPT en mars 2023.

Développeur mesure la frustration avec le 'F-Bombs Per Thousand Prompts' sur 44 212 journaux Claude Code
Un développeur a suivi le « fpk » (jurons par millier de requêtes) sur 44 412 requêtes Claude Code pendant 5 mois, constatant que la frustration a chuté de 3,4× entre Claude Opus 4-5 et 4-7, et que la plupart des jurons visaient les outils d'environnement, pas le modèle.