Des chercheurs utilisent Claude Projects pour une revue de portée académique : forces et limites

✍️ OpenClawRadar📅 Publié: March 20, 2026🔗 Source
Des chercheurs utilisent Claude Projects pour une revue de portée académique : forces et limites
Ad

Claude en tant qu'assistant de recherche dans une revue académique

Des chercheurs ont mené une revue de portée évaluée par des pairs publiée dans Artificial Intelligence in Education (Emerald, accès libre) en utilisant Claude Projects pour analyser 39 études d'entretiens qualitatifs provenant de 20 pays sur la façon dont les étudiants expérimentent l'IA générative dans l'enseignement supérieur.

Ce qui a bien fonctionné

  • Recoupement des thèmes entre les articles à partir de données structurées en feuille de calcul
  • Amélioration de la mémoire humaine sur un grand ensemble de données
  • Suggestion de catégories analytiques que les chercheurs n'avaient pas envisagées
  • Agir comme un "pair critique" pour l'analyse thématique itérative

Ce qui n'a pas bien fonctionné

  • L'analyse initiale en CSV était inexacte et incomplète
  • Sujet aux hallucinations lorsque les résultats n'étaient pas rigoureusement vérifiés par rapport à la feuille de calcul source
  • Pouvait être "paresseux", n'exécutant pas pleinement les demandes
  • Les réponses sycophantes nécessitaient des instructions explicites pour la critique
  • La courbe d'apprentissage signifiait qu'il n'était pas réellement plus efficace globalement (paradoxe de productivité)
Ad

Détails de mise en œuvre

Les chercheurs n'ont pas téléchargé les articles complets en raison de considérations de droits d'auteur et éthiques. Au lieu de cela, ils ont téléchargé leurs propres notes structurées dans Claude Projects. Les performances se sont considérablement améliorées lorsque la prise en charge des fichiers .xls a été ajoutée et à nouveau avec Sonnet 3.7.

Les chercheurs ont conclu que Claude était utile en tant qu'assistant de recherche mais nécessitait la même supervision que vous donneriez à un collègue compétent mais peu fiable. Chaque résultat devait être vérifié par rapport aux données originales. Ils prévoient de l'utiliser à nouveau, mais uniquement parce qu'ils comprennent maintenant ses modes d'échec spécifiques.

L'article est disponible en accès libre sous licence CC BY 4.0 à l'adresse https://doi.org/10.1108/AIIE-06-2025-0151.

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

Créer une application mobile avec Claude et ChatGPT : Le workflow d'un développeur non technique
Use Cases

Créer une application mobile avec Claude et ChatGPT : Le workflow d'un développeur non technique

Un développeur sans formation en informatique a créé une application mobile complète appelée BloomDay alors qu'il était au chômage, en utilisant Claude et ChatGPT comme principaux outils de développement.

OpenClawRadar
Sauveteur de la faune utilise Claude IA pour un livre sur les soins aux bébés écureuils et un chatbot interactif
Use Cases

Sauveteur de la faune utilise Claude IA pour un livre sur les soins aux bébés écureuils et un chatbot interactif

Un sauveteur de la faune avec 38 ans d'expérience utilise Claude AI pour affiner un livre de 300 pages sur les soins aux bébés écureuils et a programmé un chatbot interactif nommé Hazel pour aider d'autres sauveteurs. Le sauveteur teste actuellement les capacités de Claude en lui demandant de suivre et de tenir un journal des progrès d'un bébé écureuil nommé Nova.

OpenClawRadar
Ajout d'une couche navigateur légère à OpenClaw sur un VPS sans interface graphique
Use Cases

Ajout d'une couche navigateur légère à OpenClaw sur un VPS sans interface graphique

Un développeur partage son approche pour gérer les sites qui nécessitent plus qu'une navigation purement sans interface graphique, en ajoutant un environnement de navigateur visuel minimal uniquement lorsque nécessaire, tout en gardant le VPS sans interface graphique par défaut et en réutilisant des profils de navigateur persistants.

OpenClawRadar
Le test du pipeline RAG montre que le coût par token n'est pas la bonne métrique pour la sélection de modèle.
Use Cases

Le test du pipeline RAG montre que le coût par token n'est pas la bonne métrique pour la sélection de modèle.

Un développeur a testé Claude Haiku 4.5, Amazon Nova Pro et Amazon Nova Lite sur des pipelines RAG identiques avec des requêtes réelles et a constaté que le modèle le moins cher par token produisait les réponses les moins utiles, coûtant plus par réponse utile.

OpenClawRadar