Utiliser l'IA pour démêler 10 000 titres de propriété brésiliens : une étude de cas technique

Contexte du projet et problème
Une entreprise immobilière brésilienne a hérité d'environ 10 000 titres de propriété répartis sur plus de 10 municipalités, après des décennies de mauvaise gestion. Les données comprennent des centaines de "contrats de tiroir" non enregistrés (ventes informelles jamais déposées), des ventes en double des mêmes propriétés, des contrats frauduleux, des procurations falsifiées, des occupations irrégulières et environ 500 procès en cours, incluant des revendications de prescription acquisitive, des adjudications forcées, des expulsions, des litiges sur des ventes en double et 2 actions collectives. Les archives physiques des documents sont partiellement détenues par la police dans le cadre d'une ancienne enquête.
Approche technique
L'équipe (6 avocats + 3 opérateurs) a décidé de ne pas construire d'infrastructure au préalable, optant plutôt pour une approche de découverte d'abord avec l'aide de l'IA. Le plan comprend cinq étapes :
- Étape 1 - Numérisation physique : Les documents sont organisés par municipalité, numérisés par lots avec la convention de nommage : [municipalité]_[type-de-document]_[séquence] à l'aide d'un scanner de documents avec chargeur automatique (ADF).
- Étape 2 - OCR : Envisage Google Document AI, Mistral OCR 3, AWS Textract ou d'autres outils. L'équipe sollicite des retours sur des outils spécifiquement testés sur des documents dégradés des registres latino-américains.
- Étape 3 - Découverte : Envoi direct de la sortie OCR dans des outils d'IA avec de grandes fenêtres de contexte pour une analyse ouverte avant la mise en place de la base de données. Utilisation de Gemini 3.1 Pro (dans NotebookLM ou une autre interface) pour une analyse large par lots avec des invites comme "quels lots semblent liés à plus d'un acheteur ?", "signaler les contrats avec des dates incohérentes", "identifier des groupes de noms ou d'activités suspects" et "aidez-nous à voir les problèmes et solutions pour ce que nous ne voyons pas". Exécution de projets Claude en parallèle pour une analyse similaire.
- Étape 4 - Nettoyage et standardisation des données : Normalisation des données brutes extraites avant insertion dans la base de données. Traitement des noms de municipalités écrits de multiples façons ("B. Vista", "Bela Vista de GO", "Bela V. Goiás") pour les ramener à une forme canonique, standardisation des CPF (numéros d'identification personnelle brésiliens) avec et sans ponctuation, correction des descriptions incohérentes du statut des lots pour les catégoriser, et appariement flou des noms d'acheteurs avec des variations orthographiques. Outils : Python + rapidfuzz pour l'appariement flou, API Claude pour normaliser les champs de texte libre en catégories. L'équipe se demande si l'appariement flou + la normalisation par LLM est suffisant pour 10 000 enregistrements avec des décennies d'incohérences ou s'ils ont besoin d'une résolution d'entités plus rigoureuse (par exemple, Dedupe.io).
- Étape 5 - Base de données : Pile choisie : Supabase (PostgreSQL + pgvector) avec NocoDB par-dessus. Trois options ont été évaluées : Airtable (le plus facile à démarrer mais limité à grande échelle), PostgreSQL direct (le plus de contrôle mais itération plus lente), et Supabase + NocoDB (choisi comme compromis).
L'objectif est d'obtenir une image consolidée réelle en 30 à 60 jours, évitant les précédentes tentatives d'organisation infructueuses.
📖 Read the full source: r/ClaudeAI
👀 See Also

Leçons pratiques de l'exploitation de plusieurs agents d'IA en production
Une équipe exploitant un magasin géré par l'IA avec des agents de conception, de codage et de marketing partage des idées sur ce que signifie 'embaucher' des agents d'IA en pratique, y compris comment fournir suffisamment de contexte pour un travail autonome et où les agents échouent différemment des humains.

Récupérer les listes de lecture Apple Music supprimées avec Claude Cowork
Un utilisateur a récupéré 75 listes de lecture et 8 185 morceaux après avoir accidentellement supprimé toute sa bibliothèque Apple Music. Claude Cowork a analysé les fichiers d'export de données d'Apple, écrit des scripts Python pour l'analyse, généré des AppleScripts pour la restauration et créé des outils HTML personnalisés pour gérer les morceaux manquants.

OpenClaw Agent automatise le pipeline complet de contenu vidéo avec Remotion et Hyperframes
Un utilisateur a construit un agent sur OpenClaw qui gère les systèmes de fichiers, génère des images, les anime, recherche des histoires et produit des vidéos complètes en utilisant Remotion et Hyperframes — le tout automatisé et reproductible.

Titre de l'article : Connecteur Claude Projects + Gamma : Mises à jour des investisseurs en 12 minutes par le fondateur SaaS à 12 000 $ MRR
Un fondateur dirigeant un SaaS pour les tuteurs indiens (12 000 $ de MRR) a réduit le temps de préparation des rapports pour les investisseurs de 3 heures à 12 minutes en utilisant Claude Projects (contexte persistant) avec le connecteur Gamma pour générer automatiquement des présentations visuelles.