L'Inde développe des modèles d'IA frugaux pour répondre aux besoins locaux avec Sarvam et Krutrim.

Une IA frugale adaptée aux contraintes spécifiques de l'Inde
En réponse à la diversité linguistique et aux limitations d'infrastructure de l'Inde, plusieurs initiatives indiennes en IA développent des modèles légers et économiques qui diffèrent des approches gourmandes en calcul de la Silicon Valley. AI4Bharat, lancé à l'IIT Madras en 2020, se concentre sur des outils d'IA adaptés aux langues indiennes et aux contraintes du monde réel, construisant des systèmes qui fonctionnent sur des smartphones bas de gamme et des réseaux à faible bande passante.
L'approche et les modèles de Sarvam AI
Sarvam AI, cofondée par Vivek Raghavan et Pratyush Kumar, développe des solutions d'IA complètes pour le paysage linguistique et culturel diversifié de l'Inde. L'entreprise s'appuie sur des principes de conception frugale similaires à ceux utilisés dans Aadhaar et l'Interface de Paiement Unifiée.
Les modèles clés incluent :
- SarvamM : Un grand modèle de langage de 24 milliards de paramètres entraîné sur 10 langues indiennes
- Sarvam 2B et Sarvam-M : Modèles affinés pour le raisonnement médical et le triage des symptômes dans les langues locales
Applications pratiques dans la santé et l'éducation
Dans le domaine de la santé, Sarvam AI déploie des agents conversationnels multilingues activés par la voix qui permettent aux patients ruraux d'accéder à des conseils médicaux via WhatsApp et des interfaces à faible bande passante. Ces systèmes peuvent résumer les notes des patients, offrir des conseils diagnostiques et prioriser les cas sans nécessiter d'appareils haut de gamme ou une connexion internet constante.
Dans l'éducation, les modèles de Sarvam permettent des assistants d'apprentissage vernaculaires capables de comprendre les requêtes en code mixte et de fournir un enseignement personnalisé dans la langue maternelle des élèves. Ces modèles légers et optimisés adaptent les leçons de mathématiques et de programmation aux contextes éducatifs régionaux.
Approche technique et stratégique
Sarvam AI fonctionne comme une startup à but lucratif, estimant que des investissements significatifs et une concurrence sur le marché sont nécessaires pour étendre l'impact de l'IA à travers l'Inde. La stratégie de l'entreprise implique l'open-sourcing des modèles d'IA et la collaboration avec les entreprises indiennes pour construire des solutions spécifiques à des domaines. Leur objectif est d'apporter l'IA générative à 800 millions d'Indiens équipés de smartphones.
L'approche met l'accent sur des modèles d'IA souverains qui respectent la confidentialité des données et les nuances culturelles, répondant aux 22 langues officielles de l'Inde et à plus de 1 600 dialectes où les modèles mondiaux centrés sur l'anglais sont insuffisants.
📖 Read the full source: HN AI Agents
👀 See Also

Google : 75 % du nouveau code est généré par l'IA, la migration de code 6 fois plus rapide avec les agents.
Google rapporte que 75 % du nouveau code est généré par IA, contre 25 % en 2024. Une migration de code complexe a été réalisée 6 fois plus vite à l'aide des agents Gemini. Dans certains départements, les ingénieurs ont des objectifs d'utilisation de l'IA liés aux évaluations de performance.

Sous-Q : Premier LLM entièrement sous-quadratique avec un contexte de 12 millions de tokens et une précision RULER de 95 %
Subquadratic lance SubQ 1M-Preview, un LLM sous-quadratique à mise à l'échelle linéaire du calcul, contexte de 12 millions de tokens, attention sparse 52 fois plus rapide que FlashAttention, et 95 % sur RULER 128K. Disponible via API, agent de code en ligne de commande (SubQ Code) et outil de recherche (SubQ Search).

Machine à flux d'état : l'architecture non-transformeuse maintient 62 % de précision sur les séquences longues, là où les transformateurs tombent à 2 %.
Un chercheur a développé State Flow Machine (SFM), une architecture alternative utilisant des emplacements de mémoire explicites au lieu de têtes d'attention, atteignant 62 % de précision sur une tâche synthétique de suivi d'état de programme à une longueur d'entraînement 4× où les transformateurs tombent à 1,9-3,1 %. Le modèle fonctionne sur un seul NPU Huawei Ascend 910 ProA.

Titre : Claude Code refuserait des demandes ou facturerait des frais supplémentaires lorsque les commits mentionnent 'OpenClaw'
Un tweet de Theo prétend que Claude Code refuse les demandes ou facture des frais supplémentaires si vos commits git mentionnent 'OpenClaw', suscitant une discussion sur HN.