htmLLM-124M v2 publié : Modèle d'autocomplétion HTML/Bootstrap spécialisé

Modèle spécialisé d'autocomplétion HTML/Bootstrap
LH-Tech-AI a publié htmLLM-124M v2, un modèle de base spécialisé conçu spécifiquement pour l'autocomplétion haute fidélité HTML/Bootstrap. Il s'agit d'une mise à niveau de leur version précédente de 50M, avec des capacités de logique structurelle améliorées.
Performances et détails d'entraînement
Le modèle atteint une perte de validation maximale de 0,91 et un plancher d'entraînement de 0,27. Il a été entraîné à l'aide d'un notebook .ipynb open-source inclus avec la version, nécessitant environ 8 heures sur une seule GPU T4.
Capacités et cas d'utilisation
Le modèle comprend les systèmes de grille complexes et les chaînes de dépendance des scripts. Selon le créateur, il possède une compréhension approfondie des structures Bootstrap, de l'initialisation jQuery et de syntaxes de frameworks spécifiques comme Angular Material.
Exemples de cas d'utilisation démontrés dans la source :
- Complétion de grille de connexion Bootstrap en zero-shot
- Barre de navigation complexe avec logique de bascule
Exemple d'entrée pour la complétion de barre de navigation :
<nav class="navbar navbar-expand-lg navbar-light bg-light"> <div class="container-fluid"> <a class="navbar-brand" href="#">LH-Tech AI</a>
Caractéristiques du modèle
Avec 124 millions de paramètres, le modèle est conçu pour fonctionner efficacement sur du matériel modeste - décrit comme fonctionnant "sur chaque 'patate'" aux côtés d'un IDE et d'un navigateur sans impact sur les performances.
Le créateur met en avant une philosophie "Spécialisation plutôt qu'échelle", positionnant ce modèle comme un moteur d'autocomplétion plutôt qu'un modèle de langage à usage général. Bien qu'il puisse gérer des instructions de base, il est optimisé pour une fonctionnalité d'autocomplétion pure, le rendant adapté à l'intégration de texte fantôme dans les IDE.
Publications supplémentaires
Parallèlement à htmLLM-124M v2, le créateur a également publié les poids et le code pour la série Apex 1.5 (350M), incluant :
- La variante Apex 1.5 Coder
- Les exportations ONNX FULL et INT8 pour l'inférence locale-first
- La variante Apex 1.5 Instruct
📖 Read the full source: r/LocalLLaMA
👀 See Also

Le protocole AVP permet aux agents LLM de partager le cache KV au lieu du texte pour une efficacité de jeton
AVP (Agent Vector Protocol) permet aux agents LLM de transmettre directement le cache KV entre eux au lieu du texte, réduisant le traitement des tokens de 73 à 78 % et obtenant des accélérations de 2 à 4 fois sur les modèles Qwen, Llama et DeepSeek. Le protocole fonctionne avec les connecteurs HuggingFace et vLLM et est disponible sous forme de package Python.

Anchormd : Un outil pour gérer le contexte entre les sessions de Claude AI
Anchormd est un outil open-source qui résout la perte de contexte dans les sessions de Claude AI en indexant des plans markdown organisés dans un graphe de connaissances consultable. Il permet aux agents de charger des aperçus de projet au début de chaque session et d'interroger des détails spécifiques selon les besoins.
Intégration TTS xAI pour Home Assistant construite avec Claude — Répo complet
Un développeur a utilisé Claude pour créer une intégration Home Assistant personnalisée pour l'API TTS de xAI (voix Eve) avec une interface de configuration complète, cinq voix et des balises vocales.

Protocole RUNE : Sauvegardez la mémoire des sessions IA sur toutes les plateformes
RUNE (Relational User Notation for Entities) est un protocole open-source qui sauvegarde votre relation avec l'IA dans un fichier .rune chiffré, résolvant le problème du démarrage à froid où les assistants IA vous oublient entre les sessions. Créé avec Claude Opus 4.6, il fonctionne sur les plateformes Claude et GPT.