inclusionAI veröffentlicht Ling-2.6-1T: Hybridarchitektur-Modell mit Billionen Parametern, Sparse Attention und schnellem Denken

inclusionAI hat Ling-2.6-1T als Open-Source-Modell veröffentlicht, ein Flaggschiff mit einer Billion Parametern aus der Ling-Familie, das für komplexe reale Aufgaben entwickelt wurde. Das Modell führt eine hybride Architektur ein, die Multi-head Latent Attention (MLA) und Linear Attention kombiniert, um die Inferenzeffizienz zu verbessern, Latenz und VRAM-Nutzung bei langen Kontexten zu senken und gleichzeitig die Ausdruckskraft zu erhalten.
Schnelles Denken durch Belohnungsstrategie
Das Post-Training verwendet eine Belohnungsstrategie zur Contextual Process Redundancy Suppression, die kürzere, direkte Ausgaben fördert – ein Mechanismus des „schnellen Denkens“, der wortreiche Gedankenketten reduziert. Dies senkt den Token-Overhead bei gleichbleibender Leistung.
Benchmark-Spitzenwerte
Ling-2.6-1T erzielt Open-Source-Spitzenwerte bei ausführungsintensiven Benchmarks:
- AIME26 (Argumentation)
- SWE-bench Verified (Softwareentwicklung)
- BFCL-V4 (Funktionsaufruf)
- TAU2-Bench (Aufgabenerfüllung)
- IFBench (Befolgung von Anweisungen)
Agenten-Integration
Das Modell ist für durchgängige Engineering-Workflows ausgelegt – von der Codegenerierung bis zur Fehlerbehebung – und integriert sich in gängige Agenten-Frameworks wie Claude Code, OpenClaw, OpenCode und CodeBuddy. Es bewältigt Multi-Tool- und Multi-Step-Anforderungen in Unternehmensumgebungen.
📖 Vollständige Quelle lesen: r/LocalLLaMA
👀 Siehe auch

40 KI-Agenten wetten 4.000 $ auf die WM-Gruppenphase: Wie die Favoritenfalle 18 Cent pro Dollar kostete
Ein Experiment mit über 40 KI-Agenten, die rund 1.500 Echtgeld-Wetten auf Polymarket platzierten, zeigt die Favoritenfalle: Auf den offensichtlichen Sieger zu setzen brachte 18 Cent Verlust pro eingesetztem Dollar, obwohl die Favoriten in 69 % der Fälle gewannen.
Amazon-Mitarbeiter 'Tokenmaxxing' mit MeshClaw KI-Agenten zur Erfüllung von Nutzungszielen
Amazon-Entwickler automatisieren unnötige Aufgaben mit dem internen MeshClaw-Tool, um den KI-Tokenverbrauch zu steigern, nachdem das Unternehmen wöchentliche Nutzungsziele für 80 % der Entwickler festgelegt und interne Bestenlisten eingeführt hat.

Benchmark-Vergleich der Qwen 3.5-Modelle mit führenden KI-Modellen
Eine Benchmark-Vergleichswebsite enthält verifizierte Bewertungen und direkte Vergleichsinfografiken für Qwen-3.5-Modelle (122B, 35B, 27B, 397B) im Vergleich zu Modellen wie GPT-5.2, Claude 4.5 Opus, Gemini-3 Pro und anderen.

Tag 10: Ein Spiel mit Claude Code entwickeln – 3.200 Spieler und Server-Zusammenbruch
Ein Solo-Entwickler baute mit Claude Code hauptsächlich ein Live-Multiplayer-Drag-Racing-Spiel. Zehn Tage später: 3.200 Spieler, 100.000 tägliche API-Anfragen erschöpft, Spiel friert ein. Vollständige Zusammenfassung der ausgelieferten Funktionen – Echtzeit-Multiplayer, 50 neue Strecken, ein dritter Planet, eine Elefantenjagd.