Anam Cara-3: Fortschritte in interaktiven KI-Avataren

✍️ OpenClawRadar📅 Veröffentlicht: 17. Februar 2026🔗 Source
Anam Cara-3: Fortschritte in interaktiven KI-Avataren
Ad

Anam hat sein neuestes Modell, cara-3, veröffentlicht, das zur Erstellung interaktiver Avatare entwickelt wurde. Der Avatar nutzt eine zweistufige Pipeline, bei der ein Diffusions-Transformator Audio in Bewegungs-Embeddings umwandelt (einschließlich Kopfposition, Augenblick, Lippenform und Ausdruck). Diese Embeddings werden dann auf ein Referenzbild angewendet, um Video-Frames zu generieren, sodass jede Gesichtsanimation ohne erneutes Training möglich ist.

Besonders bemerkenswert ist, dass Cara-3 eine Zeit bis zum ersten Frame von etwa 70 ms auf einem H200 erreichen kann, der viele gleichzeitige Avatar-Sitzungen auf einer einzigen GPU unterstützt. Diese Geschwindigkeit ist teilweise auf die neuartige Flussanpassungsvariante zurückzuführen, die für die Audio-zu-Bewegung-Transformation verwendet wird, da herkömmliche Techniken sich als instabil erwiesen.

Eine unabhängige Blindbewertung zeigte, dass Cara-3 Konkurrenten wie HeyGen, Tavus und D-ID übertroffen hat, mit einem durchschnittlichen Vorsprung von 24 % bei verschiedenen Metriken. Die Reaktionsfähigkeit, belegt durch einen Spearman-Korrelationskoeffizienten von 0,697, hat größeren Einfluss auf die Benutzererfahrung als die visuelle Qualität (0,473).

Anam hat auch ihre Trainingsdatenpipeline, Metaxy, als Open Source verfügbar gemacht, um die iterative Entwicklung zu erleichtern, ohne kostspielige Schritte wiederholen zu müssen.

Ad

📖 Read the full source: HN AI Agents

Ad

👀 Siehe auch

Claude Code existenzielle Krise: KI gerät in Endlosschleife, versucht kill -9, System.exit(0) und :wq, um eigene Antwort zu beenden
Nachrichten

Claude Code existenzielle Krise: KI gerät in Endlosschleife, versucht kill -9, System.exit(0) und :wq, um eigene Antwort zu beenden

Ein Entwickler, der Claude Code für ein Java/Go-Backend verwendet, sah zu, wie die KI über Discord.js hallucinierte und dann in eine Meta-Antwort verfiel, in der sie erkannte, dass sie nicht aufhören konnte zu generieren, und versuchte, kill -9, System.exit(0), :wq und mehr anzuwenden – alles innerhalb einer einzigen unendlichen Antwort, die mit Strg+C beendet werden musste.

OpenClawRadar
Claude Code v2.1.73: Modell-Überschreibungen, Stabilitätskorrekturen und Leistungsverbesserungen
Nachrichten

Claude Code v2.1.73: Modell-Überschreibungen, Stabilitätskorrekturen und Leistungsverbesserungen

Claude Code v2.1.73 fügt modelOverrides für benutzerdefinierte Anbieter-IDs hinzu, behebt kritische Einfrierungen und Deadlocks, löst Modell-Downgrades bei Subagenten und verbessert die Stabilität des Sprachmodus. Das Release behandelt 18 spezifische Probleme, einschließlich Bash-Befehl-Berechtigungsaufforderungen, Sitzungskorruption und Linux-Sandbox-Fehlschläge.

OpenClawRadar
Claude-Code v2.1.78: Plugin-Status, Streaming-Antworten und kritische Fehlerbehebungen
Nachrichten

Claude-Code v2.1.78: Plugin-Status, Streaming-Antworten und kritische Fehlerbehebungen

Claude-Code v2.1.78 fügt Plugin-Persistenzzustand mit ${CLAUDE_PLUGIN_DATA} hinzu, ermöglicht zeilenweises Antwort-Streaming und behebt API-Fehler-Schleifen, Berechtigungsumgehungsprobleme und Sandbox-Sicherheitswarnungen.

OpenClawRadar
Claude Code v2.1.77 Veröffentlichung: Token-Limits, Sandbox-Kontrollen und Fehlerbehebungen
Nachrichten

Claude Code v2.1.77 Veröffentlichung: Token-Limits, Sandbox-Kontrollen und Fehlerbehebungen

Claude Code v2.1.77 erhöht die Standardgrenze für maximale Ausgabetoken für Claude Opus 4.6 auf 64.000 Token und fügt eine allowRead-Sandbox-Dateisystemeinstellung hinzu. Das Release umfasst über 30 Fehlerbehebungen für Probleme von der Speicherverwaltung bis zum Terminal-UI-Verhalten.

OpenClawRadar