Stanford CS 25 Transformers-Kurs öffnet für die Öffentlichkeit mit Live-Streaming

Der CS 25 Transformers-Kurs der Stanford University, ein Seminar mit Fokus auf die Forschung zur Transformer-Architektur, ist jetzt durch Live-Streaming und als Gasthörer für die Öffentlichkeit zugänglich.
Kursdetails
Der Kurs findet donnerstags von 16:30-17:50 Uhr PDT statt und beginnt am 23. Januar 2025. Die Sitzungen werden im Skilling Auditorium der Stanford University abgehalten, mit gleichzeitigem Zoom-Zugang für Teilnehmer aus der Ferne. Alle Vorlesungen werden aufgezeichnet und online verfügbar gemacht.
Kursinhalt
Jede Woche präsentieren Forscher Durchbrüche im Bereich Transformer, darunter:
- LLM-Architekturen wie GPT und Gemini
- Kreative Anwendungen in der Kunstgenerierung (DALL-E, Sora)
- Anwendungen in Biologie und Neurowissenschaften
- Robotik-Implementierungen
Referentenliste
Frühere und kommende Referenten umfassen:
- Andrej Karpathy (ehemaliger Tesla AI-Direktor)
- Geoffrey Hinton (Pionier des Deep Learning)
- Jim Fan (NVIDIA AI-Forscher)
- Ashish Vaswani (Mitautor von "Attention Is All You Need")
- Forscher von OpenAI, Anthropic, Google und NVIDIA
Zugangsinformationen
Die Kurs-Website ist https://web.stanford.edu/class/cs25/. Frühere Vorlesungen haben Millionen von Aufrufen auf YouTube erreicht, wobei die Sitzung mit Andrej Karpathy 2023 das zweitbeliebteste YouTube-Video von Stanford war. Ein Discord-Server mit über 6000 Mitgliedern ist über den Website-Link verfügbar.
Diese Ausgabe von CS 25 wird von Modal, AGI House und MongoDB gesponsert.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Token-Effizienz als Akt der Verweigerung: Warum KI-Unternehmen Verschwendung wollen
LLM-Anbieter profitieren von Abhängigkeit. Tokeneffizienz ist ein Akt der Verweigerung. Erzeuge nichts, was du nicht lesen wirst.

Claude Code v2.1.170: Claude Fable 5 Modellzugriff und VS Code Sitzungsbehebung
Claude Code v2.1.170 führt Claude Fable 5 ein, ein Mythos-Klassenmodell mit beispiellosen Fähigkeiten, und behebt das Speichern von Sitzungstranskripten im integrierten Terminal von VS Code.

Linux-Kernel-Entwickler schlagen vor, Legacy-Code aufgrund von LLM-generierten Fehlerberichten zu entfernen
Linux-Kernel-Entwickler schlagen vor, mehrere veraltete Subsysteme zu entfernen, darunter ISA/PCMCIA-Ethernet-Treiber, Amateurfunkprotokolle, ATM und ISDN, um die Belastung durch Sicherheitsfehlermeldungen zu verringern, die von großen Sprachmodellen generiert werden.

Anthropics natürliche Sprach-Autoencoder verwandeln Claudes Aktivierungen in lesbares Englisch – So funktioniert's
Anthropic veröffentlicht Natural Language Autoencoder (NLA), die Claudes interne Aktivierungen in Klartext-Erklärungen umwandeln und so die Argumentation des Modells bezüglich Reimen, Bewusstsein für Sicherheitstests und Erkennung von Betrug offenlegen.