Sebastian Raschka: Website und Forschungsnotizen zu Large Language Models

LinkSebastian RaschkaSammlung

Die persönliche Website des KI-Forschers Sebastian Raschka bietet praxisnahe Analysen, Code-Implementierungen und technische Notizen zu aktuellen Entwicklungen im LLM-Bereich.

Das Wichtigste

  1. Sebastian Raschka kombiniert akademische Forschung und Industrieerfahrung, unter anderem durch frühere Stationen an der University of Wisconsin-Madison und bei Lightning AI.
  2. Er ist Autor des Fachbuchs 'Build a Large Language Model (From Scratch)' und fokussiert sich auf codebasierte Umsetzungen von KI-Systemen.
  3. Aktuelle Artikel behandeln Wasserzeichen-Erkennung bei Claude, den Bau eigener KI-Text-Detektoren und Steuerungsmechanismen für Denkprozesse ('Reasoning Effort') in LLMs.
  4. Weitere Beiträge beleuchten den Einsatz von Open-Weight-Modellen in lokalen Coding-Agents als Alternative zu Claude Code oder Codex-Abonnements.
  5. Kurzanalysen ('Quick Notes') fassen Architekturen wie GLM-5.3-Flash sowie Ansätze zu Looped Transformers und OpenAI Astra zusammen.

Warum das relevant ist

Für Entwickler und KI-Praktiker bietet die Website fundierte, quellcodeorientierte Einblicke in LLM-Architekturen, Deep Learning und Open-Source-Alternativen ohne Marketing-Jargon.

Einordnung

Raschkas Plattform dient als Wissensressource an der Schnittstelle von Modelltraining, Inferenz und Systemarchitektur. Statt rein theoretischer Abhandlungen stehen nachvollziehbare Codebeispiele und die Dekonstruktion moderner Architekturen wie Reasoning Models und MoE-Ansätze im Mittelpunkt.

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Repository:w3cj/how-llms-work

    How LLMs Work: Interaktive Einführung in die Funktionsweise von Sprachmodellen

    Das GitHub-Repository 'how-llms-work' von w3cj bietet eine interaktive Webanwendung, die Schritt für Schritt erklärt, wie moderne Large Language Models funktionieren. Vom einfachen regelbasierten Chat über neuronale Netze, BPE-Tokenisierung und Word2Vec-Embeddings bis hin zum Training eines Transformers von Grund auf wird jede Stufe mit lokal ausführbarem Code veranschaulicht.

    568SterneTypeScript

    KI & AI· Sammlung

  • Link:Poolside

    Laguna-S-2.1: Open-Source-MoE-Modell von Poolside für agentisches Coding

    Poolside hat Laguna-S-2.1 veröffentlicht, ein Mixture-of-Experts-Sprachmodell mit 118 Milliarden Gesamtparametern und rund 8 Milliarden aktiven Parametern pro Token. Das Modell ist speziell auf Softwareentwicklung und langlebige Agenten-Workflows ausgelegt und steht unter der permissiven OpenMDW-1.1-Lizenz bereit.

    KI & AI· Tool

  • Link:Tatsunori Hashimoto, Percy Liang

    Stanford CS336: Language Modeling from Scratch

    Die Stanford-Lehrveranstaltung CS336 vermittelt die Entwicklung von Sprachmodellen von Grund auf – ähnlich wie klassische Betriebssystemkurse. Studierende durchlaufen alle Phasen von Datenbereinigung und Tokenisierung über Transformer-Architekturen und GPU-Optimierung mit Triton bis hin zu Post-Training und Alignment.

    KI & AI· Sammlung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.