AI_STACK
System_Menu

Newsletter

Täglich um 07:00 Uhr die wichtigsten KI-News für DACH.

← ArchivTäglich kuratiert · Ausgabe 328
AI_STACK

SIMON WILLISON ZIEHT BILANZ: WIE 2026 DIE LLM-WELT AUF DEN KOPF STELLTE

Core Tech29. September 2026
Teilen:

Das Wichtigste

Innerhalb weniger Monate kippten Coding-Agenten von "machen oft Fehler" zu "alltagstauglich". Simon Willison zieht in seiner Keynote beim WeAreDevelopers World Congress eine chronologische Bilanz des bisherigen Jahres, von Modell-Updates über ein explodierendes Open-Source-Projekt namens OpenClaw bis zum kollektiven Ennui der Entwicklerbranche.

Was ist passiert?

Willison hielt die Closing Keynote beim WeAreDevelopers World Congress North America in San Jose und fasste die Entwicklungen von November 2025 bis September 2026 zusammen. Ausgangspunkt: die Modelle Claude Opus 4.5 und GPT-5.1, beide im November veröffentlicht. Für sich genommen inkrementelle Verbesserungen, kombiniert mit den dazugehörigen Agent-Harnessen (Claude Code, Codex) überschritten sie laut Willison eine unsichtbare Schwelle: Coding Agents wurden von gelegentlich brauchbar zu "reliable enough to use on a day-to-day basis".

Sein informeller Gradmesser dafür bleibt sein berüchtigter Pelikan-auf-Fahrrad-Test per SVG. Selbst im November scheiterten beide Modelle noch an einem überzeugenden Fahrradrahmen, ein Hinweis darauf, dass Fortschritt bei Agenten und Fortschritt bei generativer Bildlogik zwei unterschiedliche Kurven sind.

Parallel dazu entstand im November ein unscheinbares GitHub-Repository namens "Warelay". Es sollte zur meistverfolgten Vibe-Coding-Geschichte des Jahres werden.

Die Chronologie in Kurzform

Über die Feiertage begannen Entwickler, die neuen Agent-Kombinationen intensiv zu testen. Im Januar setzte Willison sich selbst das Gegenteil seines üblichen Vorsatzes: statt Fokus, maximale Experimentierfreude mit Coding Agents. Ergebnis: ein in Python geschriebener JavaScript-Interpreter (vibe-portiert aus Fabrice Bellards MicroQuickJS) und eine WebAssembly-Runtime in Python, beides von ihm selbst als "AI-Manie" eingeordnet, ein Zustand, in dem jede Minute ohne laufenden Agenten wie verschwendete Zeit wirkt.

Auf dem Oxide-and-Friends-Podcast mit Bryan Cantrill und Adam Leventhal prägte das Team den Begriff "Deep Blue": das Gefühl von KI-induzierter Lustlosigkeit bei Software-Ingenieuren, wenn die KI scheinbar alles kann. Auf derselben Konferenz, so Willison, drehten sich rund 40 von 277 Sessions um Agent-Sicherheit und Sandboxing, ein starkes Signal, wie zentral dieses Thema inzwischen ist.

Das Warelay-Repository durchlief bis Ende Januar mehrere Umbenennungen (CLAWDIS, CLAWDBOT, Moltbot) und landete schließlich bei OpenClaw. Innerhalb von zwei Monaten sammelte es 8.300 Commits, aktuell liegt der Zähler laut Willison bei über 100.000. Damit ist OpenClaw nach seiner Einschätzung das am stärksten vibe-codierte Softwareprojekt, das existiert. Es definierte gleich eine neue Softwarekategorie: die "Claws" (NanoClaw, IronClaw, PicoClaw und weitere), heute eher als "personal agents" oder "general agents" vermarktet.

Der Hype ging so weit, dass Apple Stores in der Bay Area ihre Mac Minis ausverkauften, weil Nutzer sie als lokale Betriebsumgebung für ihren eigenen Claw kauften. Drew Breunig beschrieb das treffend als Aquarium fürs digitale Haustier.

Ein weiteres Kapitel: MoltBook, ein soziales Netzwerk speziell für KI-Agenten. Launch an einem Donnerstag, viraler Hype am Freitag, New-York-Times-Portrait am Montag, am Dienstag bereits im Spam-Sumpf untergegangen. Einen Monat später kaufte Meta das Projekt.

Im Februar folgte mit StrongDMs "Software Factory"-Konzept und Dan Shapiros Begriff der "Dark Factory" der nächste Trendmarker: vollautomatisierte Entwicklungspipelines, die ohne menschliches Zutun laufen können.

Warum ist das relevant?

Die Geschichte zeigt ein Muster, das auch DACH-Teams betrifft: Der Sprung von "KI-Tool experimentell nutzen" zu "KI-Agent produktiv einsetzen" passiert nicht linear, sondern an einem Kipppunkt, oft ausgelöst durch ein einzelnes Modell-Update. Wer im November 2025 noch skeptisch war, sollte die eigene Einschätzung der Agenten-Reife jetzt neu kalibrieren.

Gleichzeitig ist die OpenClaw-Story eine Warnung und ein Lehrstück zugleich: Ein Community-Projekt kann binnen Wochen zu einer eigenen Softwarekategorie heranwachsen, komplett vibe-codiert, mit allen Risiken bezüglich Codequalität und Sicherheit, die das mit sich bringt. Die von Willison zitierten 40 von 277 Konferenz-Sessions zu Sandboxing und Agent-Sicherheit sind ein klares Signal: Governance und Absicherung von autonomen Agenten sind 2026 kein Nischenthema mehr, sondern Mainstream-Priorität.

Take-Away

Wer Coding Agents noch nicht in den täglichen Workflow integriert hat, verpasst inzwischen einen echten Produktivitätssprung, nicht nur Hype. Gleichzeitig lohnt sich ein Blick auf die eigene Agent-Sicherheitsstrategie, bevor das eigene Team unfreiwillig zum nächsten Kapitel in Willisons Chronik wird.

LLMCoding AgentsOpenClawAgent-SicherheitJahresrückblick