Der neue Stack: Agenten, Skills und warum OpenAI jetzt im Innovators Dilemma steckt
In Davos wird das Ende alter Fiktionen ausgerufen, während AI den Code- und Wissens-Stack neu definiert. Agenten und Alignment werden zu ökonomischen Faktoren.
Davos und das Betriebssystem der Zivilisation
Auf dem Weltwirtschaftsforum in Davos sprach Mark Carney vom Ende einer „angenehmen Fiktion“, was Azeem Azhar als fundamentalen Wechsel im Betriebssystem der Zivilisation interpretiert. Dieser Wandel führt weg von Knappheit hin zu einem System, das auf Lernkurven basiert. Angetrieben wird die Transformation durch Fortschritte in den Bereichen Energie, Intelligenz und Biologie, die nicht mehr extrahiert, sondern konstruiert und iterativ verbessert werden. Das alte „Scarcity OS“ war im Kern ein Nullsummenspiel um die Kontrolle limitierter Ressourcen. Azhar unterteilt die Reaktionen auf diesen Wandel in drei Archetypen: die Horter, die Manager und die Erbauer. Während die öffentliche Debatte von den ersten beiden dominiert wird, schaffen die Erbauer im Stillen eine neue, nicht-limitierte Realität und definieren Wertschöpfung neu. → Azeem Azhar, Exponential View
Synthszr Take: Der Übergang vom „Scarcity OS“ zum „Learning OS“ ist ein starkes Narrativ, übersieht aber die entscheidende Schnittstelle: AI ist die API für dieses neue Betriebssystem. Sie ist nicht nur eine weitere Lernkurve, sondern die Meta-Ebene, die Energie, Biologie und Intelligenz überhaupt erst komponierbar macht. AI als reinen Intelligenz-Faktor zu betrachten, ist, als würde man TCP/IP nur als „Protokoll“ bezeichnen – eine grobe Untertreibung seiner systemischen Funktion. Führungskräfte, die noch im alten OS denken, optimieren die Pferdekutsche, während im Hintergrund das Fundament für ein neues Internet gelegt wird.
OpenAI steckt im Innovators Dilemma
OpenAI, einst dominant in der Chatbot-Ära, sieht sich nun in der aufkommenden Agenten-Ökonomie von Anthropic herausgefordert. Insbesondere Anthropic's Claude Code hat sich schnell als führend etabliert. Um neue Einnahmequellen zu erschließen, plant OpenAI, Werbung in ChatGPT zu schalten – eine Strategie, die auf Netzwerkeffekte statt auf reines Token-Volumen setzt. Demis Hassabis von Google DeepMind äußerte sich dazu kritisch, da ein Agent mit Drittinteressen per Definition nicht mehr im Sinne des Nutzers agiert. Zusätzlich prüft OpenAI Modelle zur Gewinnbeteiligung an Entdeckungen, die mit ihrer Technologie gemacht werden, und hegt Hardware-Ambitionen. Der einstige First-Mover-Vorteil schwindet, da sich der Fokus von Modellen auf Agenten verlagert hat. → Azeem Azhar, Exponential View
Synthszr Take: OpenAI befindet sich in einer strategischen Zwickmühle. Ihr früher Vorstoß hat den Markt zwar definiert, sie aber gleichzeitig an ein consumer-zentrisches Geschäftsmodell mit gewaltigem Compute-Verbrauch gebunden. Anthropic und Google können geduldiger agieren und das lukrativere Enterprise-Segment mit forschungsgetriebenen, vertrauenswürdigen Agenten besetzen. OpenAIs Werbe-Experiment ist ein verzweifelter Versuch, die Consumer-Basis zu monetarisieren, riskiert aber, das Kernversprechen des persönlichen Agenten zu untergraben. Es ist die klassische Innovators-Dilemma-Falle, nur in Hyperspeed.
Alignment als ökonomischer Faktor
Die gängige Annahme, dass AI-Sicherheit (Alignment) ein reiner Kostenfaktor und eine Bremse für die Entwicklung sei, wird durch die Marktdynamik zunehmend in Frage gestellt. Wenn Nutzer einem Agenten weitreichende Zugriffe auf ihre Systeme gewähren, ist Vertrauen die entscheidende Währung. Paradoxerweise ist es das sicherheitsfokussierte Labor Anthropic, das seinen Agenten die weitreichendsten autonomen Fähigkeiten zugesteht. Der Grund liegt darin, dass ihre Investitionen in Alignment ein Modell hervorgebracht haben, dem man mehr Autonomie zutrauen kann. Vertrauen ermöglicht Autonomie, und Autonomie schaltet den eigentlichen Marktwert frei. Im Gegensatz dazu führt ein Mangel an Alignment, wie bei xAI zu beobachten, zu Skandalen und zögerlichen Unternehmenskunden. → Azeem Azhar, Exponential View
Synthszr Take: Der Markt beginnt, Alignment korrekt zu bewerten: nicht als ethisches Feigenblatt, sondern als knallhartes Feature. Ein unzuverlässiger Agent ist kein Asset, sondern ein unkalkulierbares Risiko. Die Erkenntnis, dass das vertrauenswürdigste Modell am Ende auch das produktivste ist, invertiert die Logik des „Move fast and break things“. Sicherheit wird von einer Checkbox zu einem Performance-Kriterium. Das ist die reifere Phase der Technologie, in der Zuverlässigkeit und Vorhersehbarkeit die reine Rohleistung übertrumpfen.
Das Schwungrad der Robotik
Die Robotik profitiert gleichzeitig von Skalierungsgesetzen und Wright's Law, was ihre Entwicklung in Richtung allgemeiner Anwendbarkeit beschleunigt. Vision-Language-Action-Modelle dürften ähnliche Skalierungseffekte wie LLMs zeigen, leiden aber noch unter Datenknappheit. Jeder in der realen Welt eingesetzte Roboter wird jedoch zu einem Datengenerator, der ein positives Schwungrad in Gang setzt: mehr Roboter erzeugen mehr Daten, was zu besseren Modellen führt, die wiederum neue Märkte erschließen. Parallel dazu senkt Wright's Law die Kosten mit jeder Verdopplung der Produktionsmenge. Die günstigsten humanoiden Roboter kosten bereits heute nur noch 5.000 Dollar pro Einheit. Der Bau von AI-Rechenzentren könnte der Katalysator für diese positive Rückkopplung sein. → Azeem Azhar, Exponential View
Synthszr Take: Die Analogie zur LLM-Entwicklung ist treffend, aber unvollständig. Robotik hat einen entscheidenden Nachteil: Physik. Ein Token kostet fast nichts, aber ein fehlgeschlagener Greifvorgang hat reale Konsequenzen. Genau deshalb ist die Datengenerierung im standardisierten Umfeld von Rechenzentren so clever. Es ist die perfekte Petrischale für diesen Wachstumseffekt: repetitive Aufgaben, hohe Fehlertoleranz und ein Kunde (die Hyperscaler), der die strategische Notwendigkeit versteht. Die Robotik wird nicht durch einen „ChatGPT-Moment“ explodieren, sondern durch die schrittweise Automatisierung hochstrukturierter industrieller Nischen.
Google DeepMind auf Einkaufstour
Google DeepMind hat durch eine Reihe von Akquisitionen und Partnerschaften seine Talent- und Technologiebasis signifikant ausgebaut. Das Unternehmen übernahm Common Sense Machines, ein Startup, das auf die Umwandlung von 2D-Bildern in 3D-Modelle spezialisiert ist. Parallel dazu wurde ein Lizenzvertrag mit Hume AI geschlossen, das Modelle zur Emotionserkennung in Stimmen entwickelt, wobei der CEO und Schlüssel-Ingenieure zu DeepMind wechseln. Zusätzlich investierte Google in Sakana AI, ein japanisches Startup, das von ehemaligen Google-Forschern gegründet wurde, darunter ein Mitautor des originalen Transformer-Papers. Diese strategischen Zukäufe zielen darauf ab, Gemini zu stärken und Googles Position im globalen AI-Wettbewerb, insbesondere im japanischen Markt, zu festigen. → Techpresso
Synthszr Take: Das ist kein klassisches „Acqui-Hiring“, das ist eine strategische Rückführung von abgewandertem Kern-IP und Talent. Google erkennt, dass die nächste Innovationswelle außerhalb der eigenen Mauern stattfindet, selbst wenn die Innovatoren aus dem eigenen Haus stammen. Die Deals mit Hume (Emotion) und Common Sense (3D) deuten auf eine Zukunft hin, in der Gemini multimodal und kontextsensitiv agieren soll. Die Investition in Sakana ist besonders pikant: Man kauft sich den Zugang zu Forschung, die die eigene Transformer-Architektur möglicherweise obsolet machen könnte – ein klassischer Schachzug, um die eigene Disruption zu kontrollieren.
Die Evolution des AI-Stacks: Tools, MCPs und Skills
Die Art und Weise, wie AI-Modelle mit der Außenwelt interagieren, durchläuft eine schnelle Evolution von einfachen „Tools“ (Function Calling) hin zu komplexeren Architekturen. Tools waren der erste Schritt, um LLMs Aktionen ausführen zu lassen, skalierten aber schlecht, da jede Integration manuell erfolgte. Das Model Context Protocol (MCP) entstand als Standardisierungsschicht, vergleichbar mit USB-C, um Interoperabilität zwischen verschiedenen AIs und Diensten zu schaffen. Die neueste Entwicklung sind „Skills“, die nicht die Fähigkeit an sich, sondern das prozedurale Wissen – die Expertise, wann und wie ein Tool effektiv einzusetzen ist – kapseln. Dieser dreistufige Stack trennt atomare Fähigkeiten (Tools), Infrastruktur (MCP) und anwendungsspezifisches Wissen (Skills). → Charlie Guo from Artificial Ignorance
Synthszr Take: Das ist die wichtigste systemische Entwicklung in der AI seit Längerem. Wir erleben die Entstehung der fundamentalen Architekturschichten für autonome Agenten in Echtzeit. Tools sind die System Calls, MCP ist das Netzwerkprotokoll, und Skills sind die Bibliotheken und Frameworks. Diese Abstraktionsebene ist der Moment, in dem AI aufhört, ein reines „Modell“-Problem zu sein, und zu einem „Software Engineering“-Problem wird. Die spannendsten Unternehmen der nächsten Jahre werden nicht unbedingt die besten Modelle bauen, sondern die besten Skills und die robustesten MCP-Server. Wertschöpfung verlagert sich von der reinen Inferenz zur orchestrierten Ausführung.
Das Evaluator-Optimierer-Pattern
Für komplexe Aufgaben, bei denen die erste Antwort eines LLMs selten die beste ist, etabliert sich das „Evaluator-Optimierer“-Pattern. Anstatt eines einzigen „One-Shot“-Aufrufs wird der Prozess in zwei Rollen aufgeteilt: ein Generator-LLM erzeugt eine Lösung, und ein Evaluator-LLM überprüft diese kritisch anhand definierter Kriterien. Fällt die Lösung durch, wird das Feedback des Evaluators an den Generator zurückgegeben, um eine verbesserte Version zu erstellen. Dieser iterative Feedback-Zyklus setzt sich fort, bis ein Qualitätsstandard erreicht ist oder eine maximale Anzahl von Versuchen überschritten wird. Dieses Muster eignet sich besonders für Code-Generierung, juristische Dokumente oder mathematische Probleme, wo Präzision entscheidend ist. → Machine Learning Pills
Synthszr Take: Dieses Pattern ist nichts anderes als die Formalisierung des menschlichen kreativen Prozesses in einer Agenten-Architektur: Entwurf, Kritik, Überarbeitung. Der entscheidende Punkt ist die Trennung der Anliegen (Separation of Concerns). Ein einzelner Prompt, der gleichzeitig kreativ und kritisch sein soll, ist ineffizient. Durch die Aufteilung können wir für jede Rolle ein spezialisiertes Modell oder einen hochoptimierten Prompt verwenden. Das ist der Übergang von monolithischen „Super-Prompts“ zu einer Microservices-Architektur für AI-Workflows. Es erhöht nicht nur die Qualität, sondern macht den gesamten Prozess auch transparenter, debugbarer und letztlich steuerbarer.
„Vibe Coding“ und die Risiken für Open Source
Generative AI verändert die Softwareproduktion durch einen Prozess, der als „Vibe Coding“ bezeichnet wird. Dabei setzen Entwickler AI-Agenten ein, um Open-Source-Software (OSS) zu finden und zu assemblieren, oft ohne die Dokumentation zu lesen oder mit den Maintainern zu interagieren. Eine neue Studie argumentiert, dass dieser Ansatz zwar die Produktivität kurzfristig steigert, aber das Ökosystem von OSS langfristig untergräbt. Da viele OSS-Projekte auf dem Engagement der Nutzer (Bug-Reports, Beiträge, Sponsoring) basieren, um sich zu finanzieren und zu verbessern, führt die entkoppelte Nutzung durch AI zu einem Rückgang von Beiträgen und Qualität. Dies könnte paradoxerweise zu einer Verringerung des Angebots an hochwertiger OSS führen, obwohl die Nachfrage steigt. → Techpresso
Synthszr Take: AI-Agenten werden zu den ultimativen „passiven Konsumenten“ von Open Source und drohen, das soziale Gefüge zu zerstören, das es überhaupt erst ermöglicht. Dies ist eine klassische „Tragik der Allmende“ in digitaler Form. Die Reibung des manuellen Implementierens – Dokumentation lesen, auf Fehler stoßen, im Forum fragen – war ein unbeabsichtigter, aber entscheidender Mechanismus für Community-Engagement. Wenn AI diese Reibung eliminiert, muss ein neuer, expliziter Mechanismus zur Wertschätzung und Finanzierung geschaffen werden. Denkbar wären Modelle, bei denen AI-Agenten „Mikro-Lizenzgebühren“ für die Nutzung von OSS-Paketen zahlen oder automatisch qualifizierte Bug-Reports erstellen.
YouTube ermöglicht AI-Klone für Creator
YouTube-CEO Neal Mohan hat angekündigt, dass Creator bald in der Lage sein werden, Kurzvideos (Shorts) mit ihren eigenen AI-generierten Ebenbildern zu erstellen. Dies ist Teil einer breiteren Strategie, generative AI-Werkzeuge wie Auto-Dubbing und AI-generierte Clips in die Creator-Plattform zu integrieren. Paradoxerweise kämpft YouTube gleichzeitig gegen nicht autorisierte AI-Klone und hat Technologien zur Erkennung von Deepfakes eingeführt. Diese Entwicklung unterstreicht den Spagat, den Plattformen vollführen müssen: Sie wollen die Content-Produktion durch AI beschleunigen, um mit TikTok wettbewerbsfähig zu bleiben, müssen aber eine Flut von minderwertigen Inhalten („AI slop“) verhindern. → Matt from FutureTools
Synthszr Take: YouTube öffnet die Büchse der Pandora in dem Glauben, sie kontrollieren zu können. Die Unterscheidung zwischen „autorisierten“ und „nicht autorisierten“ Klonen ist technisch und rechtlich eine Fiktion, sobald die Technologie allgemein verfügbar ist. Die Plattformen befinden sich in einem Rüstungswettlauf um die Produktionsmittel für Content. Indem sie den Creators die Werkzeuge zur Massenproduktion an die Hand geben, opfern sie langfristige Qualität und Authentizität für kurzfristiges Engagement-Wachstum. Das Endspiel ist eine Content-Ökonomie, in der das Signal-Rausch-Verhältnis gegen Null tendiert und der einzige Gewinner die Plattform ist, die die Inferenzkosten für die Generierung kontrolliert.
Der Wandel im Code Review
Der traditionelle Prozess des Code-Reviews, bei dem jede Zeile Code manuell gelesen wird, wird durch AI grundlegend verändert. Entwickler Kieran Klaassen beschreibt einen neuen Ansatz, bei dem 13 spezialisierte AI-Agenten parallel ein Code-Review durchführen, während der menschliche Entwickler sich auf die Entscheidungsfindung konzentriert. Dieser „Compound Engineering“-Ansatz hat sich als effektiver erwiesen, um kritische Fehler zu finden, die bei einer manuellen Überprüfung übersehen worden wären. Die Zeit, die für die Codegenerierung benötigt wird, ist durch AI kollabiert, während die Zeit für die menschliche Überprüfung konstant geblieben ist. Dieser Bruch im Verhältnis zwingt zu neuen, agentengestützten Review-Prozessen. → Every
Synthszr Take: Code Review stirbt nicht, es abstrahiert. Die manuelle Prüfung von Codezeilen war schon immer ein Proxy für die Überprüfung von Logik, Architektur und potenziellen Risiken. AI-Agenten können die syntaktische und kleinteilige logische Prüfung nun besser und schneller durchführen. Dies zwingt den menschlichen Reviewer, sich auf eine höhere Ebene zu begeben: Bewertet der Code die richtige Geschäftslogik? Ist die Architektur nachhaltig? Welche systemischen Risiken birgt diese Änderung? Der Mensch wird vom Korrekturleser zum System-Auditor. Das ist anspruchsvoller, aber auch unendlich viel wertvoller.



