Blog

AI is the new normal. Vom Rudern zum Steuern mit KI

Warum KI Entwicklerinnen und Entwickler nicht ersetzt

… sondern unser Engineering einfach radikal verändert

Die Angst vor der eigenen Überflüssigkeit ist in der Tech-Branche aktuell greifbar. Wenn Coding-Agenten komplexe Aufgaben in Sekunden lösen, stellt sich die existenzielle Frage: Was bleibt für Software-Ingenieure, Data Scientists und Architekten künftig eigentlich noch zu tun?

Auf der ICML 2026 hielt Princeton-Professor Arvind Narayanan dazu eine viel beachtete Keynote. Seine Kernthese: KI ist weder ein reines Spielzeug noch eine magische Entität, die morgen alle Arbeitsplätze vernichtet. KI ist eine transformative, aber „normale“ Technologie – vergleichbar mit dem Siegeszug der Elektrizität.

Für Tech-Unternehmen bedeutet das: Nicht die reine Modellfähigkeit (Capability) bestimmt unsere Zukunft, sondern die Art, wie wir KI in reale, verlässliche Systeme integrieren.

1. Das 4-Phasen-Modell: Echter Impact braucht Jahrzehnte

Technologischer Fortschritt verläuft historisch nicht linear, sondern durchläuft vier typische Phasen:

 
  • Capabilities (Fähigkeiten): Forschung und Roh-Modelle (z. B. Foundation Models).
  • Products (Anwendungen): Die Transformation von Roh-LLMs in nutzbare Tools (z. B. spezialisierte Coding-Agenten mit passendem Harness).
  • Early Adoption: Erste Gehversuche im Markt (z. B. unstrukturiertes „Vibe Coding“).
  • Adaptation (Transformation): Die fundamentale Umgestaltung von Organisationen und Prozessen.

Die Elektrizitäts-Analogie:

Als Fabriken Ende des 19. Jahrhunderts Dampfmaschinen 1:1 durch Elektromotoren ersetzten („Drop-in Replacement“), blieb der Produktivitätsschub aus. Erst 40 Jahre später, als man erkannte, dass Strom dezentral nutzbar ist und ganze Werkshallen rund um das Fließband neu organisierte, setzte die industrielle Revolution richtig ein.

Genau an diesem Punkt stehen wir bei KI. Einen 1:1-Austausch von Menschen durch Agenten funktioniert in komplexen Systemen nicht. Wir fangen gerade erst an, Organisationen neu um KI herum zu bauen.

2. Capability vs. Reliability: Das Zuverlässigkeit-Paradoxon

Warum scheitern so viele Versuche, Geschäftsprozesse vollständig mit autonomen Agenten zu automatisieren? Weil in vielen Branchen Capability (Genauigkeit in Benchmarks) mit Reliability (Zuverlässigkeit in der Produktion) verwechselt wird.

In Untersuchungen zeigt sich: Während die Genauigkeit (Accuracy) moderner Modelle in den letzten Jahren steil nach oben ging, stagnierte die Reliability im einstelligen Prozentbereich.

DimensionBeschreibungProblem im produktiven Einsatz
KonsistenzLiefert der Agent bei identischem Input verlässlich das gleiche Ergebnis?70 % Accuracy bringt nichts, wenn die restlichen 30 % unvorhersehbare Halluzinationen sind.
RobustheitWie reagiert das System auf minimale Umgebungsänderungen?
Kleine API-Änderungen bringen fragile Prompt-Chains oft zum Einsturz.
KalibrierungKann der Agent selbst erkennen, ob er die Aufgabe korrekt gelöst hat?Fehlendes Meta-Wissen: Agenten „glauben“ oft, erfolgreich gewesen zu sein, obwohl der Build fehlschlägt.
Operational SafetySind Fehler reversibel?
Ein Fehler darf nicht darin enden, dass der Agent die Produktions-Datenbank löscht.

Die Agenten: Automation vs. Kollaboration

Das hat direkte Auswirkungen auf die Architektur. Denn beide Typen von KI-Agenten, die der Automatisierung ebenso wie die der Kollaboration, sind nicht aus sich heraus und alleine arbeitsfähig:

  • Automations-Agenten (Headless Mode): Benötigen maximale Konsistenz und Determinismus. Hier sind die Hürden für Production Deployments extrem hoch.
  • Kollaborations-Agenten (Human-in-the-Loop): Profitieren von der Stochastik der Modelle. Hier sind Unvorhersehbarkeit und Kreativität erwünscht, da der Mensch die Ergebnisse filtert.

3. Das Sandwich-Modell der Softwareentwicklung

Warum haben Coding-Agenten trotz extremer Verbreitung bisher zu keinen Massenentlassungen unter Software-Ingenieuren geführt? Die Antwort liegt in der Struktur unserer täglichen Arbeit:

Das Schreiben von Code (Execute Layer) war noch nie der primäre Flaschenhals in der Softwareentwicklung. De facto macht es oft nur ein Drittel der Arbeitszeit aus.

KI komprimiert diese mittlere Schicht nun drastisch. Dadurch expandieren jedoch die obere Schicht (Decide) und die untere Schicht (Deliver). Da die Erstellung von Code günstiger wird, steigt das Gesamtvolumen an Software exponentiell an (bekannt als Jevons‘ Paradoxon). Es braucht folglich mehr Ingenieure, die diese enormen Code-Mengen organisieren, testen und die Verantwortung dafür übernehmen.

4. RSI, AGI & die Illusion der Labor-Superintelligenz

In der Tech-Community dominiert das Narrativ, dass Recursive Self-Improvement (RSI), also KI-Systeme, die ihre eigenen Nachfolger entwickeln, zwangsläufig in kurzer Zeit zu AGI und ASI (Superintelligenz) führen.

Narayanan argumentiert, dass hier unterschiedliche Dimensionen vermischt werden:

Externe Flaschenhälse stoppen die KI-Explosion

Selbst wenn ein Modell im Labor in der Lage ist, Code-Optimierungen für sich selbst durchzuführen, stößt KI in der echten Welt auf externe Flaschenhälse:

  • Nicht-verifizierbare Aufgaben: KI glänzt bei verifizierbaren Problemen (z. B. Mathematik, Code-Compiling). Kreativität, System-Architektur oder wissenschaftliche Eureka-Momente erfordern abstrakte Repräsentationen und Inference-Time-Anpassungen, die den heutigen LLMs fehlen.
  • Reale Welt-Latenz: Die Entwicklung eines neuen Krebsmedikamentes scheitert nicht an der Generierung von Molekülen, sondern an mehrjährigen klinischen Studien am Menschen.
  • Chaos-Grenzen: Ähnlich wie bei der Wettervorhersage gibt es komplexe Systeme, deren Grenzen durch Physik und Mathematik gesteckt sind, nicht durch fehlende Rechenleistung.

5. Der Paradigmenwechsel: Vom Rowing zum Steering

Wenn das reine Schreiben von Code und das Generieren von Artefakten zunehmend automatisiert wird, verschiebt sich die Kernkompetenz von Tech-Teams: Von der Generierung zur Evaluation.

Die Metapher der Schifffahrt:

Früher saßen Entwickler im Ruderboot. Die physische Arbeit (das Rudern) und das Steuern waren eins. Modernes Software-Engineering gleicht einem Brückendeck auf einem Frachtschiff: Der Antrieb ist automatisiert, aber die Navigation, das Überwachen der Instrumente und die strategische Routenplanung erfordern hochspezialisierte Experten.

[💡 KEY TAKEAWAY FÜR TECH-TEAMS]

Evals sind das neue IP: Die Fähigkeit eines Unternehmens, KI-Systeme präzise, domänenspezifisch und automatisiert zu evaluieren (Evaluation Engineering), wird zum wertvolleren Wirtschaftsgut als der Code selbst.

6. Praxistipps: Wie wir uns als Engineers anpassen

Um im Zeitalter der KI nicht die Kontrolle zu verlieren, empfiehlt sich eine klare Strategie im Entwicklungsalltag:

  • Vermeide die „Black-Box-Falle“: Nutze Agenten nicht als undurchsichtige Magie. Wer die Zwischenschritte und Prompts nicht versteht, gibt Schritt für Schritt die Systemkontrolle ab.
  • Durchbrich die Abhängigkeitsspirale: Setze KI nicht für Aufgaben ein, deren Grundlagen du selbst noch nicht beherrschst. Erst die eigene Domain-Expertise befähigt dazu, die Ergebnisse der KI valide zu bewerten.
  • Fokus auf das „Ceiling“ statt das „Floor“: Nutze die durch KI gewonnene Zeit nicht nur für kurzfristige Produktivität (Floor), sondern re-investiere sie in den Aufbau neuer, komplementärer Skills (Ceiling), um komplexere Architektur Probleme zu lösen.

Fazit: Co-Superintelligence statt Job-Apokalypse

KI nimmt uns die kognitive Schwerstarbeit ab. Sie wirkt wie ein Kran für den Verstand. Wer sich nur über das händische Tippen von Code definiert, wird es schwer haben. Wer sich jedoch darauf konzentriert, komplexe Systeme zu orchestrieren, KI-Outputs kritisch zu evaluieren und die strategische Richtung vorzugeben, tritt in eine Ära ein, in der die eigenen Fähigkeiten massiv skaliert werden.