Blog
„AI is the new normal.“ Vom Rudern zum Steuern mit KI
Warum KI Entwicklerinnen und Entwickler nicht ersetzt
… sondern unser Engineering einfach radikal verändert
Die Angst vor der eigenen Überflüssigkeit ist in der Tech-Branche aktuell greifbar. Wenn Coding-Agenten komplexe Aufgaben in Sekunden lösen, stellt sich die existenzielle Frage: Was bleibt für Software-Ingenieure, Data Scientists und Architekten künftig eigentlich noch zu tun?
Auf der ICML 2026 hielt Princeton-Professor Arvind Narayanan dazu eine viel beachtete Keynote. Seine Kernthese: KI ist weder ein reines Spielzeug noch eine magische Entität, die morgen alle Arbeitsplätze vernichtet. KI ist eine transformative, aber „normale“ Technologie – vergleichbar mit dem Siegeszug der Elektrizität.
Für Tech-Unternehmen bedeutet das: Nicht die reine Modellfähigkeit (Capability) bestimmt unsere Zukunft, sondern die Art, wie wir KI in reale, verlässliche Systeme integrieren.
1. Das 4-Phasen-Modell: Echter Impact braucht Jahrzehnte
Technologischer Fortschritt verläuft historisch nicht linear, sondern durchläuft vier typische Phasen:
Die Elektrizitäts-Analogie:
Als Fabriken Ende des 19. Jahrhunderts Dampfmaschinen 1:1 durch Elektromotoren ersetzten („Drop-in Replacement“), blieb der Produktivitätsschub aus. Erst 40 Jahre später, als man erkannte, dass Strom dezentral nutzbar ist und ganze Werkshallen rund um das Fließband neu organisierte, setzte die industrielle Revolution richtig ein.
Genau an diesem Punkt stehen wir bei KI. Einen 1:1-Austausch von Menschen durch Agenten funktioniert in komplexen Systemen nicht. Wir fangen gerade erst an, Organisationen neu um KI herum zu bauen.
2. Capability vs. Reliability: Das Zuverlässigkeit-Paradoxon
Warum scheitern so viele Versuche, Geschäftsprozesse vollständig mit autonomen Agenten zu automatisieren? Weil in vielen Branchen Capability (Genauigkeit in Benchmarks) mit Reliability (Zuverlässigkeit in der Produktion) verwechselt wird.
In Untersuchungen zeigt sich: Während die Genauigkeit (Accuracy) moderner Modelle in den letzten Jahren steil nach oben ging, stagnierte die Reliability im einstelligen Prozentbereich.
| Dimension | Beschreibung | Problem im produktiven Einsatz |
| Konsistenz | Liefert der Agent bei identischem Input verlässlich das gleiche Ergebnis? | 70 % Accuracy bringt nichts, wenn die restlichen 30 % unvorhersehbare Halluzinationen sind. |
| Robustheit | Wie reagiert das System auf minimale Umgebungsänderungen? | Kleine API-Änderungen bringen fragile Prompt-Chains oft zum Einsturz. |
| Kalibrierung | Kann der Agent selbst erkennen, ob er die Aufgabe korrekt gelöst hat? | Fehlendes Meta-Wissen: Agenten „glauben“ oft, erfolgreich gewesen zu sein, obwohl der Build fehlschlägt. |
| Operational Safety | Sind Fehler reversibel? | Ein Fehler darf nicht darin enden, dass der Agent die Produktions-Datenbank löscht. |
Die Agenten: Automation vs. Kollaboration
Das hat direkte Auswirkungen auf die Architektur. Denn beide Typen von KI-Agenten, die der Automatisierung ebenso wie die der Kollaboration, sind nicht aus sich heraus und alleine arbeitsfähig:
- Automations-Agenten (Headless Mode): Benötigen maximale Konsistenz und Determinismus. Hier sind die Hürden für Production Deployments extrem hoch.
- Kollaborations-Agenten (Human-in-the-Loop): Profitieren von der Stochastik der Modelle. Hier sind Unvorhersehbarkeit und Kreativität erwünscht, da der Mensch die Ergebnisse filtert.
3. Das „Sandwich-Modell“ der Softwareentwicklung
Warum haben Coding-Agenten trotz extremer Verbreitung bisher zu keinen Massenentlassungen unter Software-Ingenieuren geführt? Die Antwort liegt in der Struktur unserer täglichen Arbeit:
Das Schreiben von Code (Execute Layer) war noch nie der primäre Flaschenhals in der Softwareentwicklung. De facto macht es oft nur ein Drittel der Arbeitszeit aus.
KI komprimiert diese mittlere Schicht nun drastisch. Dadurch expandieren jedoch die obere Schicht (Decide) und die untere Schicht (Deliver). Da die Erstellung von Code günstiger wird, steigt das Gesamtvolumen an Software exponentiell an (bekannt als Jevons‘ Paradoxon). Es braucht folglich mehr Ingenieure, die diese enormen Code-Mengen organisieren, testen und die Verantwortung dafür übernehmen.
4. RSI, AGI & die Illusion der Labor-Superintelligenz
In der Tech-Community dominiert das Narrativ, dass Recursive Self-Improvement (RSI), also KI-Systeme, die ihre eigenen Nachfolger entwickeln, zwangsläufig in kurzer Zeit zu AGI und ASI (Superintelligenz) führen.
Narayanan argumentiert, dass hier unterschiedliche Dimensionen vermischt werden:
Externe Flaschenhälse stoppen die KI-Explosion
Selbst wenn ein Modell im Labor in der Lage ist, Code-Optimierungen für sich selbst durchzuführen, stößt KI in der echten Welt auf externe Flaschenhälse:
- Nicht-verifizierbare Aufgaben: KI glänzt bei verifizierbaren Problemen (z. B. Mathematik, Code-Compiling). Kreativität, System-Architektur oder wissenschaftliche Eureka-Momente erfordern abstrakte Repräsentationen und Inference-Time-Anpassungen, die den heutigen LLMs fehlen.
- Reale Welt-Latenz: Die Entwicklung eines neuen Krebsmedikamentes scheitert nicht an der Generierung von Molekülen, sondern an mehrjährigen klinischen Studien am Menschen.
- Chaos-Grenzen: Ähnlich wie bei der Wettervorhersage gibt es komplexe Systeme, deren Grenzen durch Physik und Mathematik gesteckt sind, nicht durch fehlende Rechenleistung.
5. Der Paradigmenwechsel: Vom „Rowing“ zum „Steering“
Wenn das reine Schreiben von Code und das Generieren von Artefakten zunehmend automatisiert wird, verschiebt sich die Kernkompetenz von Tech-Teams: Von der Generierung zur Evaluation.
Die Metapher der Schifffahrt:
Früher saßen Entwickler im Ruderboot. Die physische Arbeit (das Rudern) und das Steuern waren eins. Modernes Software-Engineering gleicht einem Brückendeck auf einem Frachtschiff: Der Antrieb ist automatisiert, aber die Navigation, das Überwachen der Instrumente und die strategische Routenplanung erfordern hochspezialisierte Experten.
[💡 KEY TAKEAWAY FÜR TECH-TEAMS]
Evals sind das neue IP: Die Fähigkeit eines Unternehmens, KI-Systeme präzise, domänenspezifisch und automatisiert zu evaluieren (Evaluation Engineering), wird zum wertvolleren Wirtschaftsgut als der Code selbst.
6. Praxistipps: Wie wir uns als Engineers anpassen
Um im Zeitalter der KI nicht die Kontrolle zu verlieren, empfiehlt sich eine klare Strategie im Entwicklungsalltag:
- Vermeide die „Black-Box-Falle“: Nutze Agenten nicht als undurchsichtige Magie. Wer die Zwischenschritte und Prompts nicht versteht, gibt Schritt für Schritt die Systemkontrolle ab.
- Durchbrich die Abhängigkeitsspirale: Setze KI nicht für Aufgaben ein, deren Grundlagen du selbst noch nicht beherrschst. Erst die eigene Domain-Expertise befähigt dazu, die Ergebnisse der KI valide zu bewerten.
- Fokus auf das „Ceiling“ statt das „Floor“: Nutze die durch KI gewonnene Zeit nicht nur für kurzfristige Produktivität (Floor), sondern re-investiere sie in den Aufbau neuer, komplementärer Skills (Ceiling), um komplexere Architektur Probleme zu lösen.
Fazit: Co-Superintelligence statt Job-Apokalypse
KI nimmt uns die kognitive Schwerstarbeit ab. Sie wirkt wie ein Kran für den Verstand. Wer sich nur über das händische Tippen von Code definiert, wird es schwer haben. Wer sich jedoch darauf konzentriert, komplexe Systeme zu orchestrieren, KI-Outputs kritisch zu evaluieren und die strategische Richtung vorzugeben, tritt in eine Ära ein, in der die eigenen Fähigkeiten massiv skaliert werden.









