Rene Weiss IT Consulting

Agentic Engineering

Agentic Engineering ist die Weiterentwicklung von Software Engineering: Intent, Constraints und Qualitätsanforderungen so präzise spezifizieren, dass KI-Agenten daraus produktionsreife, langfristig wartbare Software erzeugen.

Abgrenzung

Vibe Coding delegiert das Schreiben von Code an KI und akzeptiert das Ergebnis weitgehend auf Basis dessen, ob es funktioniert. Agentic Engineering delegiert Implementierungsarbeit an KI-Agenten, nicht aber die Engineering-Verantwortung: Menschen definieren Intent, Constraints und Qualitätsmaßstäbe – und machen sie so explizit und überprüfbar, dass Agenten ihre eigene Arbeit gegen diese Kriterien verifizieren können. Die Verantwortung für das Ergebnis bleibt beim Menschen.

AI-assisted Coding lässt Menschen weiterhin jede Zeile selbst schreiben, KI schlägt lediglich vor. AI Engineering wiederum bezeichnet das Bauen von KI-/ML-Systemen selbst, nicht deren Einsatz zur Softwareentwicklung. Agentic Engineering unterscheidet sich von beidem: Agenten führen Implementierung eigenständig aus, Menschen steuern über Intent, Constraints und Verifikationskriterien.

Denn Software Engineering war nie nur Code, sondern Teil eines soziotechnischen Systems aus Team, Abteilung und Unternehmen. Mit zunehmender Geschwindigkeit der Implementierung verschiebt sich der Engpass zur Entscheidungsgeschwindigkeit dieses Systems. Agentic Engineering umfasst deshalb nicht nur den effektiven Einsatz von KI-Agenten, sondern auch die Befähigung des Teams und die aktive Einbindung der Organisation.

Reifegrade nach Shapiro

Wie weit Softwareentwicklung mit KI-Agenten fortgeschritten ist, lässt sich als Reifegrad beschreiben. Dan Shapiro unterscheidet sechs Stufen zunehmender Autonomie, benannt nach der Rolle, die die KI dabei übernimmt: vom reinen Autocomplete-Tool (Spicy Autocomplete) über Coding Intern, Junior Developer und Developer bis zum ganzen Engineering Team und schließlich der vollständig eigenständigen Dark Software Factory (Quelle: Dan Shapiro, „The Five Levels: from Spicy Autocomplete to the Dark Factory", danshapiro.com). Auffällig: Die meisten bleiben laut Shapiro bereits bei Level 3 stehen, statt weiter Richtung Level 4 („Engineering Team") vorzudringen.

Warum Organisationen hängen bleiben

Shapiros Erklärung für das Plateau bei Level 3: Wer nur noch Diffs reviewt statt selbst zu programmieren, verliert einen großen Teil dessen, was am Job als Senior Developer bisher Spaß gemacht hat. Das erklärt, warum Einzelpersonen dort hängen bleiben – aber nicht, warum ganze Teams es tun.

Der strukturelle Grund: Setzt man Agenten in eine unveränderte Arbeitsweise, beschleunigt man die Implementierung, aber nicht zwangsläufig das System darum herum. Anforderungen, Entscheidungen und Verifikation bleiben an denselben Personen hängen – der Engpass verschwindet nicht, er verdichtet sich.

Level 4 braucht deshalb nicht einfach bessere Prompts, sondern eine andere Organisation der Arbeit: etwa präzisere, maschinell überprüfbare Spezifikationen oder Verifikation, die nicht mehr von einer einzelnen Person abhängt. Welche dieser Dimensionen zuerst zum Engpass wird, unterscheidet sich von Organisation zu Organisation. Wer seine Engpass-Dimension nicht aufbricht, bleibt bei Level 3 hängen. Deshalb müssen Teams und Organisationen ihre Arbeitsweise aktiv anpassen – Level 4 entsteht nicht durch bessere Einzelpersonen, sondern durch ein verändertes Arbeitssystem.

Ich bin Rene Weiß, Berater für Software- und Enterprise-Architektur mit Fokus auf Agentic Engineering. Ich bin Co-Autor von Software Architecture Metrics (O'Reilly, 2022). Mehr zu meiner Arbeit finden Sie auf rw-it.consulting.

Agentic Engineering Compass

Der Agentic Engineering Compass ist ein multidimensionales Modell zur Standortbestimmung: Er zeigt einer Entwicklungsorganisation, wo sie aktuell steht, wo strukturelle Engpässe liegen und welche Veränderungen als Nächstes notwendig sind, um das Potenzial agentischer Softwareentwicklung bestmöglich auszunutzen.

Dafür wird Shapiros Skala nicht auf ein Gesamturteil verdichtet, sondern auf mehrere Dimensionen gleichzeitig angewendet – etwa darauf, wie Anforderungen spezifiziert, wie verifiziert und wie entschieden wird. Erhoben wird das über Gespräche mit den beteiligten Teams und einen Blick auf vorhandene Artefakte, nicht über einen Fragebogen allein. Das Ergebnis ist kein Einzellevel, sondern ein Reifegradprofil, das zeigt, welche Dimension den Fortschritt aktuell am stärksten begrenzt – Grundlage für eine priorisierte Roadmap statt einer generischen Checkliste.

Zusammenarbeit

Ich arbeite mit Entwicklungsorganisationen jeder Größe – vom einzelnen Team bis zur großen, mehrteiligen Organisation. Zuschnitt und Dauer skalieren mit der Organisation: ein bis drei Wochen bei einzelnen Teams, mit wenigen Tagen vor Ort – bei größeren Organisationen entsprechend mehr Zeit. Ergebnis ist eine Ergebnispräsentation: das Reifegradprofil aus dem Compass, mit priorisierter Roadmap, damit Teams direkt weiterarbeiten können.

Wenn Sie wissen wollen, wo Ihre Organisation steht – lassen Sie uns sprechen.