|
Getting your Trinity Audio player ready...
|
Adesso-Grüder Volker Gruhn beschreibt agentische Softwareentwicklung als Verfahren, bei dem die Agenten verschwinden, bevor das System läuft. Das verschiebt die Governance-Frage, löst sie aber nicht: Sie sitzt jetzt in der Spezifikation – und in einer Prüfpraxis, die für Agenten zur Laufzeit noch fehlt.
In einem Interview beschreibt Gruhn, wie sein Haus Software inzwischen entwickelt: Menschen bringen die fachliche Spezifikation auf ein hinreichendes Vollständigkeitsniveau, daraus werden Testfälle abgeleitet, dann arbeiten Entwicklungsagenten. Das fertige System ist weitgehend von Agenten erzeugt, enthält aber selbst keine Agenten mehr. Drei Aussagen daraus verdienen eine genauere Betrachtung: dass der Agent zur Laufzeit verschwindet, dass die Spezifikation zum Engpass wird, und dass Haftung allein nicht genügt.
Zur Begriffsklärung: Regelgebundene Agenten führen vorgegebene Regeln aus. Regelintelligente Agenten legen Regeln im Einzelfall aus, wo diese nicht eindeutig sind. Regelentwerfende Agenten erzeugen neue Regeln, für sich selbst oder für andere. Institutionell situiert ist ein Agent, wenn sein Handlungsspielraum durch das Regelwerk einer Organisation gerahmt ist und er sich darin legitimieren muss.
Die Regeln entstehen früher
Gruhns Unterscheidung ist klar: Ein Entwicklungsagent schreibt Code, das Ergebnis ist gewöhnliche, regelbasierte Software. In der genannten Typologie ist der Entwicklungsagent regelentwerfend, denn er erzeugt das Regelwerk. Das Ergebnis ist dagegen regelgebunden. Entwurfsmacht und Laufzeitmacht sind damit getrennt, und das ist institutionell ein sauberer Zug: Was ausgeliefert wird, ist festgelegt und lässt sich prüfen.
Die Grenze liegt in der Prüfbarkeit. Gruhn sagt selbst, dass es produktive Software gibt, deren Code kein Mensch mehr angesehen hat. Dann ruht die Kontrolle auf den Testfällen, und diese werden aus derselben Spezifikation abgeleitet, aus der auch der Code entsteht. Vorläufig lässt sich vermuten: Ein Fehler in der Spezifikation wird auf diese Weise nicht entdeckt, sondern doppelt bestätigt. Menschen greifen laut Gruhn ein, wenn sich die Agenten verlaufen oder groben Unsinn produzieren. Das erfasst den sichtbaren Unsinn, nicht den plausiblen.
Die Spezifikation ist die Institution
Wichtiger wird nach Gruhn, die tatsächlichen fachlichen Anforderungen zu verstehen und auszudrücken. Sein Beispiel ist das Underwriting beim Versicherer: Was wird geprüft, nach welchen Kriterien, in welchem Prozess, und worin unterscheidet sich dieses Unternehmen von anderen? Das sind Entscheidungsprämissen der Organisation. Wer sie formuliert, entwirft faktisch die Institution, in der der Agent sich bewegt.
Zwei Folgerungen, beide vorläufig. Erstens verschiebt sich der Engpass von der Programmierung zur Explikation. Was eine Organisation nicht ausdrücken kann, geht nicht in die Spezifikation ein, und ein Agent kann es nach Gruhns eigener Auskunft nur schwer selbst herausfinden. Zweitens wandert die Governance nach vorn: Sie ist Institutionengestaltung vor der Ausführung, nicht Aufsicht während des Betriebs. Gruhns Satz, schlechte Systeme würden dann eben billiger schlecht nachgebaut, beschreibt genau diese Abhängigkeit.
Offen bleibt, wer die Verantwortung für die Spezifikation trägt. Gruhn will stärker Festpreisprojekte anbieten, sodass der Effizienzgewinn zunächst beim Dienstleister bleibt. Ob dieser Anreiz auch die Vollständigkeit der Spezifikation belohnt, sagt er nicht.
Der Rest, der bleibt: Agenten im laufenden System
Gruhn trennt selbst: Wenn Agenten im ausgelieferten System Entscheidungen treffen, sei das „gesondert zu bewerten“. Solche Anwendungen seien bei Adesso noch kein relevantes Geschäft, man unterstütze Kunden aber schon beim Training von Fachagenten. Genau hier endet das Prinzip „Der Agent verschwindet“. Ein Fachagent im laufenden System ist mindestens regelintelligent, weil er Regeln auf Einzelfälle anwendet, die sie nicht vorhergesehen haben. Die von Gruhn zuletzt angesprochenen sich selbst verbessernden Systeme wären zur Laufzeit regelentwerfend.
Dass „gesondert bewerten“ ausgesprochen wird, aber kein Maßstab dafür genannt ist, ist keine Kritik an Gruhn, sondern ein Befund über den Stand der Debatte: Für den Entwicklungsagenten gibt es ein Verfahren (Spezifikation, Tests, Eingriff), für den Laufzeitagenten bisher kaum.
Haftung reicht nicht
Gruhns Karussell-Vergleich trifft einen institutionellen Kern. Niemand sagt, jeder Schausteller dürfe aufbauen und müsse im Schadensfall eben zahlen; es gibt Prüfungen und Standards, damit der Schaden gar nicht erst eintritt. Mit Luhmann lässt sich das präzisieren: Er unterscheidet Risiko, den Schaden als Folge der eigenen Entscheidung, von Gefahr, dem Schaden, den jemand erleidet, ohne selbst entschieden zu haben. Haftung adressiert die Entscheider, und zwar nachträglich. Die Betroffenen bleiben Betroffene. Ein Prüfverfahren verlegt die Entscheidung vor den Schaden und macht sie zum Gegenstand institutioneller Kontrolle.
Die Prüfung beim Karussell funktioniert allerdings, weil sein Verhalten mit dem Zustand bei der Abnahme weitgehend feststeht. Bei regelintelligenten oder regelentwerfenden Agenten ist das nicht der Fall. Gruhn räumt es für agentisch entwickelte Software selbst ein: Ob sie über den Lebenszyklus stabil bleibt, lasse sich erst bei der Außerbetriebnahme beurteilen. Vorläufig folgt daraus, dass eine Prüfung vor der Auslieferung nötig, aber nicht hinreichend ist. Sie müsste durch laufende Prüfung im Betrieb ergänzt werden, samt der Befugnis, einzugreifen und zu stoppen.
Gruhns letzte Forderung geht in diese Richtung: Wer nicht erklären kann, wie er ein System sicher beherrscht, darf es nicht ausliefern. Das ist ein Begründungsanspruch und damit im Kern eine Legitimationsfrage. Der Anbieter muss sich vor Auslieferung rechtfertigen, nicht erst danach haften.
Wer prüft später?
Eine Frage Gruhns geht über Verfahren hinaus: Orchestrieren kann agentische Prozesse, wer schon größere Softwareprojekte erlebt hat. Erfahrung entsteht jedoch durch Programmieren, und wenn das entfällt, versiegt die Quelle der Kontrollkompetenz. Adesso setzt Berufseinsteiger deshalb nicht in Projekten ein, in denen Software vollständig generiert wird. Das ist ein institutionelles Gegenmittel, aber ein einzelbetriebliches. Ob es sich über das eigene Haus hinaus durchsetzt, ist offen.
Einordnung
Gruhn spricht als Anbieter, der agentische Softwarefabriken verkaufen oder vermieten könnte; das Bild des Agenten, der vor der Auslieferung geht, ist für ihn auch ein Geschäftsmodell. Das macht seine Aussagen nicht falsch. Für den regelgebundenen Laufzeitfall ist die Konstruktion plausibel, die Prüflast liegt dort bei Spezifikation und Tests. Für Agenten, die im laufenden System entscheiden, trägt sie nicht, und dort fehlt, das sagt Gruhn selbst, das Verfahren noch. Dass die Governance mit der Spezifikation beginnt, ist vorläufig gut gestützt; ob Prüfverfahren nach dem Karussell-Muster für Laufzeitagenten ausreichen, bleibt eine offene These.
Ralf Keuper
Quellen
