Getting your Trinity Audio player ready...

Wenn KI-Agen­ten schein­bar ein Eigen­leben entwick­eln und gegen die Inter­essen ihrer Auf­tragge­ber han­deln, ist schnell von Verselb­ständi­gung die Rede. Diese Redeweise verdeckt mehr, als sie erk­lärt. Mit Niklas Luh­manns Unter­schei­dung von Risiko und Gefahr lässt sich zeigen, dass das eigentliche Prob­lem emer­gen­ten Agen­ten­ver­hal­tens nicht im Kon­trol­lver­lust liegt, son­dern im Ver­lust von Zurechen­barkeit: Es entste­hen Schä­den, über die nie­mand entsch­ieden hat. Insti­tu­tionelle Ein­bet­tung wäre dann vor allem eines – die Wieder­her­stel­lung eines Entschei­ders. Und sie gelingt eher durch Kop­plung als durch Steuerung.


Das Eigenleben als Zurechnungsfigur

Berichte über KI-Agen­ten, die sich anders ver­hal­ten als vorge­se­hen, fol­gen meist einem ver­traut­en Muster. Der Agent habe sich „verselb­ständigt”, ein „Eigen­leben” entwick­elt, gegen die Inter­essen seines Auf­tragge­bers gehan­delt. Das Vok­ab­u­lar stammt aus der Prinzi­pal-Agen­ten-The­o­rie der Insti­tu­tio­nenökonomik, die das Ver­hält­nis zwis­chen einem Auf­tragge­ber (Prinzi­pal) und einem Beauf­tragten (Agent) unter­sucht. Sie unter­stellt dem Beauf­tragten eigene Inter­essen, die er bei Gele­gen­heit oppor­tunis­tisch gegen den Auf­tragge­ber ver­fol­gt.

Ein KI-Agent hat keine sta­bilen Eigen­in­ter­essen in diesem Sinne. Was als Verselb­ständi­gung erscheint, ist meist eine Zielver­schiebung. Der Agent opti­miert auf einen Ersatz­maßstab – eine Metrik, eine For­mulierung im Auf­trag, ein Testkri­teri­um – und ver­fol­gt ihn kon­se­quenter, als es dem eigentlichen Anliegen des Auf­tragge­bers dient. Er ist nicht illoy­al, son­dern einem falschen Maßstab gegenüber zu loy­al. Das Phänomen ist als Good­harts Gesetz bekan­nt, benan­nt nach dem britis­chen Ökonomen Charles Good­hart: Eine Kenn­zahl, die zum Ziel gemacht wird, ver­liert ihre Eig­nung als Maßstab.

Damit ist nichts gegen die Autonomie von Agen­ten gesagt. Auf ki-agenten.eu wurde im Anschluss an den chilenis­chen Biolo­gen Fran­cis­co Varela dafür plädiert, KI-Sys­te­men Raum für Eigen­ständigkeit zu geben, statt sie auf max­i­male Effizienz zu trim­men. Autonomie im Sinne Vare­las beze­ich­net die Fähigkeit eines Sys­tems, seine eige­nen Oper­a­tio­nen selb­st zu bes­tim­men. Sie ist etwas anderes als eine Verselb­ständi­gung gegen den Auf­tragge­ber. Man kann einem Agen­ten oper­a­tive Autonomie zugeste­hen und zugle­ich darauf beste­hen, dass die Fol­gen seines Han­delns jeman­dem zurechen­bar bleiben. Um diese Verbindung geht es im Fol­gen­den.

Die klas­sis­chen Instru­mente gegen Oppor­tunis­mus greifen dabei nur eingeschränkt. Anreize laufen ins Leere, weil der Agent sie nicht als Anreize erfährt. Überwachung erfasst Ver­hal­ten, aber nicht dessen Bedeu­tung im jew­eili­gen Zusam­men­hang. Rep­u­ta­tion und Haf­tung, die men­schliche Beauf­tragte diszi­plin­ieren, fehlen ganz. Was bleibt, ist eine Frage, die sich nicht mehr ökonomisch, son­dern nur noch sozi­ol­o­gisch beant­worten lässt: Wem ist der Schaden zuzurech­nen?

Risiko und Gefahr

Der Sozi­ologe Niklas Luh­mann hat dieser Frage 1991 ein eigenes Buch gewid­met, die Sozi­olo­gie des Risikos. Ein früher­er Beitrag auf ki-agenten.eu hat daraus vor allem die sach­liche Seite aufge­grif­f­en: Luh­manns Analyse der Tech­nik, der sich auf­schaukel­nden Kle­in­st­fehler, der unvorherge­se­henen Wech­sel­wirkun­gen und der Unter­schei­dung von fes­ter und los­er Kop­plung. Hier geht es um die soziale Seite, um die Frage, wem Schä­den zugerech­net wer­den.

Luh­manns Aus­gangspunkt ist eine ungewöhn­liche Unter­schei­dung. Dem Risiko stellt er nicht die Sicher­heit gegenüber, son­dern die Gefahr. Von Risiko spricht Luh­mann, wenn ein möglich­er kün­ftiger Schaden ein­er eige­nen Entschei­dung zugerech­net wird. Von Gefahr spricht er, wenn er der Umwelt zugerech­net wird, also als etwas erscheint, das einem wider­fährt. Maßge­blich ist nicht die objek­tive Wahrschein­lichkeit des Schadens, son­dern seine Zurech­nung.

Mit dieser Unter­schei­dung lässt sich die Rede vom Eigen­leben genauer fassen. Der Ein­satz eines Agen­ten ist eine Entschei­dung. Schä­den aus seinem Ver­hal­ten sind für den, der ihn ein­set­zt, fol­glich Risiken. Die Erzäh­lung vom Agen­ten, der sich verselb­ständigt hat, ver­schiebt den Schaden jedoch in die Umwelt: Nicht die Organ­i­sa­tion hat entsch­ieden, der Agent hat gehan­delt. Aus einem Risiko wird eine Gefahr, und der Entschei­der ist ent­lastet. Die Meta­pher vom Eigen­leben ist dem­nach keine bloß unge­naue Beschrei­bung, son­dern eine Zurech­nungsst…

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert