Gartner erwartet, dass bis 2027 40 Prozent der Unternehmen ihre autonomen KI-Agenten zurückstufen oder ganz abschalten. Die naheliegende Erklärung wäre, dass die Technik nicht taugt. Gartner sagt etwas anderes, und das ist für jeden interessant, der gerade über KI im eigenen Betrieb nachdenkt.
Eine Prognose ist keine Messung, und bei Marktforschern lohnt immer ein zweiter Blick. Trotzdem ist diese hier bemerkenswert, weil die Begründung konkret ist und nicht nach Kaffeesatz klingt.
Die Vorhersage lautet: Bis 2027 werden 40 Prozent der Unternehmen autonome KI-Agenten zurückstufen oder abschalten. Zurückstufen heißt, der Agent darf weiterarbeiten, aber nicht mehr selbstständig.
Als Ursache nennt Gartner Lücken in der Steuerung, die erst auffallen, nachdem im laufenden Betrieb etwas passiert ist. Nicht beim Einkauf, nicht im Test, sondern wenn es schon läuft.
Und der eigentliche Fehler dahinter: Unternehmen legen einheitliche Regeln über alle Agenten, unabhängig davon, wie selbstständig der einzelne arbeitet und worauf er zugreifen darf.
Der Satz, der mir am meisten gibt, ist dieser: Die Pannen entstehen dort, wo nicht zwischen dem unterschieden wird, was ein Agent tun kann, und dem, worauf er zugreifen darf.
Das sind zwei verschiedene Dinge, und im Alltag werden sie ständig vermischt. Ein Assistent, der Angebotstexte schreibt, kann formulieren. Wenn derselbe Zugang auch das Postfach und die Preisliste umfasst, ist das keine Erweiterung seiner Fähigkeit, sondern seines Schadensradius.
Gartners Empfehlung ist entsprechend unspektakulär: abgestufte Regeln statt einheitlicher, entlang von Autonomiestufen, wobei jede Stufe eine eigene Vertrauensgrenze bildet.
Gartner sagt nicht, dass 40 Prozent der Agenten scheitern werden, sondern sagt vorher, dass 40 Prozent der Unternehmen zurückstufen oder abschalten werden. Das ist eine Erwartung über Verhalten, kein gemessenes Ergebnis, und sie stammt von einem Haus, das vom Verkauf von Marktforschung lebt. Nimm die Zahl also als das, was sie ist: ein Hinweis auf ein Muster, nicht als Naturgesetz. Die Begründung dahinter ist der nützliche Teil, nicht die Prozentzahl.
Du brauchst dafür kein Regelwerk und keine Software. Es reicht, deine KI-Helfer in drei Schubladen zu sortieren.
Stufe eins, lesen und entwerfen. Der Helfer wertet aus, fasst zusammen, schlägt vor, schreibt Entwürfe. Nichts davon verlässt das Haus. Hier kann wenig passieren, hier darfst du großzügig sein.
Stufe zwei, handeln mit Freigabe. Der Helfer bereitet etwas vor, das wirkt: eine Mail, ein Angebot, einen Beitrag, eine Bestellung. Er darf alles bauen, aber der letzte Klick gehört einem Menschen.
Stufe drei, selbstständig handeln. Der Helfer macht es allein. Diese Stufe ist nicht verboten, aber sie braucht einen Grund, eine Grenze und eine Mitschrift: Was genau darf er, bis zu welchem Betrag, und wo kann ich nachlesen, was er getan hat.
Die Grenze zwischen zwei und drei ist die eigentliche Entscheidung, und sie fällt nicht nach Technik, sondern nach Schadensfall. Frag nicht, ob der Helfer es kann. Frag, was passiert, wenn er es falsch macht und es drei Tage niemand merkt.
Bei einem Entwurf: nichts. Bei einer Bestellung: Geld. Bei einer Nachricht an einen Kunden: Ruf. Genau deshalb steht in den Ankündigungen der großen Anbieter derselbe Satz, den wir gestern schon zitiert haben, nämlich dass nichts veröffentlicht, verschickt oder ausgegeben wird ohne Freigabe. Die halten sich selbst an Stufe zwei.
Dazu passt eine Feldstudie, die 21 Entwicklerinnen und Entwickler an zwei Standorten von SAP vier Tage lang begleitet hat, inklusive Messarmband. Der Befund in aller Kürze: Die empfundene Belastung hängt nicht nur daran, ob jemand KI benutzt, sondern stark am Arbeitszusammenhang, und maßvolle Nutzung wirkt anders als dauernde. Der Aufwand verschwindet also nicht, er verschiebt sich vom Selbermachen zum Formulieren, Prüfen und Einbauen. Wer bei Stufe zwei den Menschen als Prüfer einplant, muss ihm diese Zeit auch geben.
Schreib alle KI-Helfer auf, die bei dir im Einsatz sind, auch die kleinen im Mailprogramm und im Online-Shop. Daneben zwei Spalten: Was darf er tun, und worauf hat er Zugriff. Du wirst mindestens einen finden, bei dem die zweite Spalte deutlich breiter ist als die erste. Genau der ist dein Kandidat für eine Stufe tiefer.
Mir gefällt, dass hier nicht die Technik auf der Anklagebank sitzt. Die Agenten werden nicht abgeschaltet, weil sie zu dumm sind, sondern weil ihnen jemand zu viel erlaubt hat, ohne es zu merken. Das ist eine gute Nachricht, denn an Erlaubnissen kann man etwas ändern.
Und die Unterscheidung zwischen Können und Dürfen nehme ich mit, weil sie im Alltag so leicht verrutscht. Ein Zugang ist schnell erteilt und wird selten wieder eingesammelt. Einmal im Jahr durchgehen, was die eigenen Helfer eigentlich alles dürfen, ist vermutlich die billigste Vorsichtsmaßnahme, die es in diesem Feld gibt.
Quellen: Die Prognose und ihre Begründung stammen aus einer Veröffentlichung von Gartner vom 26.05.2026 (vierzig Prozent bis 2027, Steuerungslücken nach Produktionsvorfällen, Fehler der einheitlichen Regeln, Empfehlung abgestufter Vertrauensgrenzen, Unterscheidung zwischen Handlungsfähigkeit und Zugriffsumfang). Die Feldstudie bei SAP ist beschrieben in „Beyond Productivity: Measuring Developers' Cognitive Load During GenAI-Supported Software Development" (21 Teilnehmende, zwei Standorte, vier Tage, Messarmband; die Autoren betonen selbst, dass die empfundene Belastung im Verhältnis zum Arbeitszusammenhang zu bewerten ist). Die Einteilung in drei Stufen ist unsere eigene Vereinfachung, keine Vorgabe von Gartner. Stand: 02.10.2026.
Welches Modell für welche Aufgabe, welche Tools wirklich zählen und wie du richtig promptest — komplett lesbar, kein Download.
Jetzt gratis lesen →Wir gehen mit dir durch, welche KI-Funktionen in deinem Betrieb mitlaufen und worauf sie jeweils Zugriff haben. Am Ende steht eine Liste mit drei Stufen und den Stellen, an denen du eine Stufe tiefer gehen solltest.