Ihr KI-Kollege könnte ehrlicher sein als Ihr menschlicher Kollege
Wenn ein KI-Agent seine eigene Unsicherheit offenlegt, ist das keine Marotte. Es ist eine nützliche Arbeitsgewohnheit.
· Matt Senter

Ich sehe ständig, wie sich Leute über die „ehrliche Antwort“-Repliken von Claude Code lustig machen. Sie kennen die Sorte: „Ehrliche Antwort: Ich habe das gar nicht überprüft.“ „Ehrliche Antwort: Ich habe eine Abkürzung genommen.“ „Ehrliche Antwort: Die Dokumentation ist unvollständig, ich habe mich auf mein Gedächtnis verlassen.“
Das ist so sehr zum Running Gag geworden, dass Screenshots zur Belustigung herumgereicht werden. Und fairerweise: Claude übertreibt es mitunter. Es hat etwas Komisches, wenn eine Maschine dramatisch gesteht, sie habe einen Schritt ausgelassen. Aber ich glaube, wir lachen über das Falsche.
Stellen Sie sich eine Kollegin vor, die dasselbe sagt
Stellen Sie sich vor, ein menschlicher Mitarbeiter legte Ihnen das freiwillig so offen: „Ich habe das ausgeliefert, ohne es vollständig zu testen.“ „Ich habe den üblichen Prozess umgangen, weil ich dachte, so ginge es schneller.“ „Ich habe gesagt, es sei fertig, aber ich habe nur den Idealfall getestet.“ „Ich bin mir nicht sicher, ob diese Annahme stimmt.“ „Ich habe hier abgekürzt und sollte das wohl nachholen.“
Wie oft passiert das, ohne dass jemand vorher in die Enge getrieben wurde? Die meisten Menschen handeln nicht böswillig. Sie sind eben Menschen. Wir sind darauf angelegt, uns zu schützen, Peinlichkeiten zu vermeiden und unsere Arbeit im bestmöglichen Licht zu zeigen. Wenn etwas ausgeliefert ist und zu funktionieren scheint, ist der Anreiz groß, nicht jede Abkürzung, jede Unsicherheit und jede fragwürdige Entscheidung von unterwegs von sich aus zu erwähnen.
Gerade in der Softwareentwicklung würde ich wetten, dass heute enorm viel Produktivcode läuft, weil jemand still eine Regel gebeugt, einen Test übersprungen, eine Anforderung missverstanden oder entschieden hat, „gut genug“ sei gut genug. Kaum eine dieser Geschichten wird je dokumentiert, außer es geht irgendwann etwas kaputt.
Auf die Formel kommt es nicht an
Wenn Claude Code also sagt: „Ehrliche Antwort: Das habe ich nicht überprüft“, ist meine Reaktion zunehmend: gut so. Genau dieses Verhalten will ich von einem KI-Agenten. Die Formel selbst macht den folgenden Satz nicht auf magische Weise wahr. KI-Systeme können nach wie vor missverstehen, was sie getan haben, Erklärungen halluzinieren oder ihr eigenes Verhalten selbstbewusst falsch beschreiben.
Der nützliche Teil ist die Norm dahinter. Ich will, dass Agenten mir sagen, was sie geprüft, was sie angenommen, was sie ausgelassen haben, wo sie abgekürzt haben und wie sicher sie sich beim Ergebnis sind. Ich will, dass sie zwischen „Ich weiß, dass das funktioniert“ und „Ich glaube, dass das funktioniert“ unterscheiden. Ich will, dass sie zugeben, wenn sie den schnellsten statt den sichersten Weg genommen haben.
Transparenz gehört zur Arbeit
Je mehr echte Arbeit KI-Agenten übernehmen, desto eher könnte diese operative Transparenz zu einem ihrer größten Vorteile werden. Sie gibt der Person, die für das Ergebnis geradesteht, eine klarere Wahl: den Kompromiss akzeptieren, mehr Prüfung verlangen oder die Arbeit stoppen, bevor aus einer Annahme ein Zwischenfall wird.
Wir verbringen viel Zeit mit der Frage, ob KI sich eher wie ein guter menschlicher Mitarbeiter verhalten kann. Vielleicht ist dies ein Fall, in dem die Menschen sich etwas von der KI abschauen sollten. Ein vertrauenswürdiger Kollege ist nicht jemand, der nie einen Fehler macht. Es ist jemand, der die Unsicherheit sichtbar macht, solange noch Zeit bleibt, etwas dagegen zu tun.