Das Vier-Augen-Prinzip ist eine der ältesten Kontrollformen in Organisationen. In Banken zeichnen zwei Personen größere Zahlungen ab, in der Luftfahrt prüfen sich Kapitän und Copilot gegenseitig mit Checklisten, in der Medizin werden Medikamente vor der Gabe doppelt kontrolliert. Das Prinzip soll zwei Dinge verhindern: versehentliche Fehler und absichtlichen Missbrauch.
Es hat aber eine bekannte Schwäche. Wenn zwei Menschen für dieselbe Prüfung zuständig sind, verlässt sich leicht jeder auf den anderen. Die erste Person ist weniger gründlich, weil ja noch jemand schaut; die zweite ist es auch, weil die erste schon geschaut hat. Die Sozialpsychologie nennt diese Dynamik Verantwortungsdiffusion. Aus zwei halben Prüfungen wird keine ganze.
In den Studien zum Automation Bias zeigte sich außerdem, dass ein zweiter Mensch im Cockpit Fehler durch blindes Vertrauen in die Automatik nicht zuverlässig verhinderte. Beide folgten der Maschine.
Wirksam wird das Prinzip, wenn die zwei Prüfungen tatsächlich unterschiedlich sind: verschiedene Fragen, verschiedene Informationen oder eine unabhängige Einschätzung, bevor man die andere sieht. Und es braucht eine vernünftige Menge. Wer täglich hundert Vorgänge gegenzeichnet, zeichnet irgendwann nur noch ab (siehe Alert Fatigue).
Bei KI-Agenten wird das Vier-Augen-Prinzip oft als „Mensch prüft Maschine“ verstanden. Sinnvoller ist es, gezielt dort zwei unabhängige Prüfungen vorzusehen, wo Fehler schwer umkehrbar sind, und den Rest durch technische Grenzen abzusichern (siehe Forcing Function).