Zum Inhalt springen
AnamneseArchiv der Psychologie

Mindestens zwei Zeichen

Das Journal29. August 20267 Min. Lesezeit

Der Verdächtige in Reihe drei

Wie Gegenüberstellungen Erinnerungen formen, statt sie abzufragen

161 durch DNA widerlegte Verurteilungen: Alle diese Zeugen traten im Prozess sicher auf — bei der ersten Prüfung waren bis zu 57 % erkennbar unsicher.Zeichnung des Archivs

1984 stellte Gary L. Wells 192 Augenzeuginnen und Augenzeugen vor eine Gegenüberstellung, in der der Täter nachweislich nicht stand — eine leere Reihe. Erst danach bekamen sie die eigentliche Reihe zu sehen. Wer aus der leeren Reihe niemanden ausgewählt hatte, griff anschließend deutlich seltener zur falschen Person als die übrigen Zeugen. Die Zahl der richtigen Identifikationen sank durch den Zwischenschritt nicht nennenswert. Der Umweg hatte also zwei Sorten von Zeugen getrennt, die vorher gleich ausgesehen hatten.

Wells zog daraus den Schluss, der dieses Forschungsfeld seither ordnet: Wer vor einer Reihe steht, vergleicht nicht Gesicht mit Erinnerung, sondern Gesicht mit Gesicht. Gewählt wird, wer dem inneren Bild am ähnlichsten ist — relativ zu den anderen fünf. Diese Strategie funktioniert, solange der Täter dabei ist. Sie versagt lautlos, sobald er fehlt, denn der Ähnlichste von sechs ist immer jemand. Ob er dabei ist, weiß die Zeugin nie. Eine Belehrung allein behebt das nicht vollständig, wie Wells schon 1984 festhielt.

Die Frage, die niemand stellt

Sechs Gesichter stehen nebeneinander. Eines gehört dem Verdächtigen, fünf sind Füllpersonen. Die Zeugin weiß, dass die Polizei jemanden gefunden hat. Ohne dass sie ausgesprochen würde, enthält die Anordnung eine Frage: Welcher von ihnen ist es? Die wissenschaftlich korrekte Frage lautet anders: Ist der Täter überhaupt dabei?

Ob eine nacheinander gezeigte Reihe die relative Wahl behebt, ist offen. Der Bericht der National Academies hielt 2014 fest, dass die Überlegenheit eines der beiden Verfahren ungeklärt bleibt, und mahnte zur Vorsicht bei Verfahrensumstellungen. Unstrittig ist das Übrige: Füllpersonen müssen zur ursprünglichen Beschreibung passen, und der Verdächtige darf nicht als Einziger ein auffälliges Merkmal tragen. Eine Reihe mit fünf glattrasierten Männern und dem bärtigen Verdächtigen ist keine Gedächtnisprüfung, sondern ein Hinweis.

Was das Verfahren steuern kann und was nicht

Die begriffliche Ordnung dafür stammt von Wells aus dem Jahr 1978. Er trennte zwei Klassen von Einflüssen. Schätzvariablen sind die Umstände der Tat: Lichtverhältnisse, Entfernung, Dauer, Stress, die Frage, ob Zeugin und Täter derselben Bevölkerungsgruppe angehören. Sie lassen sich im Nachhinein allenfalls abschätzen, nicht verändern. Systemvariablen sind alles, was die Strafverfolgung selbst in der Hand hat: die Zusammenstellung der Reihe, die Belehrung, das Verhalten des Beamten, der Zeitpunkt der Befragung.

Die Unterscheidung klingt technisch und ist folgenreich. Sie verschiebt die Frage von „Wie gut ist das Gedächtnis dieser Zeugin?“ zu „Wie gut war das Verfahren, mit dem wir es abgefragt haben?“. Alles, was die Forschung empfehlen kann, betrifft die zweite Frage.

Neun Empfehlungen, vier davon von 1998

2020 legten sechs Fachleute im Auftrag der American Psychology-Law Society eine Neufassung des einflussreichen Empfehlungspapiers von 1998 vor; die Rückmeldungen aus Forschung und Justiz wurden über achtzehn Monate eingeholt. Am Ende standen neun Empfehlungen. Vier stammten unverändert aus dem Papier von 1998: die Auswahl der Füllpersonen, die Belehrung vor der Reihe, die doppelblinde Durchführung und die Erhebung eines Sicherheitsurteils.

Doppelblind heißt hier, was es im Experiment heißt: Der durchführende Beamte soll selbst nicht wissen, wer der Verdächtige ist. Fehlendes Wissen und standardisierte Anweisungen verhindern die kleinen Signale, die in jeder Untersuchung als Demand Characteristics firmieren — ein längerer Blick, eine Wiederholung, hörbare Erleichterung nach der Wahl. Und die Zeugin muss ausdrücklich hören, dass die gesuchte Person fehlen kann und die Ermittlung weitergeht, wenn sie niemanden erkennt.

Fünf Empfehlungen kamen 2020 hinzu. Die Polizei soll die Zeugin vor der Reihe befragen, statt erst danach. Es soll ein evidenzbasierter Verdacht vorliegen, bevor überhaupt jemand in eine Reihe gestellt wird. Das gesamte Verfahren soll auf Video aufgezeichnet werden. Wiederholte Identifikationsversuche mit derselben Zeugin und demselben Verdächtigen sind zu vermeiden. Und Einzelgegenüberstellungen — eine Person, vorgeführt ohne Vergleich — sollen möglichst unterbleiben und, wo sie unvermeidlich sind, besser durchgeführt werden.

Was Sicherheit wert ist

An diesem Punkt hat das Fach seine eigene Lehrmeinung revidiert. Jahrzehntelang galt in Gerichten wie in Lehrbüchern, die geäußerte Sicherheit einer Zeugin sage über die Richtigkeit ihrer Identifikation so gut wie nichts. Wixted und Wells zeigten 2017, dass dieser Pessimismus zwar vernünftig war, aber an die Verfahren gebunden, die ihn erzeugt hatten.

Unter dem, was sie „unversehrte“ Bedingungen nennen — erste, unkontaminierte Prüfung, faire Reihe, kein Einfluss des Durchführenden, sofort erhobenes Sicherheitsurteil —, hängen Sicherheit und Genauigkeit bei Erwachsenen eng zusammen. Identifikationen, die mit hoher Sicherheit erfolgen, sind dann bemerkenswert oft richtig; Identifikationen, die schon beim ersten Mal zögerlich erfolgen, sind fehleranfällig. Beides gilt nur unter diesen Bedingungen. Ist die Reihe unfair zusammengesetzt, ist auch die hochsichere Identifikation kein Verlass mehr.

Daraus folgt nicht, dass man Zeugen mehr glauben soll, sondern dass man sie früher fragen muss. Rückmeldung wie „Gut, Sie haben unseren Verdächtigen gewählt“ erhöht das Vertrauen in die eigene Erinnerung, ohne deren ursprüngliche Genauigkeit zu verändern. Bis zum Prozess wird aus einem vorsichtigen „Ich glaube, Nummer drei“ ein fester Blick und ein „Ich werde dieses Gesicht nie vergessen“. Das Gericht sieht die spätere Sicherheit. Die aussagekräftige ist die erste, wörtlich protokollierte, unverstärkte.

Diesen Vorgang haben Gary Wells und Amy Bradfield 1998 erstmals isoliert. Ihre 352 Versuchspersonen sahen ein Überwachungsvideo und suchten den Täter aus einem Fotobogen, in dem er gar nicht enthalten war; jede Identifikation war also falsch. Anschließend hörte ein Teil der Befragten eine Bestätigung, ein Teil eine Korrektur, ein Teil nichts. Die Bestätigung veränderte danach nicht nur die angegebene Sicherheit, sondern auch die Erinnerung daran, wie gut die Sicht gewesen sei, wie klar das Bild und wie schnell die Entscheidung fiel. Bei denen, die jeden Einfluss der Rückmeldung bestritten, fiel der Effekt ebenso stark aus wie bei den übrigen. Der Oberste Gerichtshof von Oregon hat den Kern davon 2012 in einen Satz gefasst, den die Forschung seither zitiert:

As a result, the danger of confirming feedback lies in its potential to increase the appearance of reliability without increasing reliability itself.

Oregon v. Lawson (2012), S. 21, zitiert nach Steblay, Wells und Douglass, The Eyewitness Post-Identification Feedback Effect 15 Years Later (2014) [Die Gefahr bestätigender Rückmeldung liegt daher darin, dass sie den Anschein von Verlässlichkeit erhöhen kann, ohne die Verlässlichkeit selbst zu erhöhen.]

Wie weit die Lücke zwischen Anschein und Sache aufgehen kann, zeigt die Auswertung von 161 durch DNA widerlegten Verurteilungen. Alle diese Zeuginnen und Zeugen traten im Prozess überzeugt auf. Bei der ersten Identifikation waren sie es mehrheitlich nicht.

161 DNA-Exonerationen, Zeugen mit sicherer Aussage im ProzessAnteil
wählte beim ersten Versuch nicht den späteren Angeklagten40 %
räumte damals Unsicherheit ein21 %
gab an, das Gesicht nicht gesehen zu haben9 %
bei der ersten Prüfung erkennbar unsicher, zusammenbis zu 57 %

Wenn das Verfahren den Beweis erzeugt

Wiederholte Identifikationen sind aus demselben Grund problematisch. Wer zunächst ein Foto sieht und dieselbe Person später in einer Reihe auswählt, kann sich an das erste Foto statt an die Tat erinnern. Das rekonstruktive Gedächtnis arbeitet mit dem Material, das ihm vorliegt, und unterscheidet dabei nicht zuverlässig zwischen erlebten und nachträglich gesehenen Bildern. Die zweite Identifikation bestätigt dann nicht die erste, sondern sie wiederholt sie.

Genau das ist der Punkt, an dem eine Gegenüberstellung aufhört, eine Messung zu sein. Sie ist ein psychologisches Experiment mit einem einzigen Versuchsdurchgang. Der Versuchsleiter besitzt eine Hypothese, die Teilnehmerin nicht. Die abhängige Variable ist ihre Wahl. Wer das Verfahren schlecht gestaltet, misst nicht bloß schlecht — er verändert den Gegenstand, den er messen wollte, und produziert anschließend die Bestätigung dafür.

Was bleibt

Die Forschung sagt nicht, Augenzeugen seien unzuverlässig. Sie sagt etwas Unbequemeres: Die Zuverlässigkeit einer Identifikation ist keine Eigenschaft der Zeugin, sondern zu großen Teilen ein Produkt der Erhebungsbedingungen — und die liegen bei der Behörde. Ein fairer Aufbau, ein blinder Durchführender, eine frühe Befragung, ein aufgezeichneter Ablauf, keine zweite Reihe mit derselben Person und ein sofort dokumentiertes Sicherheitsurteil bewahren, was die Zeugin tatsächlich erinnert. Fehlt das, ist der Schaden nicht rückgängig zu machen, weil die Erinnerung selbst überschrieben wurde.

Im Alltag erkennt man das Muster an einem Detail: Wenn jemand seine Sicherheit erst nach einer Bestätigung erhöht, ist die Bestätigung die Quelle und nicht das Gedächtnis. Das gilt im Vernehmungszimmer und außerhalb. Wer wissen will, was jemand wirklich erinnert, muss vor der ersten Rückmeldung fragen — danach misst er seine eigene Rückmeldung mit.

Quellen und warum sie hier stehen

  1. Wells, G. L., Kovera, M. B., Douglass, A. B., Brewer, N., Meissner, C. A., & Wixted, J. T. (2020). Policy and procedure recommendations for the collection and preservation of eyewitness identification evidence. Law and Human Behavior, 44(1), 3–36.

    Das Papier der American Psychology-Law Society mit den neun Empfehlungen; Beleg dafür, welche vier Punkte unverändert aus dem Papier von 1998 stammen und welche fünf 2020 hinzukamen.

  2. National Research Council (2014). Identifying the Culprit: Assessing Eyewitness Identification. Washington: National Academies Press.

    Der Bericht der National Academies — Beleg dafür, dass die Überlegenheit von simultaner oder sequenzieller Reihe ungeklärt bleibt, und die vorsichtigste verfügbare Zusammenfassung des Forschungsstands.

  3. Wixted, J. T., & Wells, G. L. (2017). The relationship between eyewitness confidence and identification accuracy: A new synthesis. Psychological Science in the Public Interest, 18(1), 10–65.

    Die Revision der Lehrmeinung zum Sicherheitsurteil, samt der Bedingungen — „pristine“, unversehrt —, unter denen Sicherheit und Genauigkeit zusammenhängen.

  4. Wells, G. L. (1978). Applied eyewitness-testimony research: System variables and estimator variables. Journal of Personality and Social Psychology, 36(12), 1546–1557.

    Die Unterscheidung von Schätz- und Systemvariablen, auf der die gesamte Empfehlungspraxis aufbaut.

  5. Wells, G. L. (1984). The psychology of lineup identifications. Journal of Applied Social Psychology, 14(2), 89–103.

    Das Experiment mit der leeren Reihe und die Theorie der relativen Wahl — die Eröffnung des Artikels stammt von hier.

  6. Wells, G. L., & Bradfield, A. L. (1998). „Good, you identified the suspect“: Feedback to eyewitnesses distorts their reports of the witnessing experience. Journal of Applied Psychology, 83(3), 360–376.

    Der Erstnachweis des Rückmeldungseffekts: 352 Zeugen, sämtlich Fehlidentifikationen, weil der Täter im Fotobogen fehlte.

  7. Steblay, N. K., Wells, G. L., & Douglass, A. B. (2014). The eyewitness post-identification feedback effect 15 years later: Theoretical and policy implications. Psychology, Public Policy, and Law, 20(1), 1–18.

    Die Metaanalyse über rund 7.000 Teilnehmende; zugleich die Fundstelle des zitierten Satzes aus <em>Oregon v. Lawson</em> und der Auswertung der 161 DNA-Exonerationen.

  8. Garrett, B. L. (2011). Convicting the Innocent: Where Criminal Prosecutions Go Wrong. Cambridge: Harvard University Press.

    Die Auswertung von 161 durch DNA widerlegten Verurteilungen, aus der die Zahlen des Datenblocks stammen.