Das Journal23. November 20257 Min. Lesezeit
Sieht ein Gesicht überall dasselbe?
Basisemotionen, Konstruktion und der Streit um die Zwangswahl
1967 saß Paul Ekman im Hochland von Neuguinea, vor sich Angehörige der Fore, in der Hand einen Stapel Fotografien von Gesichtern westlicher Modelle. Er erzählte eine kurze Geschichte — „das ist ein Mann, dessen Kind gestorben ist“ — und ließ das passende Gesicht heraussuchen. Die Fore trafen überzufällig richtig, und aus dieser Szene wurde der Lehrbuchsatz der folgenden fünfzig Jahre: Emotionen haben Gesichter, und die Gesichter versteht man überall.
Zwei Details der Szene blieben lange klein gedruckt. Erstens war die Auswahl vorgegeben — die Fore konnten nur zwischen den Bildern wählen, die auf dem Tisch lagen. Zweitens funktionierte ein Paar nicht: Angst und Überraschung wurden verlässlich verwechselt, und die Angst-Geschichte musste eigens verlängert werden, damit sich die Verwechslung dämpfen ließ. Die Universalität war von Anfang an eine Frage des Verfahrens. Es dauerte nur ein halbes Jahrhundert, bis jemand das Verfahren selbst zum Gegenstand machte.
Das Programm der Basisemotionen
Aus der Feldarbeit wuchs ein Forschungsprogramm: eine kleine Zahl evolvierter Grundprogramme — Freude, Trauer, Wut, Angst, Ekel, Überraschung — mit je eigenem Gesichtsausdruck, eigener Physiologie, universell lesbar. Das Facial Action Coding System, das Ekman mit Wallace Friesen 1978 vorlegte, vermaß die beteiligten Gesichtsmuskeln und machte den Ausdruck erstmals zählbar. Aus dem Programm wuchsen Lügenerkennungs-Trainings, Sicherheitsprogramme an Flughäfen und ein jahrzehntelang gültiger Lehrbuchkonsens. Die Zeitschrift Time zählte Ekman 2009 zu den einflussreichsten Menschen der Welt.
Der historische Hintergrund erklärt, warum der Befund einschlug. William James, dessen Akte in diesem Archiv liegt, hatte 1884 die Reihenfolge umgedreht:
we feel sorry because we cry, angry because we strike, afraid because we tremble
Die Körperantwort kommt zuerst, das Gefühl ist ihre Wahrnehmung. Wundt sortierte das Erleben stattdessen in Dimensionen: Lust und Unlust, Erregung und Beruhigung. Ekmans sechs Arten schienen den Streit zugunsten diskreter Naturarten zu entscheiden — und zwar mit Daten aus dem Feld statt mit Introspektion.
Was das Zwangswahl-Format erzeugt
Der methodische Einspruch kam 1994 von James A. Russell, lange vor der großen Debatte. Er las die kulturvergleichenden Studien durch und zeigte, wie viel Übereinstimmung in der Anordnung steckt: gestellte Fotos von Modellen, die den Ausdruck übertrieben produzieren; eine Handvoll vorgegebener Antwortwörter; Versuchspersonen, die dieselben Gesichter mehrfach sehen und dabei lernen, welche Kategorien überhaupt zur Wahl stehen. Bei sechs Antwortmöglichkeiten liegt die Ratequote schon bei knapp 17 Prozent, und wer zwei Bilder sicher ausschließt, hebt sie ohne jede Emotionskenntnis weiter an.
Lisa Feldman Barrett hat diese Linie zu einer Gegentheorie ausgebaut. Ihr Ausgangspunkt bleibt die Messung: Wer Versuchspersonen sechs Wörter und sechs Gesichter vorlegt, baut die Antwortstruktur, die er findet — nimmt man die Wortlisten weg und lässt frei beschreiben, bricht die Übereinstimmung zwischen Kulturen drastisch ein. Als Himba in Namibia die Ausdrucksfotos frei sortieren durften, entstanden statt sechs sauberer Cluster Stapel nach sichtbarem Verhalten; Wut, Ekel und Trauer landeten zusammen. Beim freien Benennen westlicher Emotionslaute blieben vor allem angenehm gegen unangenehm und, schwächer, ruhig gegen erregt übrig: Wundts Dimensionen, nicht Ekmans Arten. Eine andere Forschergruppe legte Jugendlichen auf den Trobriand-Inseln das westliche Angstgesicht vor; die Mehrheit las darin eine Drohgebärde — nicht jemanden, der Angst hat, sondern jemanden, der sie macht.
Was der Körper nicht hergibt
Der zweite Angriff kam von der Physiologie. Wenn sechs Grundprogramme existieren, sollten sie sich im Körper abzeichnen. Eine Metaanalyse von Siegel und Kollegen wertete 2018 über 200 Studien mit mehr als 8.400 Personen aus und fand keine verlässlichen autonomen Fingerabdrücke: Herzrate, Hautleitwert und Atmung trennen Wut nicht sauber von Angst. Für das Gehirn gilt dasselbe — keine Amygdala ist „das Angstzentrum“, sondern eine Struktur, die bei vielem beteiligt ist und bei manchem fehlen darf, ohne dass Angst verschwindet.
Barretts Gegenentwurf, die Theorie konstruierter Emotionen, baut Gefühle aus zwei Zutaten: Kernaffekt — der körperliche Grundton aus Valenz und Erregung — plus Begriffe, die eine Kultur bereitstellt und ein Gehirn vorhersagend anwendet. Wut ist danach kein Schaltkreis, sondern eine erlernte Kategorie über körperliche Zustände in Situationen; real, wie Geld real ist, durch geteilte Übereinkunft.
Praktisch wurde der Zusammenprall, als es um Anwendungen ging. Die große Sammelprüfung von 2019, an der Barrett führend beteiligt war, attestierte der Emotionserkennung aus Gesichtern, was die Replikationskrise vielen Anwendungen attestiert hat: Die Zuordnung von Ausdruck zu Gefühl ist im Mittel schwach, kontextabhängig und kulturvariabel. Ein Stirnrunzeln bedeutet manchmal Wut, oft Konzentration, gelegentlich nichts. Für Software, die Bewerber oder Passagiere nach Gesichtern sortiert, ist das ein vernichtender Befund; das milliardenschwere Feld der „Emotion AI“ steht auf einer Prämisse, die die eigene Grundlagenforschung nicht mehr trägt. Das Flughafenprogramm SPOT, für dessen Inspektorenschulung Ekman 2007 mit gut einer Million Dollar unter Vertrag stand, hatten die Rechnungsprüfer des US-Kongresses schon 2013 abgeräumt: Die vorliegenden Belege stützten nicht, dass sich Gefährder an Verhaltensmerkmalen erkennen lassen — der Bericht empfahl, die Mittel zu streichen. Das ist ausdrücklich nicht dasselbe wie widerlegt, sondern unbelegt; der Unterschied ist genau der, den dieses Archiv sonst verteidigt.
Ein Wort zur Fairness gegenüber dem älteren Programm: Es war prüfbar gebaut, und das ist keine Kleinigkeit. Ekman legte Fotosätze, Kodiersysteme und Vorhersagen vor, an denen sich fünfzig Jahre Forschung abarbeiten konnten. Die Konstruktionstheorie verdankt ihre Munition den Daten, die das Basisemotionen-Programm erst erzeugte. Ein Programm, das seine eigene Widerlegung möglich macht, hat auch dann funktioniert, wenn sie eintritt.
| Prüfung | Jahr | Umfang | Was dabei herauskam |
|---|---|---|---|
| Ekman & Friesen, Feldarbeit | 1971 | Fore, Neuguinea | überzufällig richtig — bei vorgegebener Auswahl |
| Russell, Methodendurchsicht | 1994 | die Kulturvergleiche bis dahin | die Übereinstimmung steckt zum Teil in der Anordnung |
| Elfenbein & Ambady | 2002 | Metaanalyse | über dem Zufall, mit Heimvorteil der eigenen Gruppe |
| Gendron u. a., Himba | 2014 | freies Sortieren | Stapel nach Verhalten statt sechs Cluster |
| Crivelli u. a., Trobriand | 2016 | Angstgesicht vorgelegt | mehrheitlich als Drohgebärde gelesen |
| Siegel u. a. | 2018 | über 200 Studien, 8.400+ Personen | keine autonomen Fingerabdrücke |
Wo der Streit heute steht
Die ehrliche Bilanz ist unsymmetrisch verteilt. Gut belegt ist: Einige Ausdrücke werden überzufällig ähnlich gelesen, weit über dem Zufall und weit unter der Perfektion der Lehrbuchgrafiken. Kontext, Kultur und Methode verschieben die Werte massiv. Feste körperliche Fingerabdrücke einzelner Emotionen fehlen. Und die Dimensionsstruktur aus Valenz und Erregung taucht in praktisch jedem Datensatz auf.
Eine Metaanalyse von Hillary Anger Elfenbein und Nalini Ambady hat 2002 die Zwischenposition vermessen, die heute die meisten Fachvertreter einnehmen. Über viele Kulturvergleiche hinweg lagen die Trefferquoten deutlich über dem Zufall — und zugleich systematisch höher, wenn Ausdruck und Betrachter aus derselben kulturellen Gruppe stammten. Diesen Heimvorteil hat das Basisemotionen-Lager übernommen: Aus sechs Programmen wurden Familien mit kulturellen „Dialekten“; die starke Fassung verteidigt kaum noch jemand. Die Konstruktionstheorie wiederum hat ihr eigenes Prüfproblem. Sie ist so flexibel, dass Kritiker fragen, welche Beobachtung sie ausschließt — das Popper-Argument, das dieses Journal schon gegen die Traumdeutung im Einsatz sah.
Die deutsche Sprachgeschichte liefert der Konstruktionsseite nebenbei ihr schönstes Alltagsargument. Begriffe wie Schadenfreude, Fernweh oder Torschlusspanik ordnen Körperzustände zu Gefühlen, für die andere Sprachen keine Kategorie bereithalten — und wer das Wort kennt, kennt das Gefühl genauer. Dass Kategorien das Erleben schärfen, ist im Kleinen messbar: Trainings, die das Emotionsvokabular differenzieren, verändern nachweislich, wie fein Menschen ihre eigenen Zustände berichten und wie sie sie regulieren. Kein Beweis für die große Theorie, aber ein Hinweis, wo ihre Zutat „Begriff“ tatsächlich arbeitet.
Was bleibt
Die Antwort auf die Titelfrage lautet: teils. Ein Gesicht wird überall über dem Zufall gelesen und nirgends so eindeutig, wie es die sechs Lehrbuchkacheln nahelegen — und wie weit die Trefferquote unter der Eindeutigkeit liegt, hängt am Verfahren, nicht an der Emotion. Gesichert ist die Richtung des Befunds, nicht seine Größe. Strittig bleibt die Erklärung: ob am Ende Naturarten mit kulturellen Dialekten stehen oder Konstruktionen mit biologischen Zutaten, entscheiden Datentypen, die gerade erst entstehen — Feldaufnahmen statt gestellter Fotos, freie Beschreibung statt Auswahlliste, Verläufe statt Momentaufnahmen.
Im Alltag folgt daraus eine schlichte Regel: Ein Gesicht ist ein Hinweis, kein Urteil. Wer wissen will, wie es jemandem geht, fragt — und wo gefragt werden kann, ist jedes Ablesen die schlechtere Methode. Für Software, die Bewerbungsgespräche, Klassenzimmer oder Sicherheitsschleusen nach Gesichtern sortiert, gilt derselbe Satz mit Nachdruck, weil dort niemand widersprechen kann. Und für die Fachgeschichte bleibt eine Pointe: Der Streit ist bei James gelandet, von dem er ausging. Barretts vorhersagendes Gehirn, das Körperzustände kategorisiert, ist eine moderne Fassung seines Satzes, dass das Gefühl die Wahrnehmung der Körperantwort sei — angereichert um das, was James fehlte: Begriffe als Zutat, Vorhersage als Mechanismus. Das Kapitel, das die Lehrbücher als erledigt führten, war hundertvierzig Jahre lang nie entschieden worden.
Quellen und warum sie hier stehen
James, W. (1884). What is an emotion? Mind, 9, 188–205.
Der Ausgangspunkt und zugleich der Zielpunkt des Artikels: die umgedrehte Reihenfolge, aus der das Zitat stammt — und die Fassung, zu der Barretts vorhersagendes Gehirn hundertvierzig Jahre später zurückkehrt.
Ekman, P., & Friesen, W. V. (1971). Constants across cultures in the face and emotion. Journal of Personality and Social Psychology, 17, 124–129.
Die Feldarbeit bei den Fore, mit der der Artikel beginnt — samt der beiden klein gedruckten Details: vorgegebene Auswahl und die eigens verlängerte Angst-Geschichte.
Ekman, P., & Friesen, W. V. (1978). Facial Action Coding System. Consulting Psychologists Press.
Das Werkzeug, das den Ausdruck zählbar machte. Ohne es gäbe es weder das Forschungsprogramm noch die Daten, mit denen es später angegriffen wurde.
Russell, J. A. (1994). Is there universal recognition of emotion from facial expression? A review of the cross-cultural studies. Psychological Bulletin, 115(1), 102–141.
Der methodische Einspruch, dreizehn Jahre vor der großen Debatte: wie viel Übereinstimmung schon in der Anordnung steckt. Fundstelle der Ratequote in der Randnotiz.
Elfenbein, H. A., & Ambady, N. (2002). On the universality and cultural specificity of emotion recognition: A meta-analysis. Psychological Bulletin, 128(2), 203–235.
Die Vermessung der Zwischenposition, die heute die meisten einnehmen: deutlich über dem Zufall, und systematisch besser innerhalb der eigenen kulturellen Gruppe. Der „Heimvorteil“, aus dem die Dialekt-Fassung wurde.
Gendron, M., Roberson, D., van der Vyver, J. M., & Barrett, L. F. (2014). Perceptions of emotion from facial expressions are not culturally universal: Evidence from a remote culture. Emotion, 14, 251–262.
Die Himba-Studie: Was entsteht, wenn man die Wortliste wegnimmt und frei sortieren lässt — Stapel nach sichtbarem Verhalten statt nach Emotion. Das ist die geschwärzte Stelle des Artikels.
Gendron, M., Roberson, D., van der Vyver, J. M., & Barrett, L. F. (2014). Cultural relativity in perceiving emotion from vocalizations. Psychological Science, 25, 911–920.
Dasselbe für Laute statt Gesichter — und der Befund, dass beim freien Benennen Wundts Dimensionen übrig bleiben, nicht Ekmans Arten.
Crivelli, C., Russell, J. A., Jarillo, S., & Fernández-Dols, J.-M. (2016). The fear gasping face as a threat display in a Melanesian society. PNAS, 113, 12403–12407.
Der schärfste Einzelbefund: Auf den Trobriand-Inseln liest die Mehrheit im westlichen Angstgesicht keine Angst, sondern eine Drohung. Nicht ungenauer gelesen — anders herum.
Siegel, E. H., Sands, M. K., Van den Noortgate, W., Condon, P., Chang, Y., Dy, J., Quigley, K. S., & Barrett, L. F. (2018). Emotion fingerprints or emotion populations? A meta-analytic investigation of autonomic features of emotion categories. Psychological Bulletin, 144, 343–393.
Der Angriff von der Physiologie her: über 200 Studien, mehr als 8.400 Personen, keine verlässlichen autonomen Fingerabdrücke. Die Zahl unter dem Leitbild stammt von hier.
Barrett, L. F. (2017). How Emotions Are Made: The Secret Life of the Brain. Houghton Mifflin Harcourt.
Die ausgebaute Gegentheorie in Buchform — Kernaffekt plus Begriffe, und der Vergleich, Emotionen seien real, wie Geld real ist.
Barrett, L. F., Adolphs, R., Marsella, S., Martinez, A. M., & Pollak, S. D. (2019). Emotional expressions reconsidered: Challenges to inferring emotion from human facial movements. Psychological Science in the Public Interest, 20(1), 1–68.
Die große Sammelprüfung, an der die Anwendungsfrage hängt: Die Zuordnung von Ausdruck zu Gefühl ist im Mittel schwach, kontextabhängig und kulturvariabel.
Kashdan, T. B., Barrett, L. F., & McKnight, P. E. (2015). Unpacking emotion differentiation: Transforming unpleasant experience by perceiving distinctions in negativity. Current Directions in Psychological Science, 24(1), 10–16.
Belegt im Kleinen, was die große Theorie im Großen behauptet: dass ein feineres Emotionsvokabular verändert, wie Menschen ihre Zustände berichten und regulieren.
U.S. Government Accountability Office (2013). Aviation Security: TSA Should Limit Future Funding for Behavior Detection Activities. GAO-14-159.
Der Prüfbericht zum Flughafenprogramm SPOT. Wichtig für die Unterscheidung, auf die der Artikel besteht: Die Belege stützten die Erkennung nicht — das heißt unbelegt, nicht widerlegt.