Zum Hauptinhalt springen

Kapitänssyndrom

Warum auf jede Frage eine Antwort kommt – auch auf die, die sich aus den vorliegenden Angaben gar nicht beantworten lässt

„Auf einem Schiff sind 26 Schafe und 10 Ziegen. Wie alt ist der Kapitän?“ Die Aufgabe ist seit über vierzig Jahren ein Klassiker der Didaktikforschung, weil ein erstaunlicher Anteil von Kindern sie beantwortet: 36. Der Witz daran ist nicht, dass Kinder rechnen, was sich rechnen lässt. Der Witz ist, dass Erwachsene in Besprechungen dasselbe tun, nur mit Auslastungsprognosen und Ursachenerklärungen. Und dass es einen einzigen Grund dafür gibt, der nichts mit Können zu tun hat.


Die Aufgabe, die keine ist

Der Ursprung liegt weiter zurück, als man vermutet. Gustave Flaubert schrieb am 16. Mai 1841 in einem Brief an seine Schwester Caroline eine Aufgabe über ein Schiff, das mit Baumwolle Boston verlässt – ausgestattet mit vielen Angaben zu Ladung, Wind und Kurs, und der Frage nach dem Alter des Kapitäns. Es war als Scherz gemeint.

Zum Forschungsgegenstand wurde die Sache erst in den 1980er Jahren, als eine Arbeitsgruppe am französischen Institut für Mathematikdidaktik in Grenoble Kindern der zweiten und dritten Klasse genau eine solche Aufgabe vorlegte. Der Großteil der befragten Kinder gab ein Rechenergebnis an. Die französische Mathematikdidaktikerin Stella Baruk machte den Fall 1985 mit ihrem Buch „L’âge du capitaine“ international bekannt, und seither heißt das Phänomen so.

Wichtig für die Einordnung: Die häufig kursierende Zahlenangabe zu dieser ersten Erhebung ist in der Sekundärliteratur uneinheitlich überliefert. Wir verzichten deshalb hier auf eine genaue Prozentzahl für die Ursprungsstudie. Die belastbaren Zahlen liefert die spätere, systematische Forschung – und die ist eindeutig genug.

Was daraus an belastbarer Forschung geworden ist

Lieven Verschaffel, Erik De Corte und Sabien Lasure haben 1994 in Learning and Instruction eine Untersuchung vorgelegt, die den Kern des Problems präzise fasst. Sie legten Kindern Aufgaben vor, die sich nur unter Einbezug von Alltagswissen sinnvoll beantworten lassen – oder gar nicht.

Ein Beispiel: „Ein Seil ist zwölf Meter lang. Wie viele Stücke von eineinhalb Metern kann man daraus schneiden?“ Rein rechnerisch ergibt das acht. In der Wirklichkeit kommt es darauf an, ob beim Schneiden etwas verloren geht, ob das Seil an den Enden verwendbar ist und so fort.

Das Ergebnis: Nur rund 17 Prozent aller Reaktionen auf diese problematischen Aufgaben ließen sich als realistisch einstufen. Bei den meisten Einzelaufgaben lag der Anteil zwischen null und 17 Prozent, nur bei zwei Aufgaben deutlich höher, bei 49 und 59 Prozent.

Der Befund wurde in mehreren Ländern wiederholt – unter anderem in Japan, Deutschland, der Schweiz, Nordirland und Venezuela – und fiel jeweils ähnlich aus. Es handelt sich also nicht um eine Eigenheit belgischer Fünftklässler.

In der Fachsprache heißt das Aussetzung des Sinnverstehens. Und das ist die genauere Beschreibung als jedes Wort über mangelndes Nachdenken: Die Kinder denken nicht weniger. Sie schalten einen Teil ihres Wissens ab, weil die Situation es nahelegt.

Warum die Kinder das tun – und warum es dieselbe Ursache ist wie bei Erwachsenen

Der Grund liegt nicht in den Kindern, sondern in dem, was sie über die Situation gelernt haben. In der Schule hat jede Aufgabe eine Lösung. Wer eine Textaufgabe bekommt, bekommt sie, weil sie lösbar ist. Es hat sich noch nie gelohnt zu sagen: Das geht aus den Angaben nicht hervor.

Die Kinder beantworten also nicht die Frage. Sie beantworten die Situation.

Genau das ist der Punkt, an dem die Sache aus dem Klassenzimmer heraus und in jede Leitungsrunde hinein reicht. Denn in Betrieben gilt dieselbe unausgesprochene Regel: Wer gefragt wird, antwortet. Eine Nachfrage ohne Antwort wirkt wie fehlende Kompetenz, nicht wie Redlichkeit.

Der Beleg bei Erwachsenen: Meinungen zu einem Gesetz, das es nicht gab

George Bishop, Robert Oldendick und Alfred Tuchfarber haben 1980 im Public Opinion Quarterly eine Untersuchung veröffentlicht, die man kennen sollte, bevor man das nächste Mal eine Runde nach Einschätzungen fragt.

Sie befragten Menschen zu einem Gesetz namens „Public Affairs Act of 1975“. Dieses Gesetz existierte nicht. Es war frei erfunden.

Rund ein Drittel der Befragten gab dazu eine Meinung ab.

Und jetzt kommt der Teil, der die Sache von einer Kuriosität in ein Werkzeug verwandelt. Sobald in der Frage ausdrücklich angeboten wurde, dass man dazu auch keine Meinung haben könne, sank der Anteil auf rund zehn Prozent.

Dieselben Menschen. Dieselbe erfundene Sache. Ein anderer Fragesatz.

Die Schlussfolgerung ist unbequem und außerordentlich brauchbar: Der Anteil der Scheinantworten hängt nicht in erster Linie davon ab, wen man fragt. Er hängt davon ab, wie man fragt. Wer die Nicht-Antwort nicht anbietet, bekommt sie nicht.

Der zweite Mechanismus: Wir halten uns für erklärungsfähiger, als wir sind

Es gibt einen zweiten, unabhängigen Grund, warum in Besprechungen Erklärungen entstehen, die niemand belegen kann. Leonid Rozenblit und Frank Keil haben ihn 2002 in Cognitive Science beschrieben und Illusion der Erklärungstiefe genannt.

Das Vorgehen ist bestechend einfach. Menschen schätzen zunächst ein, wie gut sie verstehen, wie etwas funktioniert. Danach werden sie gebeten, es tatsächlich im Detail zu erklären. Anschließend schätzen sie sich erneut ein – und liegen deutlich niedriger.

Das Versprechen des eigenen Verstehens hält der eigenen Erklärung nicht stand. Bemerkenswert daran ist die Spezifität: Die Illusion ist nach den Autoren deutlich stärker bei erklärendem Wissen als bei Tatsachenwissen, bei Abläufen oder bei Erzählungen. Wer weiß, wie viele Zimmer sein Haus hat, weiß es wirklich. Wer meint zu wissen, warum die Auslastung im November gesunken ist, meint es oft nur.

Beides zusammen ergibt die Mechanik des Kapitänssyndroms im Betrieb. Die Situation verlangt eine Antwort, und das Gefühl, eine zu haben, ist zuverlässig vorhanden – auch wenn die Grundlage fehlt.

Wie das im Haus aussieht

Sechs Fragen, die in Hotelbetrieben regelmäßig gestellt und ebenso regelmäßig beantwortet werden, obwohl die vorliegenden Angaben das nicht hergeben.

→  „Warum war der Oktober schlechter als im Vorjahr?“ Es gibt eine Antwort. Meistens das Wetter, eine Baustelle oder ein Wettbewerber. Geprüft wurde keine davon.

→  „Wie viele Zimmer verkaufen wir im März?“ Es kommt eine Zahl. Sie beruht auf dem Vorjahr, obwohl im Vorjahr eine Messe stattfand, die es diesmal nicht gibt.

→  „Warum hat die Kollegin gekündigt?“ Es kommt ein Grund. Meistens das Gehalt. Gefragt wurde sie nicht, und wenn doch, im Austrittsgespräch.

→  „Wie zufrieden ist das Team gerade?“ Es kommt eine Einschätzung, gestützt auf die drei Personen, mit denen die Führungskraft am meisten spricht.

→  „Bringt die neue Frühstückskarte etwas?“ Es kommt ein Urteil, obwohl gleichzeitig der Preis geändert und ein Lieferant gewechselt wurde.

→  „Wie lange brauchen wir für die Einarbeitung?“ Es kommt eine Wochenzahl, die aus einem einzigen Fall stammt, an den sich jemand erinnert.

Keine dieser Antworten ist gelogen. Alle sind gut gemeint. Und alle haben dieselbe Eigenschaft: Sie sind aus dem verfügbaren Material nicht ableitbar.

Der teuerste Fall ist immer die Ursachenfrage

Unter allen sechs Beispielen ist eines gefährlicher als die anderen, und das ist das Warum.

Eine falsche Prognose bemerkt man. Der März kommt, die Zahl stimmt nicht, man lernt etwas. Eine falsche Ursache bemerkt man nicht, weil man auf ihrer Grundlage handelt und danach nie erfährt, was passiert wäre, wenn man etwas anderes getan hätte.

Wenn die Kündigung einer Mitarbeiterin dem Gehalt zugeschrieben wird, obwohl der eigentliche Grund die Dienstplanung war, dann folgt daraus eine Gehaltsanpassung. Die kostet Geld, sie wirkt nicht, und die nächste Kündigung kommt trotzdem – nur wird sie dann noch einmal dem Gehalt zugeschrieben, weil die Anpassung ja offenbar zu klein war.

Das ist die eigentliche Rechnung des Kapitänssyndroms. Nicht die falsche Antwort, sondern die Maßnahme, die daraus folgt.

Das ist nicht Überkonfidenz und nicht der HIPPO-Effekt

Zwei verwandte Themen dieser Reihe liegen nahe, beschreiben aber etwas anderes.

Beim Überkonfidenzeffekt gibt es eine Grundlage, und die Einschätzung darauf ist zu sicher: Die Spanne, die jemand angibt, ist zu eng. Beim Kapitänssyndrom gibt es keine Grundlage. Die Antwort ist nicht zu präzise, sie ist unbegründet.

Beim HIPPO-Effekt liegen Belege vor und werden von einer Einschätzung verdrängt. Hier liegen keine Belege vor, und die Lücke fällt niemandem auf, weil die Antwort so klingt wie eine mit Grundlage.

Praktisch ist die Unterscheidung wichtig, weil die Gegenmaßnahmen verschieden sind. Gegen Überkonfidenz hilft, Spannen anzugeben und Prognosen nachzuhalten. Gegen den HIPPO-Effekt hilft eine andere Sprechreihenfolge. Gegen das Kapitänssyndrom hilft nur eines: die Frage anders zu stellen.

Sechs Werkzeuge, die im Alltag funktionieren

→  Die Nicht-Antwort ausdrücklich anbieten. „Wenn du das nicht sagen kannst, ist das eine vollständige Antwort.“ Ein Satz, den man der Frage voranstellt. Nach dem Befund von Bishop und Kollegen ist das der wirksamste Eingriff überhaupt – dort sank der Anteil der Scheinantworten von rund einem Drittel auf rund zehn Prozent, allein durch das Angebot.

→  Die Rückfrage nach dem, was fehlt. Statt „Warum war der Oktober schlecht?“ die Frage: „Was müssten wir wissen, um das beantworten zu können?“ Sie führt fast immer zu einer kurzen, konkreten Liste – und die ist meistens beschaffbar.

→  Antwort mit Grundlage. Eine einfache Hausregel: Wer eine Zahl nennt, nennt in einem halben Satz, woher sie kommt. „Vierzig Prozent, aus dem Vorjahresmonat.“ Das dauert drei Sekunden und macht sofort sichtbar, was gerade auf dem Tisch liegt.

→  Die Erklärprobe. Wo jemand eine Ursache nennt, einmal bitten, den Weg von der Ursache zur Wirkung in drei Schritten auszuführen. Das ist keine Prüfung, sondern genau das Verfahren, mit dem Rozenblit und Keil die Erklärungslücke sichtbar gemacht haben. Es wirkt auch bei einem selbst.

→  Die Spanne statt der Zahl. Wo eine Prognose verlangt wird, eine Spanne nennen lassen und dazu, was sie an das obere und was an das untere Ende treiben würde. Wer keine Spanne angeben kann, hat keine Prognose, sondern eine Vermutung.

→  Das Fragen-Audit. Einmal im Quartal die zehn Fragen aufschreiben, die in Ihren Runden am häufigsten gestellt werden, und hinter jede setzen, woraus sie beantwortet werden könnte. Bei einigen wird dort ein Strich stehen. Das sind die Fragen, die Sie derzeit systematisch falsch beantwortet bekommen.

Wie Sie fragen, ohne eine Antwort zu erzwingen

Der wirksamste Hebel liegt nicht bei den Antwortenden, sondern in der Frage. Drei Unterschiede machen fast die ganze Wirkung aus.

Erstens: Eine Frage, die im Raum gestellt wird und auf die alle schauen, erzeugt mehr Antwortdruck als dieselbe Frage schriftlich mit einem Tag Zeit. Was Sie wirklich wissen wollen, fragen Sie am besten nicht spontan.

Zweitens: Eine Frage, die eine Zahl verlangt, bekommt eine Zahl. Wer eine ehrliche Antwort will, fragt nach der Grundlage mit: „Was ist deine Einschätzung, und worauf stützt sie sich?“ Das ist ein Wort mehr und ein völlig anderer Auftrag.

Drittens: Wer selbst regelmäßig „Das weiß ich nicht“ sagt, bekommt es auch zu hören. Wer es nie sagt, hat es im Haus abgeschafft, ohne es je verboten zu haben. Das ist die unbequemste Stelle des ganzen Themas, weil sie nichts kostet und trotzdem selten eingelöst wird.

Ein tragfähiger Einstieg in der Runde klingt etwa so: „Ich stelle gleich eine Frage, auf die es vielleicht keine Antwort gibt. Wenn wir sie nicht beantworten können, ist das das Ergebnis, und dann klären wir, was uns dafür fehlt.“

Was in den ersten Wochen passiert

→  Die erste Reaktion ist Irritation. Wer jahrelang Antworten geliefert hat, hält die neue Erlaubnis zunächst für eine Prüfung. Das legt sich nach etwa zwei Runden.

→  Danach kommt eine Phase, in der auffallend viel nicht beantwortet wird. Das wirkt wie ein Rückschritt und ist der eigentliche Fortschritt: Sie sehen zum ersten Mal, wie groß der Anteil war.

→  Nach etwa vier Wochen entstehen die ersten Listen mit dem, was fehlt. Ab hier wird das Thema praktisch, weil sich die meisten dieser Lücken mit geringem Aufwand schließen lassen.

→  Nach einem Quartal ändert sich die Sprache in den Runden. Aus „Das liegt am Wetter“ wird „Wir vermuten das Wetter, geprüft haben wir es nicht“. Der Satz ist länger und um einiges wertvoller.

Drei Einwände, die berechtigt sind

„Dann entscheidet bei uns bald niemand mehr.“ Der Einwand trifft, wenn aus der Erlaubnis zur Nicht-Antwort eine Erlaubnis zur Nicht-Entscheidung wird. Beides ist nicht dasselbe. Man kann sehr wohl entscheiden und dabei sagen, dass die Grundlage dünn ist. Das ist sogar die redlichere Form.

„Manchmal muss man einfach eine Zahl nennen.“ Stimmt. Banken, Steuerberatung, Budgetplanung verlangen Zahlen, und Warten ist keine Option. Der Vorschlag lautet nicht, keine Zahl zu nennen, sondern sie zu kennzeichnen. Eine Schätzung, die als Schätzung im Protokoll steht, richtet keinen Schaden an. Eine, die als Erhebung gelesen wird, schon.

„Mein Team traut sich das nicht.“ Wahrscheinlich zutreffend, und es ist kein Grund gegen das Vorgehen, sondern der Grund dafür. Der Befund von Bishop und Kollegen zeigt ja gerade, dass es an der Frage liegt und nicht an den Befragten. Wer das Angebot macht, verändert das Ergebnis, ohne irgendjemanden ändern zu müssen.

Fünf Lücken, die sich mit einem Feld schließen lassen

Der häufigste Einwand gegen dieses Thema lautet, man könne ja nicht für jede Frage eine Erhebung aufsetzen. Das stimmt, ist aber selten nötig. Wer die Listen anschaut, die entstehen, sobald in Runden ehrlich benannt wird, was fehlt, findet dort meistens sehr kleine Dinge.

→  Stornogründe. In den meisten Häusern wird die Stornierung erfasst, der Grund nicht. Ein Auswahlfeld mit fünf Einträgen und einem Freitextfeld beantwortet nach einem Quartal eine Frage, die vorher jedes Mal geraten wurde.

→  Der wirkliche Kündigungsgrund. Das Austrittsgespräch liefert selten belastbare Auskünfte, weil es zum falschen Zeitpunkt und mit der falschen Person stattfindet. Eine kurze schriftliche Nachfrage sechs bis acht Wochen nach dem Ausscheiden bringt erfahrungsgemäß deutlich mehr, weil die Person dann nichts mehr zu verlieren hat.

→  Wann eine Einarbeitung tatsächlich abgeschlossen war. Zwei Datumsfelder statt einer Wochenzahl aus der Erinnerung: Eintritt und der Tag, an dem die Person die erste Schicht ohne Rückfragen geführt hat. Nach fünf Fällen haben Sie eine Größenordnung statt einer Anekdote.

→  Was gleichzeitig geändert wurde. Eine einzige Zeile in einem gemeinsamen Kalender, in die jede Änderung an Preis, Karte, Lieferant oder Ablauf mit Datum eingetragen wird. Ohne diese Zeile lässt sich hinterher nie sagen, was gewirkt hat, weil in Häusern selten nur eine Sache auf einmal verändert wird.

→  Womit sich eine Prognose vergleichen lässt. Die eigene Schätzung vor dem Monat aufschreiben, nicht nur das Ergebnis danach. Ohne den ersten Wert gibt es keine Auswertung, sondern nur die nachträgliche Überzeugung, es ungefähr so erwartet zu haben.

Allen fünf Punkten ist gemeinsam, dass sie nichts kosten außer der Entscheidung, sie einzuführen, und dass sie erst nach einigen Wochen etwas liefern. Genau deshalb werden sie selten eingeführt: Der Aufwand fällt sofort an, der Nutzen später.

Der brauchbare Zeitpunkt ist deshalb nicht der, an dem die Frage gestellt wird, sondern der davor. Wer im Januar ein Feld ergänzt, kann im April eine Frage beantworten, die er sonst wieder geraten hätte.

Fazit

Das Kapitänssyndrom ist kein Denkfehler und kein Zeichen mangelnder Sorgfalt. Es ist eine erlernte Reaktion auf eine Situation, in der eine Antwort erwartet wird. Kinder lernen das in der Schule, weil dort jede Aufgabe lösbar ist. Erwachsene lernen es im Betrieb, weil dort jede Frage beantwortet wird.

Die Forschung liefert dazu zwei Zahlen, die man sich merken kann. Nur rund 17 Prozent der Reaktionen von Kindern auf unlösbare Aufgaben waren realistisch. Und rund ein Drittel erwachsener Befragter hatte eine Meinung zu einem Gesetz, das es nicht gab – bis man ihnen ausdrücklich anbot, keine zu haben. Dann war es noch etwa ein Zehntel.

Darin steckt die ganze Gegenmaßnahme. Sie liegt nicht bei den Menschen, die antworten. Sie liegt in der Frage. Und der Satz, der sie umsetzt, ist kurz genug für jede Runde: Wenn wir das nicht beantworten können, ist das das Ergebnis.

Quellen und Anmerkungen

·  Verschaffel, L., De Corte, E. & Lasure, S. (1994). Realistic considerations in mathematical modeling of school arithmetic word problems. Learning and Instruction, 4, 273–294. — Nur rund 17 Prozent aller Reaktionen auf die problematischen Aufgaben waren als realistisch einzustufen; bei den meisten Einzelaufgaben zwischen null und 17 Prozent, bei zwei Aufgaben 49 und 59 Prozent. Der Befund wurde unter anderem in Japan, Deutschland, der Schweiz, Nordirland, Belgien und Venezuela repliziert.

·  Bishop, G. F., Oldendick, R. W. & Tuchfarber, A. J. (1980). Pseudo-opinions on public affairs. Public Opinion Quarterly, 44, 198–209. — Rund ein Drittel der Befragten äußerte eine Meinung zum frei erfundenen „Public Affairs Act of 1975“; wurde in der Frage ausdrücklich die Möglichkeit angeboten, keine Meinung zu haben, sank der Anteil auf rund zehn Prozent.

·  Rozenblit, L. & Keil, F. (2002). The misunderstood limits of folk science: An illusion of explanatory depth. Cognitive Science, 26(5), 521–562. — Selbsteingeschätztes Verständnis fällt deutlich ab, nachdem Personen gebeten wurden, den Gegenstand tatsächlich im Detail zu erklären. Die Illusion ist bei erklärendem Wissen deutlich stärker ausgeprägt als bei Tatsachenwissen, Abläufen oder Erzählungen.

·  Baruk, S. (1985). L’âge du capitaine: De l’erreur en mathématiques. Paris: Seuil. — Das Buch, das dem Phänomen seinen Namen gab. Die zugrunde liegende Erhebung stammt von einer Arbeitsgruppe des Instituts für Mathematikdidaktik (IREM) in Grenoble mit Kindern der zweiten und dritten Klasse.

·  Flaubert, G. (1841). Brief an seine Schwester Caroline vom 16. Mai 1841. — Früheste bekannte Fassung der Aufgabe, als Scherz gemeint: ein Schiff verlässt mit Baumwolle Boston, es folgen zahlreiche Angaben zu Ladung und Kurs, gefragt wird nach dem Alter des Kapitäns.

·  Anmerkung zur Ursprungserhebung: Die in Sekundärquellen kursierenden Zahlenangaben zur ersten Grenobler Erhebung sind uneinheitlich überliefert. Dieser Artikel verzichtet deshalb bewusst auf eine Prozentzahl für diese Studie und stützt die quantitative Aussage ausschließlich auf Verschaffel, De Corte und Lasure (1994).

·  Abgrenzung zu zwei Vorthemen dieser Reihe: Beim Überkonfidenzeffekt liegt eine Grundlage vor und die Sicherheitsspanne ist zu eng. Beim HIPPO-Effekt liegen Belege vor und werden von einer Einschätzung verdrängt. Beim Kapitänssyndrom fehlt die Grundlage, und die Antwort klingt dennoch wie eine mit Grundlage.

·  Als Praxisableitung und nicht als Studienergebnis gekennzeichnet: die sechs Beispiele aus dem Hausbetrieb, die sechs Werkzeuge einschließlich Erklärprobe und Fragen-Audit, die drei Unterschiede beim Fragenstellen und der Verlauf über die ersten Wochen einschließlich der Vier-Wochen-Marke.

·  Anmerkung zur Übertragbarkeit: Verschaffel und Kollegen (1994) untersuchten Grundschulkinder, Bishop und Kollegen (1980) eine Bevölkerungsbefragung in den USA, Rozenblit und Keil (2002) Laborstudien mit Erwachsenen. Keine dieser Arbeiten wurde in Betrieben erhoben. Übertragbar ist der Mechanismus, nicht der einzelne Zahlenwert.