Intelligenztest

Dr. med. NonnenmacherMedizinische Expertise: Dr. med. Nonnenmacher
Qualitätssicherung: Dipl.-Biol. Elke Löbel, Dr. rer. nat. Frank Meyer
Letzte Aktualisierung am: 2. September 2026
Dieser Artikel wurde unter Maßgabe medizinischer Fachliteratur und wissenschaftlicher Quellen geprüft.

Sie sind hier: Startseite Behandlungen Intelligenztest

Unter einem Intelligenztest wird ein wissenschaftliches Instrument verstanden, welches dazu dient, den Intelligenzquotienten einer Testperson zu ermitteln. Im Folgenden wird der Begriff des Intelligenztests genauer definiert und sein Anwendungsgebiet und seine Anwendungsverfahren im Hinblick auf Funktion, Wirkung und Ziele beschrieben. Des Weiteren wird auf Risiken, Nebenwirkungen, Gefahren und Besonderheiten von Intelligenztests eingegangen.

Inhaltsverzeichnis

Was ist der Intelligenztest?

Intelligenztest
Unter dem Begriff Intelligenztest ist ein psychologisches Verfahren zu verstehen, welches der Ermittlung der Intelligenz einer Person dient.

Unter dem Begriff Intelligenztest ist ein psychologisches Verfahren zu verstehen, welches der Ermittlung der Intelligenz einer Person dient. Dies geschieht mittels verschiedener Problem- und Aufgabenstellungen, die gelöst werden müssen. Auf Grundlage des Ergebnisses wird die Person dann im Vergleich mit einer altersentsprechenden Normstichprobe eingestuft.

Da es jedoch unterschiedliche Theorien darüber gibt, was Intelligenz ist, gibt es auch verschiedene Intelligenztests. Den meisten gemein ist jedoch, das Ergebnis durch den Intelligenzquotienten, kurz IQ, darzustellen. In Deutschland gelten Menschen mit einem IQ von 130 oder mehr als hochbegabt. Bei der Auswertung eines Intelligenztests ist es wichtig zu beachten, welche Theorie dem Test zugrunde liegt. Demnach befasst sich ein solcher Test entweder mit einer allgemeinen Intelligenz oder aber mit verschiedenen Komponenten.

Die allgemeine Intelligenz wird durch den Zahlen-Verbindungs-Test von Wolf D. Oswald und Erwin Roth oder den Matrizen-Test von John C. Raven ermittelt. Nach einer Theorie des britisch-amerikanischen Psychologen R. B. Cattell lässt sich Intelligenz in fluide und kristalline Intelligenz unterteilen. Dabei werden Problemlösefähigkeit und erlerntes Wissen einander gegenübergestellt. Je nach Ausprägung bei der Testperson ist das Ergebnis für die klinische oder die Entwicklungspsychologie von Bedeutung.

Funktion, Wirkung & Ziele

Das Anwendungsgebiet von Intelligenztests erstreckt sich von der Personalauswahl und Berufsberatung über die Empfehlung einer möglichen schulischen Laufbahn bis hin zur medizinischen Diagnostik. Intelligenztests sollen dabei helfen, die Eignung für bestimmte Berufe im Voraus abzuschätzen. Auch zu einer Intelligenzminderung, einer psychischen Störung oder einer Demenz können sie Hinweise liefern; die Diagnose stellen sie nicht. Dementsprechend gibt es unterschiedliche Tests für verschiedene Altersgruppen.

Der bekannteste Test für Kinder von zweieinhalb bis zwölfeinhalb Jahren ist die Kaufman Assessment Battery for Children, kurz K-ABC. Seit einigen Jahren gibt es in Deutschland allerdings die Nachfolgeversion KABC II, da Intelligenztests aufgrund der sich ändernden durchschnittlich gemessenen Intelligenz regelmäßig überprüft und gegebenenfalls nachgeeicht werden müssen. Die neue Version richtet sich an Kinder und Jugendliche von drei bis achtzehn Jahren und dient neben der ausbildungs- und berufsbezogenen Eignungs- und Rehabilitationsdiagnostik auch der Entwicklungsdiagnostik im frühen Kindesalter und der neuropsychologischen Diagnostik.

Der KABC II beruht auf der Theorie der kristallinen und fluiden Intelligenz. Er besteht aus einer größeren Zahl von Unterkategorien, aus denen je nach Alter der Testperson ausgewählt wird. Für Menschen mit starker Einschränkung des Gehörs oder der Sprachfähigkeit sowie mit geringen Sprachkenntnissen gibt es auch einen sprachfreien Test. Seit 1997 gibt es auch den Kaufman-Test zur Intelligenzmessung für Jugendliche und Erwachsene. Dieser beruht auf derselben Theorie, hat aber nur acht Unterkategorien.

Ein weiterer sprachfreier Intelligenztest ist der bereits erwähnte Matrizen-Test nach John C. Raven. Dieser fußt auf der Theorie der allgemeinen Intelligenz und besteht aus Mustern, die erkannt und fortgeführt werden müssen. Lange Zeit war der Hamburg-Wechsler-Intelligenztest für Erwachsene verbreitet; heute werden seine Nachfolger unter der Bezeichnung Wechsler-Intelligenztest geführt, für Erwachsene ebenso wie in einer Version für Kinder und Jugendliche. Die Erwachsenenfassung besteht aus zehn Untertests, die sich in vier verschiedene Skalen einteilen lassen. Die Einteilung erfolgt in die Bereiche Sprachverständnis, wahrnehmungsgebundenes logisches Denken, Arbeitsgedächtnis und Verarbeitungsgeschwindigkeit. Es gibt mehrere verschiedene Tests, die sich mit unterschiedlichen Komponenten der Intelligenz beschäftigen, also nicht von einer allgemeinen Intelligenz ausgehen.

Die bekanntesten sind der Berliner-Intelligenz-Struktur-Test, der Intelligenz-Struktur-Test und der Wilde-Intelligenz-Test in der zweiten Version. Alle drei befassen sich unter anderem mit der Sprach-, Rechen- und Merkfähigkeit der Testpersonen. Intelligenztests sind zeitlich begrenzt und müssen unter Aufsicht einer entsprechend qualifizierten psychologischen Fachkraft vorgenommen werden. Das ist besonders wichtig, wenn ein solcher Test im Rahmen eines Assessment-Centers durchgeführt wird, da das Ergebnis ansonsten angefochten werden kann.


Risiken, Nebenwirkungen & Gefahren

Zu beachten ist, dass es aufgrund der verschiedenen Intelligenztheorien, aber auch durch kulturelle und sprachliche Unterschiede keinen allgemeingültigen Intelligenztest geben kann. Obwohl alle Ergebnisse mit dem IQ angegeben werden, sind sie nicht unmittelbar vergleichbar. Da unterschiedliche Aspekte getestet werden, sind nicht alle gemessenen Werte gleichbedeutend. Außerdem sind aufgrund von Normierung und Eichung auch die Tests selbst nicht miteinander vergleichbar.

Noch schwieriger ist dadurch ein länderübergreifender oder kultureller Vergleich der erzielten IQ-Werte. Oft ist die Bereitschaft, an einem solchen Testverfahren teilzunehmen, in Gesellschaften, in denen es dazu keinen realitätsnahen Bezug gibt, äußerst gering. Bei sprachgebundenen Varianten schneiden Menschen mit geringen Sprachkenntnissen oft schlecht ab. Zwar gibt es auch nichtsprachliche Tests, wie den oben genannten Matrizen-Test oder den Culture Fair Test CFT, aber auch bei diesen ist der Erfolg stark kulturabhängig. Jedoch ist nicht nur der sprachliche oder kulturelle Hintergrund wichtig für den erfolgreichen Abschluss eines Intelligenztests.

Kinder aus den oberen Sozialschichten erzielen bei solchen Tests bessere Ergebnisse als Kinder aus der Arbeiter- oder Unterschicht. Ob das daran liegt, dass die Testaufgaben solchen Kindern gegenüber unfair sind, wird derzeit diskutiert. Der sogenannte Minnesota Mechanical Assembly Test misst hingegen nicht in traditioneller Weise, sondern bezieht sich auf mechanische Fähigkeiten. Dabei schneiden Kinder aus der Unterschicht etwas besser ab als ihre Altersgenossen aus der Mittel- oder Oberschicht. Des Weiteren ist ein Testergebnis kein exakter Wert. Jeder Messung haftet eine Ungenauigkeit an, weshalb IQ-Werte üblicherweise mit einem Vertrauensbereich angegeben werden.

Wie ein IQ-Wert zustande kommt

Der Intelligenzquotient ist kein Messwert wie eine Körpergröße, sondern eine Vergleichszahl. Die Testperson löst eine festgelegte Reihe von Aufgaben; daraus ergibt sich zunächst ein Rohwert, also schlicht die Anzahl richtiger Lösungen, bei einigen Verfahren gewichtet nach Schwierigkeit oder Bearbeitungszeit. Dieser Rohwert allein sagt nichts aus. Erst der Vergleich mit der Normstichprobe, einer möglichst repräsentativen Gruppe gleichaltriger Personen, macht ihn deutbar: Der IQ gibt an, wo die Testperson innerhalb dieser Gruppe steht.

Die gebräuchlichen Verfahren sind dabei so geeicht, dass der Mittelwert der Normstichprobe bei 100 liegt. Die Streuung ist bei den verbreiteten Tests so festgelegt, dass einer Standardabweichung 15 Punkte entsprechen. Ein Wert von 115 bedeutet daher nicht, dass jemand "15 Prozent klüger" wäre als der Durchschnitt, sondern dass er eine Standardabweichung oberhalb des Mittelwerts der Vergleichsgruppe liegt. Aus derselben Rechenweise folgt, dass die weit überwiegende Mehrheit der Bevölkerung in einem mittleren Bereich um 100 liegt und extreme Werte selten sind.

Weil der Vergleich immer gegen eine bestimmte Stichprobe erfolgt, hängt das Ergebnis auch davon ab, wie alt und wie gut zusammengestellt diese Stichprobe ist. Veraltete Normen führen dazu, dass Werte im Mittel zu hoch ausfallen; dieser Zusammenhang ist als Flynn-Effekt bekannt, benannt nach der Beobachtung, dass die gemessene Durchschnittsleistung über das 20. Jahrhundert hinweg anstieg. Die weiter oben erwähnte regelmäßige Neueichung der Verfahren ist die Antwort darauf. Aus demselben Grund lassen sich Ergebnisse, die mit unterschiedlichen Testversionen oder in weit auseinanderliegenden Jahren erhoben wurden, nicht ohne Weiteres nebeneinanderstellen.

Damit ein Verfahren überhaupt als Intelligenztest gelten kann, muss es drei Anforderungen erfüllen, die in der Testtheorie als Gütekriterien bezeichnet werden. Objektivität bedeutet, dass das Ergebnis nicht davon abhängt, wer den Test durchführt und auswertet; sie wird über die wörtlich vorgegebenen Anweisungen und über eindeutige Auswertungsregeln hergestellt. Zuverlässigkeit bedeutet, dass eine wiederholte Messung unter gleichen Bedingungen zu einem ähnlichen Ergebnis führt. Gültigkeit schließlich bedeutet, dass ein Verfahren wirklich das erfasst, was es zu erfassen beansprucht, und nicht in erster Linie Vorwissen, Lesegeschwindigkeit oder Übung im Umgang mit Testaufgaben. Diese drei Anforderungen werden für jedes Verfahren geprüft und dokumentiert; sie sind der Grund dafür, dass ein Intelligenztest aus mehr besteht als aus einer Sammlung kniffliger Aufgaben.

Was der Wert aussagt und was nicht

Jedes Testergebnis ist mit einer Messungenauigkeit behaftet. Deshalb wird ein IQ nicht als exakte Zahl, sondern sinnvollerweise als Bereich berichtet, innerhalb dessen der wahre Wert mit einer bestimmten Wahrscheinlichkeit liegt. Kleine Unterschiede zwischen zwei Personen oder zwischen zwei Untersuchungszeitpunkten sind vor diesem Hintergrund nicht aussagekräftig; erst deutliche Abweichungen lassen sich fachlich deuten.

Ebenso wichtig ist die Unterscheidung zwischen Testleistung und Intelligenz. Gemessen wird stets nur, wie jemand an einem bestimmten Tag unter bestimmten Bedingungen abgeschnitten hat. Angst vor der Situation, fehlende Motivation, Müdigkeit, Konzentrationsstörungen, eine akute Erkrankung, Medikamente oder auch nur ein missverstandenes Aufgabenbeispiel können das Ergebnis nach unten verschieben. Umgekehrt kann die Wiederholung desselben Verfahrens nach kurzer Zeit den Wert allein durch Übung anheben, weshalb zwischen zwei Testungen üblicherweise ein größerer Abstand eingehalten oder ein Parallelverfahren gewählt wird.

Ein Testergebnis ist außerdem kein Persönlichkeitsurteil. Über Kreativität, Ausdauer, soziale Fähigkeiten, Interessen oder die spätere berufliche Zufriedenheit trifft ein Intelligenztest keine Aussage. Ein niedriger Wert ist für sich genommen auch keine Diagnose: Eine Intelligenzminderung wird nicht allein über einen Zahlenwert bestimmt, sondern setzt zusätzlich voraus, dass die Bewältigung des Alltags erkennbar eingeschränkt ist. Umgekehrt sichert ein hoher Wert weder Schulerfolg noch beruflichen Erfolg. Die im Umlauf befindlichen Kurztests im Internet oder in Zeitschriften sind in aller Regel weder genormt noch auf ihre Zuverlässigkeit geprüft; ihre Ergebnisse lassen sich mit denen eines fachlich durchgeführten Verfahrens nicht vergleichen.

Ablauf einer Testung

Am Anfang steht ein Gespräch, in dem die Fragestellung geklärt wird: Wer möchte das Ergebnis wozu wissen, und welches Verfahren passt zu Alter, Sprachkenntnissen und möglichen Einschränkungen der Testperson. Bei Kindern werden dabei auch Angaben der Eltern und, sofern vorhanden, Berichte aus Kindergarten oder Schule einbezogen.

Die Untersuchung selbst findet in einem ruhigen Raum und in aller Regel als Einzeltestung statt. Die Anweisungen sind wörtlich vorgegeben und werden unverändert vorgelesen, damit alle Testpersonen dieselben Bedingungen vorfinden; aus demselben Grund sind Hilfestellungen über die vorgesehenen Beispielaufgaben hinaus nicht zulässig. Viele Untertests sind zeitlich begrenzt. Der Umfang richtet sich nach Verfahren und Alter; bei Kindern werden Pausen eingelegt, und die Testung kann bei Erschöpfung abgebrochen und später fortgesetzt werden.

Anschließend werden die Rohwerte anhand der Normtabellen in Standardwerte umgerechnet. Beurteilt wird dabei nicht nur der Gesamtwert, sondern auch das Profil der Einzelbereiche: Ein ausgeglichenes Profil wird anders gedeutet als eines, in dem etwa das Sprachverständnis deutlich vom logischen Denken abweicht. Solche Unterschiede innerhalb eines Tests sind für die Beratung oft aufschlussreicher als der Gesamtwert. Zum Abschluss gehören ein Rückmeldegespräch und ein schriftlicher Befund, der das Ergebnis einordnet und Empfehlungen enthält. Die Testverfahren selbst unterliegen einer Bezugsbeschränkung und werden nur an fachlich qualifizierte Personen abgegeben, damit die Aufgaben nicht im Voraus bekannt sind.

Anlässe und Rahmen

Veranlasst wird eine Intelligenzdiagnostik immer aus einer konkreten Fragestellung heraus, nie als Selbstzweck. Im Kindes- und Jugendalter geht es häufig um schulische Fragen: um die Abklärung von Lernschwierigkeiten und deren Abgrenzung gegenüber einer Legasthenie oder einer Dyskalkulie, um Förderbedarf, um die Einschätzung einer Entwicklungsverzögerung oder um den Verdacht auf eine besondere Begabung. Auch bei einer Sprachentwicklungsstörung oder im Rahmen der Abklärung eines Autismus gehört eine Leistungsdiagnostik oft zum Untersuchungsprogramm.

Im Erwachsenenalter liegt der Schwerpunkt anders. In der klinischen Neuropsychologie wird die Leistungsfähigkeit nach einem Schädel-Hirn-Trauma, einem Schlaganfall oder bei Verdacht auf eine Demenz untersucht, wobei dort meist nicht der Gesamt-IQ, sondern das Muster erhaltener und beeinträchtigter Teilleistungen interessiert und der Vergleich mit dem früheren Leistungsniveau der Person entscheidend ist. Weitere Anlässe sind die Berufs- und Rehabilitationsberatung sowie die Personalauswahl.

Durchgeführt und ausgewertet werden die Verfahren von entsprechend qualifizierten Fachkräften, etwa in psychologischen Praxen, in schulpsychologischen Diensten, in Sozialpädiatrischen Zentren, in Kliniken und in Beratungsstellen. Wer die Kosten trägt, hängt vom Anlass ab: Wird die Untersuchung im Rahmen einer medizinischen Abklärung veranlasst, ist sie Teil der Krankenbehandlung; bei schulischen oder beruflichen Fragestellungen kommen andere Kostenträger in Betracht oder die Untersuchung wird selbst bezahlt.

Geschichte der Intelligenzmessung

Der erste in der Praxis brauchbare Intelligenztest entstand 1905 in Frankreich. Der Psychologe Alfred Binet entwickelte ihn gemeinsam mit Théodore Simon im Auftrag der Schulverwaltung, um Kinder zu erkennen, die dem regulären Unterricht nicht folgen konnten und besonderer Förderung bedurften. Die Aufgaben waren nach Schwierigkeit geordnet, und aus der Zahl gelöster Aufgaben wurde ein Entwicklungsalter abgeleitet.

Den Begriff des Intelligenzquotienten prägte 1912 der Psychologe William Stern. Er setzte das aus dem Test gewonnene Intelligenzalter ins Verhältnis zum Lebensalter. Diese Rechenweise war für Kinder brauchbar, versagte aber bei Erwachsenen, weil die Testleistung dort nicht mehr in gleichem Maße mit dem Lebensalter ansteigt. Sie wurde deshalb später durch den heute gebräuchlichen Abweichungs-IQ ersetzt, der die Leistung nicht mehr auf ein Alter, sondern auf die Verteilung in der altersentsprechenden Normstichprobe bezieht. Maßgeblich beteiligt an dieser Umstellung war der Psychologe David Wechsler, auf den die bis heute weiterentwickelte Testfamilie gleichen Namens zurückgeht.

Die Geschichte der Intelligenzmessung ist zugleich eine Geschichte ihres Missbrauchs. Testergebnisse wurden im 20. Jahrhundert wiederholt herangezogen, um Zuwanderung zu beschränken oder Menschen Bildungswege und Rechte zu verweigern; die dabei verwendeten Verfahren waren sprach- und kulturgebunden und benachteiligten die Geprüften systematisch. Die heutige Zurückhaltung gegenüber der Deutung einzelner Zahlenwerte, die ausführlichen Anforderungen an Normierung und Testfairness und die Bindung der Verfahren an eine fachliche Qualifikation sind auch eine Folge dieser Erfahrungen.

Quellen

  • Hoyer, J., Knappe, S. (Hrsg.): Klinische Psychologie & Psychotherapie.
    ISBN: 9783662618134
  • Lehrner, J. (Hrsg.): Klinische Neuropsychologie.
    ISBN: 9783709100639
  • Siegler, R., Saffran, J., Gershoff, E., et al.: Entwicklungspsychologie im Kindes- und Jugendalter.
    ISBN: 9783662627716
  • Remschmidt, H., Becker, K. (Hrsg.): Kinder- und Jugendpsychiatrie und Psychotherapie.
    ISBN: 9783132411227
  • Falkai, P., Wittchen, H.-U. (Hrsg.): Diagnostisches und statistisches Manual psychischer Störungen.
    ISBN: 9783801732172

Das könnte Sie auch interessieren