Die bisher zitierten Experimente zeigen Unterschiede bei bestimmten Schreibaufgaben – sie belegen nicht, dass KI das Gehirn körperlich „verkümmern“ lässt. Quarks diskutiert eine reale Forschungsfrage, aber die starke Formulierung im Titel geht weiter als die verfügbare Evidenz. Die prominenteste im Beitrag behandelte Untersuchung beobachtete EEG-Signale und Erinnerung beim Schreiben eines Essays. Sie war klein, auf eine Aufgabe begrenzt und ist kein Beleg für dauerhafte Hirnschäden.
Geprüft wurde die am 25. September 2026 veröffentlichte Quarks-Folge „Lässt die KI unser Hirn verkümmern?“. Aussagen werden sinngemäß aus den automatisch erzeugten Untertiteln wiedergegeben und mit der zugrunde liegenden Studie sowie einer späteren methodischen Kritik verglichen. Prüfstand ist der 27. September 2026. Das Wort „verkümmern“ meint eine körperliche oder dauerhafte Schädigung; genau dafür liefert die Sendung keinen Nachweis.
Was die EEG-Studie tatsächlich untersuchte
Die Arbeit „Your Brain on ChatGPT“ verglich drei Gruppen: Essay-Schreiben mit einem Sprachmodell, mit einer Suchmaschine und ohne digitale Hilfsmittel. Gemessen wurde unter anderem die elektrische Aktivität des Gehirns während der Aufgabe. Die Forschenden berichten Unterschiede in der Netzwerkverbindung zwischen den Gruppen. Das ist ein interessanter Laborbefund über eine konkrete Tätigkeit – aber keine Aufnahme, die Hirnsubstanz oder einen dauerhaften Abbau misst.
Auch der Ausdruck „kognitive Auslagerung“ beschreibt zunächst, dass Menschen Gedächtnis- oder Denkschritte an Hilfsmittel abgeben. Das kann kurzfristig entlasten. Ob daraus in bestimmten Situationen weniger eigenes Üben entsteht, hängt davon ab, wie ein Werkzeug verwendet wird. Ein EEG-Unterschied während eines Essays beweist für sich allein weder einen Verlust allgemeiner Fähigkeiten noch eine bleibende Verschlechterung.
54 Teilnehmende, aber nur 18 im vierten Durchgang
Nach der Studienbeschreibung nahmen 54 Personen an den ersten drei Sitzungen teil. In der vierten Sitzung machten 18 Personen weiter. Die Versuchsanordnung bat Teilnehmende, Essays zu schreiben; sie tauschte bei einigen Personen das Hilfsmittel für den vierten Termin aus. Die Autorinnen und Autoren berichten unter anderem geringere Konnektivität in der Gruppe, die mit einem Sprachmodell arbeitete, sowie Unterschiede beim Erinnern an selbst verfasste Inhalte.
Diese Ergebnisse sind ernst zu nehmen, aber klein und eng umrissen. Ein kurzer Essay unter Versuchsbedingungen ist nicht dasselbe wie Lernen über Monate, Lesen im Alltag oder klinische Hirngesundheit. Die Untersuchung zeigt eine mögliche Frage für größere Studien auf. Sie erlaubt nicht, bei einzelnen Nutzerinnen und Nutzern einen Schaden zu diagnostizieren.
Messbare Aktivität ist nicht dasselbe wie Denkfähigkeit
Ein geringeres EEG-Signal in einer bestimmten Aufgabe kann mehrere Erklärungen haben. Es kann darauf hinweisen, dass Teilnehmende weniger kognitive Arbeit leisten; es sagt jedoch nicht automatisch, ob sie weniger verstanden, ob sie das Gelernte später noch anwenden können oder ob sich ihre allgemeine Denkfähigkeit verändert. Die Studie betrachtet mehrere Messgrößen, aber sie ersetzt keine langfristige Prüfung realer Lernleistungen.
Die Sendung macht auf dieses Risiko aufmerksam, wenn Menschen Antworten ungeprüft übernehmen. Sie springt an einzelnen Stellen aber von einer beobachteten Aufgabe zu einer weitreichenden Frage über das Gehirn. Das ist als Warnfrage legitim; als nachgewiesene Wirkung wäre es zu stark formuliert.
Die Forschung ist umstritten und noch nicht abschließend geprüft
Das zentrale Manuskript ist auf arXiv als Preprint veröffentlicht. Ein unabhängiger Beitrag auf derselben Plattform kritisiert unter anderem die kleine Stichprobe, die Nachvollziehbarkeit der Auswertung und die Interpretation der EEG-Ergebnisse. Dieser Kommentar ist ebenfalls ein Preprint und kein endgültiger Gegenbeweis. Er zeigt aber, warum aus einer einzelnen Studie kein sicheres Urteil über eine ganze Generation folgen sollte.
Was für belastbare Aussagen noch fehlt, sind größere und wiederholte Untersuchungen mit verschiedenen Altersgruppen, Aufgaben und längeren Zeiträumen. Auch sollte gemessen werden, ob Menschen Inhalte später erinnern und anwenden können – nicht nur, welche Aktivität während eines kurzen Textauftrags sichtbar ist.
PISA belegt keinen KI-Effekt
Die Quarks-Folge verknüpft ihre Diskussion mit schwächeren PISA-Ergebnissen. PISA 2022 liefert wichtige Informationen zu schulischen Leistungen, ist aber kein Experiment zu generativer KI. Die Erhebung fand vor dem öffentlichen Start von ChatGPT im November 2022 statt. Sie kann daher nicht zeigen, dass ChatGPT oder heutige Sprachmodelle die damaligen Ergebnisse verursacht haben. Ein zeitlicher Zusammenhang, der nicht einmal zeitlich passt, trägt diesen Schluss nicht.
Das gilt auch für spätere Entwicklungen: Wenn sich Leistungen verändern, müssen Unterricht, Pandemieeffekte, soziale Lage, Lernzeit und digitale Werkzeuge getrennt geprüft werden. Die PISA-Zahl allein weist keinen einzelnen Grund nach.
Wie man KI nutzt, ohne das eigene Üben zu überspringen
Die konkreten Tipps am Ende der Sendung – zunächst selbst einen Lösungsversuch machen, KI als Erklärhilfe nutzen und das Gelernte anschließend ohne Vorlage wiedergeben – passen zu einer vorsichtigen Lernstrategie. Der Beitrag belegt aber nicht, dass genau diese vier Tipps die langfristigen Folgen von KI-Nutzung verhindern. Leserinnen und Leser können sie als praktische Orientierung nutzen, nicht als bereits getestete Therapie.
Fazit: Die Folge benennt eine offene Forschungsfrage und eine plausible Gefahr: Wer Denk- und Lernschritte immer delegiert, könnte weniger selbst üben. Die angeführte Studie findet Unterschiede bei EEG und Erinnerung in einer begrenzten Schreibaufgabe. Sie zeigt keine anatomische Hirnschädigung und beweist keinen dauerhaften Verlust von Intelligenz. „KI lässt das Gehirn verkümmern“ ist deshalb nicht belegt; „die Art der Nutzung kann beeinflussen, wie viel Menschen selbst üben“ ist die engere, besser gestützte Aussage.
