Niezwykłe eksperymenty i badania psychologiczne

„Power posing” obiecywało zmianę hormonów przez dwie minuty pozy — późniejsze badania mocno zawęziły ten obraz

W głośnym badaniu z 2010 r. osoby przyjmujące przez krótki czas ekspansywne „pozy władzy” miały według autorów odczuwać większą moc, częściej podejmować ryzyko, mieć wyższy testosteron i niższy kortyzol niż osoby w pozach skurczonych. Wynik stał się światowym fenomenem. W 2015 r. większa replikacja nie odtworzyła efektów hormonalnych ani wpływu na ryzyko, choć znalazła różnicę w subiektywnym poczuciu władzy. Kolejne prerejestrowane badania i meta-analizy sugerowały, że niektóre niewielkie efekty subiektywne mogą istnieć, ale spektakularna opowieść o natychmiastowej zmianie hormonów i zachowania nie ma stabilnego potwierdzenia. Power posing to więc świetny przykład rozdzielania efektu medialnego od tego, co naprawdę pozostaje w danych.

„Wyczerpywanie samokontroli” stało się teorią podręcznikową, zanim duże replikacje skomplikowały obraz

W 1998 r. Baumeister i współpracownicy zaproponowali model ego depletion: wcześniejsze użycie samokontroli miało zużywać ograniczony zasób, przez co kolejne zadanie wymagające kontroli wypadało gorzej. W słynnym eksperymencie osoby powstrzymujące się od czekolady i jedzące rzodkiewki krócej pracowały później nad nierozwiązywalnymi łamigłówkami. Teoria zdobyła ogromną popularność, lecz późniejsze analizy wykrywały sygnały biasu publikacyjnego, a prerejestrowana replikacja w wielu laboratoriach w 2016 r. nie znalazła przewidywanego efektu w zastosowanym zadaniu. Nie oznacza to, że zmęczenie i motywacja nie wpływają na samokontrolę. Oznacza, że prosty model jednego, zużywalnego „zasobu siły woli” nie ma dziś tak mocnego statusu, jak sugerowała wcześniejsza popularność.

Czy można pamiętać wydarzenie, które nigdy się nie zdarzyło?

W badaniach nad fałszywymi wspomnieniami dorosłym przedstawiano kilka prawdziwych wydarzeń z dzieciństwa oraz jedno zdarzenie wymyślone przez badaczy, ale osadzone w wiarygodnych szczegółach rodzinnych. Część uczestników po kolejnych próbach przypominania zaczynała zgłaszać informacje lub doświadczenia pamięciowe związane z fikcyjnym epizodem. Nie oznacza to, że psycholog może dowolnie „wgrać” każdemu dowolne wspomnienie. Późniejsze przeglądy pokazują, że dużo zależy od sposobu definiowania fałszywej pamięci: łatwiej zwiększyć przekonanie, że coś mogło się wydarzyć, niż wywołać bogate, pewne wspomnienie autobiograficzne. Najważniejszy wniosek jest jednak mocny — poczucie pamiętania nie jest nieomylnym dowodem, że zdarzenie naprawdę miało miejsce.

Długopis w ustach miał pokazać, że „uśmiech” zmienia emocje — później efekt okazał się znacznie bardziej złożony

W 1988 r. Fritz Strack, Leonard Martin i Sabine Stepper poprosili uczestników o trzymanie długopisu w sposób ułatwiający lub utrudniający pracę mięśni związanych z uśmiechem, nie mówiąc im, że chodzi o mimikę. Osoby w warunku „uśmiechowym” oceniały kreskówki jako zabawniejsze. Badanie stało się ikoną hipotezy sprzężenia zwrotnego z twarzy. W 2016 r. 17 bezpośrednich replikacji nie odtworzyło tego konkretnego efektu. To jednak nie zakończyło całej hipotezy: szeroka współpraca Many Smiles z 2022 r. znalazła niewielkie zmiany odczuwanej przyjemności dla niektórych sposobów wywoływania uśmiechu, ale nie dla klasycznej procedury z długopisem. Wniosek brzmi więc nie „mimika nie ma znaczenia”, lecz „słynny efekt długopisu nie jest stabilnym uniwersalnym dowodem”.

Do stworzenia podziału „my–oni” może wystarczyć niemal arbitralna etykieta

W eksperymentach minimalnych grup Henriego Tajfela chłopców dzielono na grupy według kryteriów pozbawionych realnej historii i praktycznego znaczenia, a następnie proszono o przydzielanie anonimowym członkom obu grup punktów lub nagród. Mimo że uczestnicy nie znali odbiorców osobiście i nie mieli wcześniejszego konfliktu, pojawiała się tendencja do faworyzowania własnej grupy. Szczególnie interesujące było to, że ludzie czasem wybierali rozwiązania zwiększające różnicę między grupami zamiast maksymalizować bezwzględny zysk wszystkich. Efekt nie oznacza, że każda przypadkowa etykieta natychmiast tworzy wrogość. Minimal group paradigm usuwał jednak wiele zwykłych powodów konfliktu i pokazał, że sama kategoryzacja może stać się wystarczającą podstawą nierównego traktowania.

Dwie grupy chłopców najpierw skonfliktowano, a potem dano im cele wymagające współpracy

W badaniu Robbers Cave z 1954 r. 22 chłopców na obozie letnim podzielono na dwie nieznające się grupy. Najpierw każda rozwijała własną tożsamość. Następnie badacze wprowadzili konkurencję o nagrody, po której narastały wrogość, obraźliwe stereotypy i konflikty. Sama okazja do wspólnego przebywania nie wystarczyła, by łatwo odwrócić napięcie. Zmiana pojawiła się, gdy obie grupy musiały współpracować przy nadrzędnych celach, których żadna nie mogła skutecznie osiągnąć samodzielnie, np. przy problemach wymagających wspólnego działania. Badanie stało się klasycznym źródłem teorii konfliktu realistycznego, ale jego próbka była skrajnie wąska: podobni do siebie, 11-letni chłopcy, nieświadomi, że uczestniczą w eksperymencie.

Gdy powtórzono 100 opublikowanych badań psychologicznych, wiele efektów wyraźnie osłabło

W 2015 roku Open Science Collaboration opublikowała wyniki dużego projektu replikacyjnego obejmującego 100 badań eksperymentalnych i korelacyjnych z trzech czasopism psychologicznych. W pracach oryginalnych 97% wybranych wyników było istotnych statystycznie, natomiast w replikacjach 36%; średnia wielkość efektu w replikacjach wynosiła około połowy wartości z publikacji pierwotnych. Nie oznacza to, że „64% psychologii było fałszywe”. Autorzy sami używali kilku różnych kryteriów sukcesu i podkreślali, że żadna pojedyncza miara nie opisuje replikowalności. Późniejsze projekty, takie jak Many Labs 2, również pokazywały mieszaninę dobrze i słabiej replikujących się efektów. Najciekawsza lekcja dotyczy samej nauki: powtórzenie badania na nowych danych jest osobnym źródłem wiedzy, a nie formalnością.

Historia „Małego Alberta” jest mniej pewna, niż sugerują podręczniki

W 1920 r. John B. Watson i Rosalie Rayner opisali próbę wywołania lęku u niemowlęcia znanego jako „Albert B.”. Łączyli kontakt z białym szczurem z nagłym, głośnym dźwiękiem, a później badali reakcje dziecka na szczura i inne futrzaste obiekty. Eksperyment stał się podręcznikową ikoną warunkowania emocji, ale późniejsze analizy pokazały, że popularne opowieści dodawały szczegóły, których oryginalny raport nie potwierdzał. Nie przeprowadzono pełnego odwarunkowania, procedura była nieregularna, a tożsamość i stan zdrowia Alberta stały się przedmiotem sporu historycznego. Samo badanie jest więc ciekawsze jako przykład powstawania naukowej legendy niż jako idealny eksperymentalny dowód, że jedną prostą procedurą „stworzono fobię”.

Im więcej świadków, tym nie zawsze łatwiej o pomoc

Klasyczne badania Johna Darleya i Bibba Latané pokazały, że obecność innych świadków może zmniejszać skłonność pojedynczej osoby do szybkiej interwencji. W jednym eksperymencie uczestnicy słyszeli przez interkom osobę pozornie przechodzącą napad padaczkowy. Gdy sądzili, że tylko oni mogą pomóc, reagowali szybciej niż wtedy, gdy wierzyli, że sytuację słyszy więcej osób. Zjawisko nazwano efektem widza i wiązano m.in. z rozproszeniem odpowiedzialności. Późniejsza meta-analiza ponad 100 efektów potwierdziła ogólną tendencję, ale pokazała ważny wyjątek: w wyraźnie niebezpiecznych sytuacjach obecność innych może mniej hamować pomoc, a czasem dostarczać wsparcia. „Więcej ludzi = mniej pomocy” jest więc zbyt prostą regułą.

Jak daleko ludzie posuną się, gdy polecenie wydaje autorytet?

W badaniu Stanleya Milgrama uczestnik w roli „nauczyciela” miał na polecenie eksperymentatora uruchamiać coraz wyższe rzekome wstrząsy elektryczne za błędne odpowiedzi „ucznia”. W rzeczywistości uczeń był współpracownikiem badacza i nie otrzymywał wstrząsów. W podstawowej publikacji 26 z 40 uczestników doszło do najwyższego poziomu generatora, mimo protestów ofiary i widocznego napięcia samych badanych. Wynik nie oznacza, że większość ludzi zawsze wykona każde polecenie autorytetu. Milgram badał specyficzną, stopniowo eskalowaną sytuację laboratoryjną. Częściowa replikacja Jerry’ego Burgera z 2006 r. zatrzymywała procedurę przy 150 V; 70% badanych próbowało kontynuować dalej, co pokazało, że presja sytuacyjna nie była wyłącznie artefaktem lat 60.

Jedno słowo w pytaniu może zmienić późniejszą relację świadka

W klasycznym badaniu Elizabeth Loftus i Johna Palmera uczestnicy oglądali filmy z wypadkami samochodowymi, a później odpowiadali na pytania o prędkość pojazdów. Sam czasownik użyty w pytaniu — od łagodniejszego do sugerującego gwałtowne zderzenie — wpływał na podawane szacunki. W drugim eksperymencie osoby, którym wcześniej zasugerowano mocniejsze zderzenie, częściej później deklarowały, że widziały rozbite szkło, choć na filmie go nie było. Nie znaczy to, że pojedyncze słowo dowolnie „przepisuje” pamięć. Badanie stało się jednak jednym z punktów wyjścia do szerokiej literatury o efekcie dezinformacji: informacje otrzymane już po zdarzeniu mogą wpływać na to, jak później je relacjonujemy.

Jednomyślna grupa potrafi skłonić człowieka do podania oczywiście błędnej odpowiedzi

W eksperymentach Solomona Ascha uczestnik miał wskazać, która z kilku linii ma taką samą długość jak linia wzorcowa. Zadanie było proste, lecz przed prawdziwym uczestnikiem odpowiadali współpracownicy badacza, którzy w wybranych próbach jednogłośnie podawali błędną odpowiedź. Presja grupy wyraźnie zwiększała liczbę błędnych odpowiedzi uczestników, choć wiele osób nadal zachowywało niezależność. Późniejsza meta-analiza 133 badań z 17 krajów pokazała, że konformizm w paradygmacie Ascha zależy m.in. od czasu i kultury. Eksperyment nie mówi więc, że „ludzie zawsze idą za tłumem”, lecz że jednomyślna większość może zmienić zachowanie nawet wtedy, gdy odpowiedź wydaje się perceptualnie oczywista.

Ludzie potrafią uzasadnić wybór, którego wcale nie dokonali

W badaniu nad tzw. choice blindness uczestnicy wybierali bardziej atrakcyjną z dwóch twarzy, ale w części prób eksperymentator za pomocą prostego triku podmieniał wynik i pokazywał im twarz, którą wcześniej odrzucili. Wiele takich podmian nie było natychmiast wykrywanych, a uczestnicy potrafili następnie podawać powody rzekomego wyboru. Później podobny efekt uzyskano w prawdziwym supermarkecie przy wyborze dżemu i herbaty. Nie oznacza to, że ludzie nie znają własnych preferencji albo zawsze konfabulują. Eksperyment pokazuje jednak, że dostęp do historii własnej decyzji nie jest doskonały: gdy wynik wygląda wiarygodnie, możemy nie zauważyć rozbieżności między intencją a tym, co dostaliśmy, a następnie zbudować sensowne wyjaśnienie na podstawie aktualnej sytuacji.

Próba przypomnienia sobie materiału może uczyć lepiej niż kolejne czytanie

Test nie musi jedynie sprawdzać wiedzy — samo wydobywanie informacji z pamięci może poprawiać jej późniejsze zachowanie. W eksperymentach Roedigera i Karpickego studenci czytali teksty, a następnie albo ponownie je studiowali, albo próbowali odtworzyć je z pamięci bez informacji zwrotnej. Po kilku minutach dodatkowe czytanie mogło dawać przewagę, ale po dwóch dniach i tygodniu lepiej wypadały warunki z wcześniejszym przypominaniem. Meta-analizy potwierdziły ogólną korzyść retrieval practice względem ponownego studiowania, choć wielkość efektu zależy od typu zadania. Nowsza analiza z 2026 roku dodatkowo pokazała, że literatura miesza bezpośrednią korzyść dla testowanego materiału z korzyścią dla późniejszego uczenia się nowych treści. Mechanizm jest więc bogatszy niż jedno hasło „testowanie działa”.

Przypominanie jednej informacji może utrudnić późniejsze przypomnienie innych

Ćwiczenie przypominania zwykle wzmacnia pamięć materiału, który właśnie odtwarzamy. Badania nad retrieval-induced forgetting pokazują jednak drugą stronę: gdy wielokrotnie wydobywamy tylko część informacji z danej kategorii, późniejszy dostęp do konkurencyjnych, niećwiczonych elementów może być gorszy niż do materiału z kategorii, której w ogóle nie ćwiczono. W klasycznym paradygmacie Andersona, Bjorków uczestnicy uczyli się par kategorii i egzemplarzy, np. FRUIT–orange, a potem ćwiczyli tylko część z nich. Na późniejszym teście elementy powiązane, ale pomijane podczas praktyki, bywały odtwarzane słabiej. Meta-analiza z 2014 r. potwierdziła ogólny efekt, choć jego mechanizm — szczególnie rola aktywnego hamowania konkurentów — pozostaje przedmiotem dyskusji.

Stanfordzki eksperyment więzienny nie dowodzi, że role automatycznie zmieniają ludzi w oprawców

Stanford Prison Experiment z 1971 r. stał się ikoną psychologii: studentów losowo przypisano do ról strażników i więźniów, a symulację przerwano wcześniej po eskalacji złego traktowania i kryzysach części „więźniów”. Przez lata przedstawiano to jako niemal czysty dowód, że sama rola i sytuacja więzienna szybko produkują tyranię. Późniejsza analiza archiwów i wywiadów ujawniła jednak poważne problemy: strażnicy otrzymywali konkretne wskazówki dotyczące traktowania więźniów, nie wszyscy zachowywali się brutalnie, występowały silne demand characteristics, a dobór ochotników mógł sprzyjać określonym cechom. Badanie pozostaje ważnym wydarzeniem historycznym, ale jego klasyczna interpretacja jest znacznie mocniejsza niż pozwala metodologia.

Test z pianką marshmallow nie był prostą przepowiednią przyszłego sukcesu dziecka

Słynne badania nad odraczaniem gratyfikacji pokazały, że w pewnych warunkach długość oczekiwania przedszkolaków wiązała się z późniejszymi kompetencjami poznawczymi i samoregulacyjnymi. Popkulturowa wersja zrobiła z tego niemal test charakteru: dziecko, które poczeka na drugą słodycz, ma rzekomo „odnieść sukces”. Późniejsze badania dały bardziej złożony obraz. Eksperyment z 2013 roku pokazał, że dzieci czekały dużo dłużej, gdy wcześniej doświadczyły wiarygodnego eksperymentatora. Analiza większej próby 918 dzieci w 2018 roku wykazała słabsze związki z późniejszymi osiągnięciami, które wyraźnie malały po uwzględnieniu środowiska rodzinnego i wcześniejszych zdolności. Marshmallow test nie okazał się bezwartościowy — okazał się po prostu mniej magiczny.

Uczestnik eksperymentu może zmienić zachowanie tylko dlatego, że domyślił się hipotezy badacza

Psychologiczny eksperyment nie jest neutralną maszyną: uczestnik wie, że bierze udział w badaniu, obserwuje procedurę i próbuje zrozumieć, czego oczekuje eksperymentator. Martin Orne nazwał wskazówki ujawniające prawdopodobny cel badania „demand characteristics”. Jeśli uczestnik odgadnie hipotezę, może — świadomie lub nie — zachowywać się tak, by ją potwierdzić, zanegować albo „być dobrym badanym”. W eksperymencie Nicholsa i Manera z 2008 r. osoby poinformowane przez współpracownika o rzekomej hipotezie miały tendencję do odpowiedzi ją potwierdzających, choć zależało to od ich nastawienia i cech indywidualnych. Problem nie oznacza, że wyniki psychologii są artefaktem oczekiwań, lecz że dobry projekt musi kontrolować samą społeczną sytuację badania.

Wspomnienie może stać się podatniejsze na zmianę właśnie wtedy, gdy je sobie przypominamy

Klasyczny model pamięci zakładał, że po konsolidacji wspomnienie staje się względnie stabilne. Badania nad rekonsolidacją zaproponowały bardziej dynamiczny obraz: reaktywacja niektórych wspomnień może uruchomić okres, w którym zapis jest ponownie modyfikowalny i musi zostać ustabilizowany. W eksperymencie Hupbach i współpracowników studenci uczyli się listy przedmiotów, a następnego dnia — po subtelnym przypomnieniu wcześniejszej sytuacji albo bez niego — uczyli się nowej listy. Przy późniejszym odtwarzaniu osoby z przypomnieniem częściej włączały elementy nowej listy do starej. Wynik jest zgodny z ideą aktualizowania reaktywowanej pamięci, ale krytyczne przeglądy podkreślają, że „rekonsolidacja” u ludzi ma warunki brzegowe i nie każda zmiana po przypomnieniu dowodzi tego samego mechanizmu biologicznego.

Zapach podczas snu może ponownie uruchomić ślad wcześniejszej nauki

W badaniu Björna Rascha i współpracowników uczestnicy uczyli się zadania w obecności określonego zapachu. Gdy ten sam zapach ponownie prezentowano podczas snu wolnofalowego, późniejsza pamięć materiału deklaratywnego była lepsza niż w odpowiednich warunkach kontrolnych. Zapach nie pomagał w ten sam sposób, gdy nie był wcześniej związany z nauką, ani w badanych warunkach podczas REM czy czuwania. To jeden z fundamentów targeted memory reactivation — reaktywowania podczas snu wskazówek skojarzonych wcześniej z materiałem. Meta-analiza z 2020 roku obejmująca 91 eksperymentów i 2004 uczestników wykazała niewielki, ale dodatni ogólny efekt TMR podczas snu, przede wszystkim w NREM. To nie jest „nauka przez sen”: treść musi zostać wcześniej poznana na jawie.