Blog

Exit experience: po co projektować koniec wydarzenia

Najważniejsze tezy: Rynek projektuje mocne zakończenia, powołując się na regułę peak-end. Dla wydarzeń wielodniowych ta reguła nie trzyma: na realnych doświadczeniach zwykła średnia ocen z całości przewiduje ocenę końcową lepiej niż kombinacja momentu szczytowego i ostatniego. Zakończenie nie dźwiga pamięci całego wydarzenia, jest natomiast jedynym momentem, w którym da się ustawić następne działanie uczestnika, i tylko to jego znaczenie ma pokrycie w danych.

  • W badaniu na 691 turystach prosta średnia korelowała z oceną całości na poziomie 0,3457, średnia ważona czasem 0,3201, a model peak-end 0,2583.
  • Próba replikacji na 988 osobach w wieku od 2 do 97 lat nie wykryła efektu peak-end dla prostych pozytywnych doświadczeń.
  • Jedyny randomizowany wynik behawioralny dotyczący łagodnego zakończenia pochodzi z medycyny i daje iloraz szans powrotu 1,41 przy p = 0,038.
  • Przeniesienie tych wyników na konferencję B2B jest rozumowaniem przez analogię, dopóki nikt nie zrobi eksperymentu na realnym wydarzeniu.

Na każdym szkoleniu z projektowania doświadczeń pada ta sama teza: uczestnik zapamięta szczyt i koniec, więc zaprojektuj mocne zakończenie. Ma ona źródło w prawdziwych badaniach i ma nazwę. Problem polega na tym, że te badania mierzyły zjawisko innej skali, a próby przeniesienia ich wyników na doświadczenia dłuższe niż kilka minut wychodzą blado albo wcale.

Nie piszę tego, żeby zdjąć zakończenie z listy rzeczy wartych uwagi, a żeby zmienić jego uzasadnienie, bo z fałszywego uzasadnienia biorą się fałszywe decyzje budżetowe. Powód, dla którego zakończenie jest warte pracy, jest inny niż ten podawany przez rynek, i bardziej użyteczny.

Skąd wzięła się reguła szczytu i końca

Oryginalny eksperyment Kahnemana, Fredrickson, Schreibera i Redelmeiera z 1993 roku wyglądał tak: 32 mężczyzn trzymało rękę w zimnej wodzie. Pierwszy warunek to 60 sekund przy 14,1 stopnia, drugi to te same 60 sekund plus kolejne 30, w czasie których woda ocieplała się do 15,2 stopnia. Dyskomfort w sześćdziesiątej sekundzie był praktycznie identyczny, 8,44 wobec 8,34, a w ostatnich trzydziestu sekundach wariantu dłuższego spadł o 2,65 punktu.

Potem uczestnicy wybierali, który wariant chcą powtórzyć. Dwudziestu dwóch z trzydziestu dwóch wybrało dłuższy, czyli obiektywnie więcej bólu, z = 2,15. Korelacja wyboru z ogólną oceną dyskomfortu wyniosła 0,80, a z czasem trwania 0,16. Stąd dwa wnioski: ocena retrospektywna opiera się na momentach szczególnych, a czas trwania jest w niej zaniedbywany.

Rok później ci sami autorzy powtórzyli to na klipach filmowych, na grupach 32 i 96 osób. Czas trwania korelował z oceną na poziomie 0,10 dla materiałów przyjemnych i 0,26 dla nieprzyjemnych, a po uwzględnieniu szczytu i końca zostawało 0,06 i minus 0,02.

Jedno badanie, które rynek powinien znać, i zwykle zna błędnie

Najmocniejszy dowód behawioralny nie pochodzi z laboratorium. Redelmeier, Katz i Kahneman opublikowali w 2003 roku w czasopiśmie Pain badanie randomizowane na 682 pacjentach poddawanych kolonoskopii: 345 z wydłużonym o około trzy minuty, łagodniejszym zakończeniem i 337 w grupie kontrolnej.

Wyniki: ból w końcówce 1,7 wobec 2,5 przy p poniżej 0,001, ocena retrospektywna 4,4 wobec 4,9, nieprzyjemność 4,1 wobec 4,6. I rzecz, która interesuje organizatora najbardziej: iloraz szans zgłoszenia się na kolejne badanie wyniósł 1,41 przy p = 0,038, przy medianie obserwacji 5,3 roku i 50,4 procent powrotów.

Autorzy sami nazwali to dowodem koncepcyjnym, nie rekomendacją kliniczną. Patrzę na to z dwóch stron jednocześnie. Jest to jedyne znane mi randomizowane badanie, w którym zmiana samego zakończenia przełożyła się na faktyczne zachowanie wiele lat później, a jednocześnie różnica w ocenie wynosiła pół punktu na skali, zaś iloraz szans 1,41 jest efektem umiarkowanym.

Dla doświadczeń wieloepizodowych reguła przestaje działać

Tu zaczyna się część, której rynek eventowy nie przyswoił. Gdy badacze wyszli z laboratorium na doświadczenia rozciągnięte na godziny i dni, model peak-end zaczął przegrywać z prostszymi.

Chark, King i Tang zbadali 691 turystów w Makau, przy średnim pobycie 1,72 nocy, i policzyli trzy modele przewidywania oceny całego pobytu. Prosta średnia ocen epizodów: r = 0,3457. Ważona czasem: 0,3201. Peak-end: 0,2583. Autorzy napisali wprost, że nie ma tu skrótu poznawczego zastępującego uśrednianie.

Miron-Shatz pracowała w 2009 roku na rekonstrukcji dnia u 810 Amerykanek, 820 Francuzek i 805 Dunek, z około setką pomiarów afektu na osobę dziennie. Średnia ważona czasem przewidywała ocenę dnia ze współczynnikiem 0,84 i 0,82, najniższe oceny miały wagę od minus 0,10 do minus 0,13, szczyt dawał 0,006 i tylko w próbie amerykańskiej, a koniec był zaniedbywalny. Wniosek autorki: peak-end dotyczy zdarzeń pojedynczych i spójnych, a dzień ani pobyt takim zdarzeniem nie są.

Kemp, Burt i Furneaux badali wspomnienia 49 wakacji: czas trwania nie miał wpływu na ocenę, peak-end również nie okazał się dobrym predyktorem. Strijbosch i współpracownicy w 2019 roku pokazali na 40 osobach i czternastominutowym materiale VR, że średnia walencji i pobudzenia przewiduje lepiej, a efekt peak-end słabnie przy ocenie odroczonej.

Najtwardszy wynik należy do Mah i Bernsteina: 988 osób w wieku od 2 do 97 lat, proste doświadczenia pozytywne, brak efektu peak-end. Czynniki Bayesa na rzecz hipotezy zerowej wyniosły 12 i 3,21, a w metaanalizie ich badań 7,77. Nie jest to wynik nieistotny statystycznie, który można odłożyć jako za małą próbę, a dowód na brak efektu.

Co z metaanalizami, które reguły broni

Alaybek i współautorzy w 2022 roku w OBHDP przejrzeli 174 wielkości efektu. Korelacja peak-end z oceną całości wyniosła 0,581 przy przedziale ufności od 0,487 do 0,661, więc wysoko. W tej samej pracy ogólna średnia przewidywała porównywalnie dobrze. Jeżeli dwa modele przewidują równie dobrze, a jeden jest prostszy w zastosowaniu, decyzja projektowa jest oczywista.

Scharbert i współautorzy w 2025 roku w European Journal of Personality poszli dalej: cztery badania metodą próbkowania doświadczeń, 1889 uczestników, 131 575 pomiarów. Siła efektu zależała od tego, jak zadano pytanie i w jakiej skali czasu. Reguła nie jest więc stałą przyrody, a wielkością wrażliwą na operacjonalizację.

Jedyne badanie na wydarzeniu, jakie udało mi się znaleźć

Godovykh i Hahm opublikowali w Journal of Convention and Event Tourism analizę satysfakcji i lojalności uczestników konferencji naukowych. Kolejność prezentacji nie wpłynęła istotnie ani na satysfakcję, ani na lojalność, a doświadczenie szczytowe blisko końca miało najsilniejszy związek z lojalnością. Bez dostępu do liczebności próby i opisu metody traktuję to jako sygnał, nie dowód.

Ten wynik zestawiam z resztą tak: przesuwanie punktów agendy samo z siebie nie zmienia oceny wydarzenia, a z lojalnością współwystępuje intensywność doświadczenia blisko zakończenia. Przyczynowości nikt tu nie wykazał.

Cztery zastrzeżenia, bez których ta wiedza szkodzi

Zanim ktokolwiek przełoży to na agendę, muszę nazwać granice.

Skala czasu. Eksperymenty mierzyły sekundy i minuty. Konferencja trwa od jednego do trzech dni, z przerwami, snem, dojazdem i życiem zawodowym w tle. Odległość między tymi skalami jest większa niż między klipem filmowym a kolonoskopią.

Domena. Najmocniejszy wynik behawioralny dotyczy bólu fizycznego w procedurze medycznej. Uczestnik konferencji nie znosi malejącego bólu, a podejmuje decyzje o uwadze, kontakcie i powrocie.

Rozmiar efektu. Pół punktu na skali oceny. Iloraz szans 1,41. Próby po 32 osoby w pracach laboratoryjnych. To są efekty umiarkowane, mierzone na małych grupach, a nie dźwignie, które przeważają o jakości wydarzenia.

Trwałość. Efekt słabnie przy ocenie odroczonej, co pokazało badanie VR, a zaniedbanie czasu trwania nie jest absolutne: w materiałach nieprzyjemnych czas korelował z oceną na poziomie 0,26.

Do tego dochodzi brak, którego nie zasypię cytatem. Nie istnieje badanie randomizowane, w którym manipulowano by zakończeniem realnej konferencji i mierzono ocenę albo powrót. Wszystko, co napiszę dalej o wydarzeniach, jest analogią z laboratorium i z gabinetu. Mówię to otwarcie, bo widziałem zbyt wiele prezentacji, w których kolonoskopia służyła jako dowód na to, że po gali trzeba puścić konfetti.

Miejsce na planszę: trzy słupki siły predykcji oceny całości dla doświadczenia wieloepizodowego: prosta średnia 0,3457, średnia ważona czasem 0,3201, model peak-end 0,2583, z podpisem: badanie na 691 turystach, Chark, King, Tang.

Po co wtedy pracować nad zakończeniem

Odpowiedź jest prostsza i mniej efektowna niż ta, którą sprzedaje rynek. Zakończenie nie dźwiga oceny całego wydarzenia, bo ocena bierze się z uśrednienia trzech dni. Jest natomiast ostatnim momentem, w którym uczestnik znajduje się w jednym miejscu, nastroju i kontekście, i w którym da się ustawić jego następne działanie.

Właśnie to mierzył wynik z kolonoskopii: nie ocenę, a powrót. Iloraz szans 1,41 dotyczył faktycznego zgłoszenia się na kolejne badanie wiele lat później i jest to jedyna wielkość w tej literaturze, która ma bezpośredni odpowiednik w arkuszu organizatora.

Rozdzielam więc dwa zadania, które rynek skleił w jedno. Jakość doświadczenia przez cały czas trwania, bo z tego bierze się ocena. I zakończenie jako moment decyzyjny, bo z tego bierze się działanie. Budżet na konfetti finansuje pierwsze przez ostatnie dziesięć minut i nie finansuje drugiego w ogóle.

Co to zmienia w agendzie

Jeżeli zakończenie ma ustawić działanie, jego treścią nie jest emocja, a decyzja. Uczestnik wychodzi z jedną rzeczą do zrobienia i z jednym sposobem, żeby ją zrobić. Reszta scenografii jest obudową.

W praktyce projektowej wygląda to tak. Przed ostatnim punktem agendy odpowiadam na pytanie, jakie konkretne zachowanie ma wystąpić w ciągu najbliższych siedmiu dni. Potem sprawdzam, czy jest ono w ostatnich dwudziestu minutach możliwe do wykonania na miejscu, czy tylko do zadeklarowania. Jeżeli tylko do zadeklarowania, zakończenie nie pracuje, a jedynie się podoba. O podziale wydarzenia na etapy z własnymi zadaniami pisałem w tekście o pięciu fazach imprezy firmowej.

Druga rzecz: zakończenie nie jest końcem wydarzenia, a przejściem do komunikacji po. Bez zaprojektowanego przejścia uczestnik wychodzi w pustkę i wszystko, co ustawiliście w ostatnich minutach, rozsypuje się w ciągu tygodnia. O tym, co dzieje się dalej, napisałem osobno w materiale o obsłudze po wydarzeniu i relacjach z uczestnikami.

Rytuały zamknięcia: co da się powiedzieć, a czego nie

Przy projektowaniu zakończeń pojawia się argument z rytuału. Stoi on na mniejszej podstawie, niż się zwykle podaje.

Vohs, Wang, Gino i Norton wykazali w serii eksperymentów, że rytuał poprzedzający konsumpcję podnosi przyjemność i gotowość do zapłaty. Przy czekoladzie na 52 osobach ocena przyjemności wyniosła 5,95 wobec 5,15, a gotowość do zapłaty 59 wobec 34 centów. Marchewka na 105 osobach dała 4,80 wobec 3,69. Mediatorem okazało się zainteresowanie wewnętrzne.

Dwa ograniczenia. Rytuał był indywidualny i poprzedzał konsumpcję, a nie ją zamykał, a badania prowadzono na studentach. Przeniesienie tego na zbiorowe zamknięcie konferencji dla pięciuset osób jest skokiem, którego nikt nie przebadał.

Wiltermuth i Heath pokazali na grupach trzyosobowych, przy próbach 30, 96 i 105 osób, że synchroniczne działanie podnosi późniejszą współpracę. Poziom szczęścia się nie zmieniał. To jest argument za wspólnym działaniem, nie za wspólnym wzruszeniem.

Czego w tej literaturze nie znalazłem: badań nad rytuałami zamykającymi doświadczenie zbiorowe, replikacji prac Vohs i Wiltermutha na większych próbach oraz polskich badań nad projektowaniem zakończeń. Nie twierdzę, że ich nie ma, a że nie przeszukałem tego obszaru.

Czego nie cytować, mówiąc o zakończeniach

Lista rzeczy, które krążą w branży bez pokrycia, jest dłuższa niż lista ustaleń.

Dokładne liczby z pracy Redelmeiera i Kahnemana z 1996 roku, w szczególności powtarzane stu pięćdziesięciu czterech pacjentów. Teza, że peak-end przewiduje lepiej niż średnia, odwrotna do wyników na doświadczeniach wieloepizodowych. Badanie Do, Ruperta i Wolforda z 2008 roku bez wzmianki o nieudanej replikacji. Praca Garbinsky, Morewedge i Shiva jako dowód, że dobre zakończenie podnosi ocenę całości, bo dotyczy ona czasu do ponownej konsumpcji. Artykuł Nortona i Gino z 2014 roku w sprawie rytuałów zamknięcia. Efekt Zeigarnik. Niezweryfikowane wielkości efektu z metaanaliz synchroniczności.

Dodam jedno z własnej praktyki. Najczęstszy błąd w zakończeniach, które widziałem, polegał nie na braku emocji, a na tym, że po ostatnim punkcie agendy nikt nie wiedział, co ma zrobić w poniedziałek. O domykaniu wydarzenia w cykl zamiast w kropkę pisałem w tekście o pętli eventowej zamiast kropki w kalendarzu.

Pięć pytań do waszego ostatniego punktu agendy

Zamiast checklisty udającej metodę, pięć pytań, które sam zadaję przy projektowaniu zamknięcia.

Pierwsze: jakie zachowanie uczestnika w ciągu siedmiu dni ma być skutkiem wydarzenia? Jeżeli odpowiedź brzmi, że ma dobrze wspominać, zakończenie nie ma czego ustawiać.

Drugie: czy można je zacząć na miejscu, w ostatnich dwudziestu minutach? Podpis, wybór terminu, zapis na coś konkretnego, przekazanie czegoś, co trzeba będzie odesłać.

Trzecie: kto skontaktuje się z uczestnikiem po wydarzeniu, kiedy i w jakiej sprawie? Bez odpowiedzi zakończenie wisi w powietrzu.

Czwarte: czy ocena, którą zbierzecie, mierzy całość, czy nastrój z ostatniej godziny? Ankieta wypełniana przy wyjściu mierzy to drugie, co zmienia sposób czytania wyników.

Piąte: co w zakończeniu jest dla uczestnika, a co dla zarządu klienta? Oba powody są uprawnione, ale mieszanie ich bez świadomości kosztuje czas uczestnika wtedy, gdy jego uwaga jest najdroższa.

Co z tego wynika

Reguła peak-end jest prawdziwa w swojej skali i nieprawdziwa w tej, w której używa jej branża eventowa. Dla wydarzenia trwającego dzień albo trzy ocena bierze się z uśrednienia, nie z finału. Mocne zakończenie nie uratuje słabego programu, słabe nie zniszczy dobrego, a pieniądze przesuwane z programu na finał zwykle pogarszają wynik.

Wartość zakończenia leży gdzie indziej: to ostatni moment kontroli nad kontekstem uczestnika, a jedyny twardy wynik behawioralny w tej literaturze dotyczy powrotu, nie oceny. Jeżeli więc ostatnie dwadzieścia minut mają na coś wpłynąć, niech wpłyną na działanie, a nie na wzruszenie.

FAQ

Czy reguła peak-end jest obalona?

Nie. Jest ograniczona do zdarzeń pojedynczych i spójnych, trwających od sekund do minut, i tam ma mocne potwierdzenie eksperymentalne. Dla doświadczeń rozciągniętych na godziny i dni prostsze modele uśredniające przewidują ocenę całości lepiej, a replikacja na 988 osobach nie wykryła efektu dla prostych doświadczeń pozytywnych. Branża stosuje regułę poza zakresem, w którym ją wykazano.

Czy warto inwestować w mocny finał konferencji?

Warto, ale z innego powodu niż pamięć o wydarzeniu. Finał jest ostatnim momentem, w którym uczestnicy są razem, w jednym nastroju i w zasięgu organizatora, więc to tam najtaniej ustawić konkretne następne działanie. Jeżeli finał ma tylko wywołać emocję i nie prowadzi do żadnej decyzji ani czynności, jego wpływ na wynik biznesowy wydarzenia jest trudny do obronienia.

Kiedy zbierać ocenę wydarzenia, żeby nie mierzyć samego nastroju z finału?

Ankieta wypełniana przy wyjściu mierzy w dużej mierze stan z ostatniej godziny. Jeżeli interesuje was ocena całości, warto zbierać ją też po jednym do trzech dni, kiedy wrażenia się uśrednią, i porównywać oba pomiary. Rozbieżność między nimi sama jest informacją o tym, czy program i finał pracowały w tym samym kierunku.

Co z badaniem kolonoskopii, które wszyscy cytują?

To randomizowane badanie na 682 pacjentach, w którym łagodniejsze zakończenie obniżyło ocenę nieprzyjemności o około pół punktu i podniosło iloraz szans powrotu na kolejne badanie do 1,41 przy p = 0,038. Jest to najmocniejszy dowód behawioralny w tym obszarze i jednocześnie dotyczy bólu fizycznego w procedurze medycznej. Autorzy nazwali je dowodem koncepcyjnym, a przeniesienie go na konferencję jest analogią.

Źródła

Kahneman D., Fredrickson B., Schreiber C., Redelmeier D., Psychological Science 1993: eksperyment z zimną wodą, N = 32 mężczyzn, 60 sekund przy 14,1 stopnia wobec 90 sekund z ocieplaniem do 15,2 stopnia, dyskomfort w 60 sekundzie 8,44 wobec 8,34, spadek o 2,65 w ostatnich 30 sekundach, 22 z 32 wybrały wariant dłuższy, z = 2,15, korelacja wyboru z ogólnym dyskomfortem 0,80, z czasem trwania 0,16. Fredrickson B., Kahneman D., Journal of Personality and Social Psychology 1993: klipy filmowe, N = 32 i N = 96, korelacja czasu trwania z oceną 0,10 i 0,26, po kontroli szczytu i końca 0,06 i minus 0,02. Redelmeier D., Katz J., Kahneman D., Pain 2003: badanie randomizowane, N = 682, grupy 345 i 337, wydłużenie o około 3 minuty, ból w końcówce 1,7 wobec 2,5 przy p poniżej 0,001, ocena retrospektywna 4,4 wobec 4,9, nieprzyjemność 4,1 wobec 4,6, iloraz szans powrotu 1,41 przy p = 0,038, mediana obserwacji 5,3 roku, 50,4 procent powrotów, dowód koncepcyjny wedle samych autorów. Alaybek B. i inni, Organizational Behavior and Human Decision Processes 2022: 174 wielkości efektu, korelacja peak-end z oceną całości 0,581 przy przedziale 0,487 do 0,661, ogólna średnia przewiduje porównywalnie. Miron-Shatz T., Emotion 2009: rekonstrukcja dnia, 810 Amerykanek, 820 Francuzek, 805 Dunek, około 100 pomiarów afektu na osobę dziennie, beta średniej ważonej czasem 0,84 i 0,82, najniższe oceny minus 0,10 do minus 0,13, szczyt 0,006 tylko w próbie amerykańskiej, koniec zaniedbywalny. Kemp S., Burt C., Furneaux L., Memory and Cognition 2008: N = 49 wspomnień wakacji, brak wpływu czasu trwania, peak-end bez dobrej predykcji. Chark R., King B., Tang C., N = 691 turystów w Makau, średni pobyt 1,72 nocy, korelacja oceny całości z prostą średnią 0,3457, ze średnią ważoną czasem 0,3201, z modelem peak-end 0,2583. Strijbosch W. i inni, Frontiers in Psychology 2019: N = 40, materiał VR 14 minut, lepsza predykcja ze średniej walencji i pobudzenia, osłabienie peak-end przy ocenie odroczonej. Mah E., Bernstein D., Journal of Applied Research in Memory and Cognition 2019: N = 988 w wieku od 2 do 97 lat, brak efektu peak-end dla prostych doświadczeń pozytywnych, czynniki Bayesa na rzecz hipotezy zerowej 12 i 3,21, w metaanalizie ich badań 7,77. Scharbert J. i inni, European Journal of Personality 2025: cztery badania metodą próbkowania doświadczeń, 1889 uczestników, 131 575 pomiarów, siła efektu zależna od sformułowania pytania i skali czasu. Godovykh M., Hahm J., Journal of Convention and Event Tourism 2020: konferencje naukowe, kolejność prezentacji bez istotnego wpływu na satysfakcję i lojalność, najsilniejszy związek z lojalnością dla doświadczenia szczytowego blisko końca, bez dostępu do liczebności próby i pełnego opisu metody. Vohs K., Wang Y., Gino F., Norton M., Psychological Science 2013: rytuał przed konsumpcją, N = 52 przyjemność 5,95 wobec 5,15 przy sile efektu 0,73, gotowość do zapłaty 59 wobec 34 centów, N = 105 marchewka 4,80 wobec 3,69, N = 40 rytuał własny wobec obserwowanego 4,55 wobec 3,75, N = 87 mediacja przez zainteresowanie wewnętrzne, próby studenckie, rytuał indywidualny i poprzedzający konsumpcję. Wiltermuth S., Heath C., Psychological Science 2009: grupy trzyosobowe, N = 30, 96 i 105, wzrost współpracy przy działaniu synchronicznym, bez zmiany poziomu szczęścia. Brak badania randomizowanego, w którym manipulowano by zakończeniem realnej konferencji i mierzono ocenę albo powrót uczestników, więc przeniesienie powyższych wyników na wydarzenia B2B jest rozumowaniem przez analogię. Nie przeszukałem literatury nad rytuałami zamykającymi doświadczenie zbiorowe, replikacji prac Vohs i Wiltermutha ani polskich badań nad projektowaniem zakończeń wydarzeń. Konsultacja indywidualna dotycząca projektowania zakończenia i domknięcia wydarzenia: rozmowa o waszym wydarzeniu.

Było pomocne? Podaj dalej
→ Zobacz pozostałe artykuły

Przeczytaj również

ZGARNIJ BONUSY!

Dołącz do społeczności świadomych marketerów i otrzymaj pakiet bonusów za darmo! 🎉 Co 2 tygodnie wyślemy Ci też newsletter pełen konkretnych inspiracji z obszaru marketingu doświadczeń.

Dziękujemy! Zapisaliśmy Cię do Newslettera
Ups! Coś poszło nie tak