Event Marketing Institute Sp. z o.o.
Iwonicka 3, 60-473 Poznań
NIP 7812066079
REGON 527890052
KRS 0001090243
REGON 527890052
KRS 0001090243
© 2024 Kalewski copy
Najważniejsze tezy: Rynek projektuje mocne zakończenia, powołując się na regułę peak-end. Dla wydarzeń wielodniowych ta reguła nie trzyma: na realnych doświadczeniach zwykła średnia ocen z całości przewiduje ocenę końcową lepiej niż kombinacja momentu szczytowego i ostatniego. Zakończenie nie dźwiga pamięci całego wydarzenia, jest natomiast jedynym momentem, w którym da się ustawić następne działanie uczestnika, i tylko to jego znaczenie ma pokrycie w danych.
- W badaniu na 691 turystach prosta średnia korelowała z oceną całości na poziomie 0,3457, średnia ważona czasem 0,3201, a model peak-end 0,2583.
- Próba replikacji na 988 osobach w wieku od 2 do 97 lat nie wykryła efektu peak-end dla prostych pozytywnych doświadczeń.
- Jedyny randomizowany wynik behawioralny dotyczący łagodnego zakończenia pochodzi z medycyny i daje iloraz szans powrotu 1,41 przy p = 0,038.
- Przeniesienie tych wyników na konferencję B2B jest rozumowaniem przez analogię, dopóki nikt nie zrobi eksperymentu na realnym wydarzeniu.
Na każdym szkoleniu z projektowania doświadczeń pada ta sama teza: uczestnik zapamięta szczyt i koniec, więc zaprojektuj mocne zakończenie. Ma ona źródło w prawdziwych badaniach i ma nazwę. Problem polega na tym, że te badania mierzyły zjawisko innej skali, a próby przeniesienia ich wyników na doświadczenia dłuższe niż kilka minut wychodzą blado albo wcale.
Nie piszę tego, żeby zdjąć zakończenie z listy rzeczy wartych uwagi, a żeby zmienić jego uzasadnienie, bo z fałszywego uzasadnienia biorą się fałszywe decyzje budżetowe. Powód, dla którego zakończenie jest warte pracy, jest inny niż ten podawany przez rynek, i bardziej użyteczny.
Oryginalny eksperyment Kahnemana, Fredrickson, Schreibera i Redelmeiera z 1993 roku wyglądał tak: 32 mężczyzn trzymało rękę w zimnej wodzie. Pierwszy warunek to 60 sekund przy 14,1 stopnia, drugi to te same 60 sekund plus kolejne 30, w czasie których woda ocieplała się do 15,2 stopnia. Dyskomfort w sześćdziesiątej sekundzie był praktycznie identyczny, 8,44 wobec 8,34, a w ostatnich trzydziestu sekundach wariantu dłuższego spadł o 2,65 punktu.
Potem uczestnicy wybierali, który wariant chcą powtórzyć. Dwudziestu dwóch z trzydziestu dwóch wybrało dłuższy, czyli obiektywnie więcej bólu, z = 2,15. Korelacja wyboru z ogólną oceną dyskomfortu wyniosła 0,80, a z czasem trwania 0,16. Stąd dwa wnioski: ocena retrospektywna opiera się na momentach szczególnych, a czas trwania jest w niej zaniedbywany.
Rok później ci sami autorzy powtórzyli to na klipach filmowych, na grupach 32 i 96 osób. Czas trwania korelował z oceną na poziomie 0,10 dla materiałów przyjemnych i 0,26 dla nieprzyjemnych, a po uwzględnieniu szczytu i końca zostawało 0,06 i minus 0,02.
Najmocniejszy dowód behawioralny nie pochodzi z laboratorium. Redelmeier, Katz i Kahneman opublikowali w 2003 roku w czasopiśmie Pain badanie randomizowane na 682 pacjentach poddawanych kolonoskopii: 345 z wydłużonym o około trzy minuty, łagodniejszym zakończeniem i 337 w grupie kontrolnej.
Wyniki: ból w końcówce 1,7 wobec 2,5 przy p poniżej 0,001, ocena retrospektywna 4,4 wobec 4,9, nieprzyjemność 4,1 wobec 4,6. I rzecz, która interesuje organizatora najbardziej: iloraz szans zgłoszenia się na kolejne badanie wyniósł 1,41 przy p = 0,038, przy medianie obserwacji 5,3 roku i 50,4 procent powrotów.
Autorzy sami nazwali to dowodem koncepcyjnym, nie rekomendacją kliniczną. Patrzę na to z dwóch stron jednocześnie. Jest to jedyne znane mi randomizowane badanie, w którym zmiana samego zakończenia przełożyła się na faktyczne zachowanie wiele lat później, a jednocześnie różnica w ocenie wynosiła pół punktu na skali, zaś iloraz szans 1,41 jest efektem umiarkowanym.
Tu zaczyna się część, której rynek eventowy nie przyswoił. Gdy badacze wyszli z laboratorium na doświadczenia rozciągnięte na godziny i dni, model peak-end zaczął przegrywać z prostszymi.
Chark, King i Tang zbadali 691 turystów w Makau, przy średnim pobycie 1,72 nocy, i policzyli trzy modele przewidywania oceny całego pobytu. Prosta średnia ocen epizodów: r = 0,3457. Ważona czasem: 0,3201. Peak-end: 0,2583. Autorzy napisali wprost, że nie ma tu skrótu poznawczego zastępującego uśrednianie.
Miron-Shatz pracowała w 2009 roku na rekonstrukcji dnia u 810 Amerykanek, 820 Francuzek i 805 Dunek, z około setką pomiarów afektu na osobę dziennie. Średnia ważona czasem przewidywała ocenę dnia ze współczynnikiem 0,84 i 0,82, najniższe oceny miały wagę od minus 0,10 do minus 0,13, szczyt dawał 0,006 i tylko w próbie amerykańskiej, a koniec był zaniedbywalny. Wniosek autorki: peak-end dotyczy zdarzeń pojedynczych i spójnych, a dzień ani pobyt takim zdarzeniem nie są.
Kemp, Burt i Furneaux badali wspomnienia 49 wakacji: czas trwania nie miał wpływu na ocenę, peak-end również nie okazał się dobrym predyktorem. Strijbosch i współpracownicy w 2019 roku pokazali na 40 osobach i czternastominutowym materiale VR, że średnia walencji i pobudzenia przewiduje lepiej, a efekt peak-end słabnie przy ocenie odroczonej.
Najtwardszy wynik należy do Mah i Bernsteina: 988 osób w wieku od 2 do 97 lat, proste doświadczenia pozytywne, brak efektu peak-end. Czynniki Bayesa na rzecz hipotezy zerowej wyniosły 12 i 3,21, a w metaanalizie ich badań 7,77. Nie jest to wynik nieistotny statystycznie, który można odłożyć jako za małą próbę, a dowód na brak efektu.
Alaybek i współautorzy w 2022 roku w OBHDP przejrzeli 174 wielkości efektu. Korelacja peak-end z oceną całości wyniosła 0,581 przy przedziale ufności od 0,487 do 0,661, więc wysoko. W tej samej pracy ogólna średnia przewidywała porównywalnie dobrze. Jeżeli dwa modele przewidują równie dobrze, a jeden jest prostszy w zastosowaniu, decyzja projektowa jest oczywista.
Scharbert i współautorzy w 2025 roku w European Journal of Personality poszli dalej: cztery badania metodą próbkowania doświadczeń, 1889 uczestników, 131 575 pomiarów. Siła efektu zależała od tego, jak zadano pytanie i w jakiej skali czasu. Reguła nie jest więc stałą przyrody, a wielkością wrażliwą na operacjonalizację.
Godovykh i Hahm opublikowali w Journal of Convention and Event Tourism analizę satysfakcji i lojalności uczestników konferencji naukowych. Kolejność prezentacji nie wpłynęła istotnie ani na satysfakcję, ani na lojalność, a doświadczenie szczytowe blisko końca miało najsilniejszy związek z lojalnością. Bez dostępu do liczebności próby i opisu metody traktuję to jako sygnał, nie dowód.
Ten wynik zestawiam z resztą tak: przesuwanie punktów agendy samo z siebie nie zmienia oceny wydarzenia, a z lojalnością współwystępuje intensywność doświadczenia blisko zakończenia. Przyczynowości nikt tu nie wykazał.
Zanim ktokolwiek przełoży to na agendę, muszę nazwać granice.
Skala czasu. Eksperymenty mierzyły sekundy i minuty. Konferencja trwa od jednego do trzech dni, z przerwami, snem, dojazdem i życiem zawodowym w tle. Odległość między tymi skalami jest większa niż między klipem filmowym a kolonoskopią.
Domena. Najmocniejszy wynik behawioralny dotyczy bólu fizycznego w procedurze medycznej. Uczestnik konferencji nie znosi malejącego bólu, a podejmuje decyzje o uwadze, kontakcie i powrocie.
Rozmiar efektu. Pół punktu na skali oceny. Iloraz szans 1,41. Próby po 32 osoby w pracach laboratoryjnych. To są efekty umiarkowane, mierzone na małych grupach, a nie dźwignie, które przeważają o jakości wydarzenia.
Trwałość. Efekt słabnie przy ocenie odroczonej, co pokazało badanie VR, a zaniedbanie czasu trwania nie jest absolutne: w materiałach nieprzyjemnych czas korelował z oceną na poziomie 0,26.
Do tego dochodzi brak, którego nie zasypię cytatem. Nie istnieje badanie randomizowane, w którym manipulowano by zakończeniem realnej konferencji i mierzono ocenę albo powrót. Wszystko, co napiszę dalej o wydarzeniach, jest analogią z laboratorium i z gabinetu. Mówię to otwarcie, bo widziałem zbyt wiele prezentacji, w których kolonoskopia służyła jako dowód na to, że po gali trzeba puścić konfetti.
Miejsce na planszę: trzy słupki siły predykcji oceny całości dla doświadczenia wieloepizodowego: prosta średnia 0,3457, średnia ważona czasem 0,3201, model peak-end 0,2583, z podpisem: badanie na 691 turystach, Chark, King, Tang.
Odpowiedź jest prostsza i mniej efektowna niż ta, którą sprzedaje rynek. Zakończenie nie dźwiga oceny całego wydarzenia, bo ocena bierze się z uśrednienia trzech dni. Jest natomiast ostatnim momentem, w którym uczestnik znajduje się w jednym miejscu, nastroju i kontekście, i w którym da się ustawić jego następne działanie.
Właśnie to mierzył wynik z kolonoskopii: nie ocenę, a powrót. Iloraz szans 1,41 dotyczył faktycznego zgłoszenia się na kolejne badanie wiele lat później i jest to jedyna wielkość w tej literaturze, która ma bezpośredni odpowiednik w arkuszu organizatora.
Rozdzielam więc dwa zadania, które rynek skleił w jedno. Jakość doświadczenia przez cały czas trwania, bo z tego bierze się ocena. I zakończenie jako moment decyzyjny, bo z tego bierze się działanie. Budżet na konfetti finansuje pierwsze przez ostatnie dziesięć minut i nie finansuje drugiego w ogóle.
Jeżeli zakończenie ma ustawić działanie, jego treścią nie jest emocja, a decyzja. Uczestnik wychodzi z jedną rzeczą do zrobienia i z jednym sposobem, żeby ją zrobić. Reszta scenografii jest obudową.
W praktyce projektowej wygląda to tak. Przed ostatnim punktem agendy odpowiadam na pytanie, jakie konkretne zachowanie ma wystąpić w ciągu najbliższych siedmiu dni. Potem sprawdzam, czy jest ono w ostatnich dwudziestu minutach możliwe do wykonania na miejscu, czy tylko do zadeklarowania. Jeżeli tylko do zadeklarowania, zakończenie nie pracuje, a jedynie się podoba. O podziale wydarzenia na etapy z własnymi zadaniami pisałem w tekście o pięciu fazach imprezy firmowej.
Druga rzecz: zakończenie nie jest końcem wydarzenia, a przejściem do komunikacji po. Bez zaprojektowanego przejścia uczestnik wychodzi w pustkę i wszystko, co ustawiliście w ostatnich minutach, rozsypuje się w ciągu tygodnia. O tym, co dzieje się dalej, napisałem osobno w materiale o obsłudze po wydarzeniu i relacjach z uczestnikami.
Przy projektowaniu zakończeń pojawia się argument z rytuału. Stoi on na mniejszej podstawie, niż się zwykle podaje.
Vohs, Wang, Gino i Norton wykazali w serii eksperymentów, że rytuał poprzedzający konsumpcję podnosi przyjemność i gotowość do zapłaty. Przy czekoladzie na 52 osobach ocena przyjemności wyniosła 5,95 wobec 5,15, a gotowość do zapłaty 59 wobec 34 centów. Marchewka na 105 osobach dała 4,80 wobec 3,69. Mediatorem okazało się zainteresowanie wewnętrzne.
Dwa ograniczenia. Rytuał był indywidualny i poprzedzał konsumpcję, a nie ją zamykał, a badania prowadzono na studentach. Przeniesienie tego na zbiorowe zamknięcie konferencji dla pięciuset osób jest skokiem, którego nikt nie przebadał.
Wiltermuth i Heath pokazali na grupach trzyosobowych, przy próbach 30, 96 i 105 osób, że synchroniczne działanie podnosi późniejszą współpracę. Poziom szczęścia się nie zmieniał. To jest argument za wspólnym działaniem, nie za wspólnym wzruszeniem.
Czego w tej literaturze nie znalazłem: badań nad rytuałami zamykającymi doświadczenie zbiorowe, replikacji prac Vohs i Wiltermutha na większych próbach oraz polskich badań nad projektowaniem zakończeń. Nie twierdzę, że ich nie ma, a że nie przeszukałem tego obszaru.
Lista rzeczy, które krążą w branży bez pokrycia, jest dłuższa niż lista ustaleń.
Dokładne liczby z pracy Redelmeiera i Kahnemana z 1996 roku, w szczególności powtarzane stu pięćdziesięciu czterech pacjentów. Teza, że peak-end przewiduje lepiej niż średnia, odwrotna do wyników na doświadczeniach wieloepizodowych. Badanie Do, Ruperta i Wolforda z 2008 roku bez wzmianki o nieudanej replikacji. Praca Garbinsky, Morewedge i Shiva jako dowód, że dobre zakończenie podnosi ocenę całości, bo dotyczy ona czasu do ponownej konsumpcji. Artykuł Nortona i Gino z 2014 roku w sprawie rytuałów zamknięcia. Efekt Zeigarnik. Niezweryfikowane wielkości efektu z metaanaliz synchroniczności.
Dodam jedno z własnej praktyki. Najczęstszy błąd w zakończeniach, które widziałem, polegał nie na braku emocji, a na tym, że po ostatnim punkcie agendy nikt nie wiedział, co ma zrobić w poniedziałek. O domykaniu wydarzenia w cykl zamiast w kropkę pisałem w tekście o pętli eventowej zamiast kropki w kalendarzu.
Zamiast checklisty udającej metodę, pięć pytań, które sam zadaję przy projektowaniu zamknięcia.
Pierwsze: jakie zachowanie uczestnika w ciągu siedmiu dni ma być skutkiem wydarzenia? Jeżeli odpowiedź brzmi, że ma dobrze wspominać, zakończenie nie ma czego ustawiać.
Drugie: czy można je zacząć na miejscu, w ostatnich dwudziestu minutach? Podpis, wybór terminu, zapis na coś konkretnego, przekazanie czegoś, co trzeba będzie odesłać.
Trzecie: kto skontaktuje się z uczestnikiem po wydarzeniu, kiedy i w jakiej sprawie? Bez odpowiedzi zakończenie wisi w powietrzu.
Czwarte: czy ocena, którą zbierzecie, mierzy całość, czy nastrój z ostatniej godziny? Ankieta wypełniana przy wyjściu mierzy to drugie, co zmienia sposób czytania wyników.
Piąte: co w zakończeniu jest dla uczestnika, a co dla zarządu klienta? Oba powody są uprawnione, ale mieszanie ich bez świadomości kosztuje czas uczestnika wtedy, gdy jego uwaga jest najdroższa.
Reguła peak-end jest prawdziwa w swojej skali i nieprawdziwa w tej, w której używa jej branża eventowa. Dla wydarzenia trwającego dzień albo trzy ocena bierze się z uśrednienia, nie z finału. Mocne zakończenie nie uratuje słabego programu, słabe nie zniszczy dobrego, a pieniądze przesuwane z programu na finał zwykle pogarszają wynik.
Wartość zakończenia leży gdzie indziej: to ostatni moment kontroli nad kontekstem uczestnika, a jedyny twardy wynik behawioralny w tej literaturze dotyczy powrotu, nie oceny. Jeżeli więc ostatnie dwadzieścia minut mają na coś wpłynąć, niech wpłyną na działanie, a nie na wzruszenie.
Nie. Jest ograniczona do zdarzeń pojedynczych i spójnych, trwających od sekund do minut, i tam ma mocne potwierdzenie eksperymentalne. Dla doświadczeń rozciągniętych na godziny i dni prostsze modele uśredniające przewidują ocenę całości lepiej, a replikacja na 988 osobach nie wykryła efektu dla prostych doświadczeń pozytywnych. Branża stosuje regułę poza zakresem, w którym ją wykazano.
Warto, ale z innego powodu niż pamięć o wydarzeniu. Finał jest ostatnim momentem, w którym uczestnicy są razem, w jednym nastroju i w zasięgu organizatora, więc to tam najtaniej ustawić konkretne następne działanie. Jeżeli finał ma tylko wywołać emocję i nie prowadzi do żadnej decyzji ani czynności, jego wpływ na wynik biznesowy wydarzenia jest trudny do obronienia.
Ankieta wypełniana przy wyjściu mierzy w dużej mierze stan z ostatniej godziny. Jeżeli interesuje was ocena całości, warto zbierać ją też po jednym do trzech dni, kiedy wrażenia się uśrednią, i porównywać oba pomiary. Rozbieżność między nimi sama jest informacją o tym, czy program i finał pracowały w tym samym kierunku.
To randomizowane badanie na 682 pacjentach, w którym łagodniejsze zakończenie obniżyło ocenę nieprzyjemności o około pół punktu i podniosło iloraz szans powrotu na kolejne badanie do 1,41 przy p = 0,038. Jest to najmocniejszy dowód behawioralny w tym obszarze i jednocześnie dotyczy bólu fizycznego w procedurze medycznej. Autorzy nazwali je dowodem koncepcyjnym, a przeniesienie go na konferencję jest analogią.
Kahneman D., Fredrickson B., Schreiber C., Redelmeier D., Psychological Science 1993: eksperyment z zimną wodą, N = 32 mężczyzn, 60 sekund przy 14,1 stopnia wobec 90 sekund z ocieplaniem do 15,2 stopnia, dyskomfort w 60 sekundzie 8,44 wobec 8,34, spadek o 2,65 w ostatnich 30 sekundach, 22 z 32 wybrały wariant dłuższy, z = 2,15, korelacja wyboru z ogólnym dyskomfortem 0,80, z czasem trwania 0,16. Fredrickson B., Kahneman D., Journal of Personality and Social Psychology 1993: klipy filmowe, N = 32 i N = 96, korelacja czasu trwania z oceną 0,10 i 0,26, po kontroli szczytu i końca 0,06 i minus 0,02. Redelmeier D., Katz J., Kahneman D., Pain 2003: badanie randomizowane, N = 682, grupy 345 i 337, wydłużenie o około 3 minuty, ból w końcówce 1,7 wobec 2,5 przy p poniżej 0,001, ocena retrospektywna 4,4 wobec 4,9, nieprzyjemność 4,1 wobec 4,6, iloraz szans powrotu 1,41 przy p = 0,038, mediana obserwacji 5,3 roku, 50,4 procent powrotów, dowód koncepcyjny wedle samych autorów. Alaybek B. i inni, Organizational Behavior and Human Decision Processes 2022: 174 wielkości efektu, korelacja peak-end z oceną całości 0,581 przy przedziale 0,487 do 0,661, ogólna średnia przewiduje porównywalnie. Miron-Shatz T., Emotion 2009: rekonstrukcja dnia, 810 Amerykanek, 820 Francuzek, 805 Dunek, około 100 pomiarów afektu na osobę dziennie, beta średniej ważonej czasem 0,84 i 0,82, najniższe oceny minus 0,10 do minus 0,13, szczyt 0,006 tylko w próbie amerykańskiej, koniec zaniedbywalny. Kemp S., Burt C., Furneaux L., Memory and Cognition 2008: N = 49 wspomnień wakacji, brak wpływu czasu trwania, peak-end bez dobrej predykcji. Chark R., King B., Tang C., N = 691 turystów w Makau, średni pobyt 1,72 nocy, korelacja oceny całości z prostą średnią 0,3457, ze średnią ważoną czasem 0,3201, z modelem peak-end 0,2583. Strijbosch W. i inni, Frontiers in Psychology 2019: N = 40, materiał VR 14 minut, lepsza predykcja ze średniej walencji i pobudzenia, osłabienie peak-end przy ocenie odroczonej. Mah E., Bernstein D., Journal of Applied Research in Memory and Cognition 2019: N = 988 w wieku od 2 do 97 lat, brak efektu peak-end dla prostych doświadczeń pozytywnych, czynniki Bayesa na rzecz hipotezy zerowej 12 i 3,21, w metaanalizie ich badań 7,77. Scharbert J. i inni, European Journal of Personality 2025: cztery badania metodą próbkowania doświadczeń, 1889 uczestników, 131 575 pomiarów, siła efektu zależna od sformułowania pytania i skali czasu. Godovykh M., Hahm J., Journal of Convention and Event Tourism 2020: konferencje naukowe, kolejność prezentacji bez istotnego wpływu na satysfakcję i lojalność, najsilniejszy związek z lojalnością dla doświadczenia szczytowego blisko końca, bez dostępu do liczebności próby i pełnego opisu metody. Vohs K., Wang Y., Gino F., Norton M., Psychological Science 2013: rytuał przed konsumpcją, N = 52 przyjemność 5,95 wobec 5,15 przy sile efektu 0,73, gotowość do zapłaty 59 wobec 34 centów, N = 105 marchewka 4,80 wobec 3,69, N = 40 rytuał własny wobec obserwowanego 4,55 wobec 3,75, N = 87 mediacja przez zainteresowanie wewnętrzne, próby studenckie, rytuał indywidualny i poprzedzający konsumpcję. Wiltermuth S., Heath C., Psychological Science 2009: grupy trzyosobowe, N = 30, 96 i 105, wzrost współpracy przy działaniu synchronicznym, bez zmiany poziomu szczęścia. Brak badania randomizowanego, w którym manipulowano by zakończeniem realnej konferencji i mierzono ocenę albo powrót uczestników, więc przeniesienie powyższych wyników na wydarzenia B2B jest rozumowaniem przez analogię. Nie przeszukałem literatury nad rytuałami zamykającymi doświadczenie zbiorowe, replikacji prac Vohs i Wiltermutha ani polskich badań nad projektowaniem zakończeń wydarzeń. Konsultacja indywidualna dotycząca projektowania zakończenia i domknięcia wydarzenia: rozmowa o waszym wydarzeniu.
Dołącz do społeczności świadomych marketerów i otrzymaj pakiet bonusów za darmo! 🎉 Co 2 tygodnie wyślemy Ci też newsletter pełen konkretnych inspiracji z obszaru marketingu doświadczeń.