Body Battery, Recovery, Readiness: 14 „ocen gotowości” u 10 marek — i ani jednej opublikowanej formuły

W maju Google wypuścił Fitbit Air — opaskę bez ekranu, w której najważniejszą liczbą jest „gotowość”. Takie wskaźniki mają Garmin, WHOOP, Oura, Polar i Coros. Analiza z 2025 roku znalazła 14 podobnych ocen u 10 producentów: nikt nie ujawnił formuły, a weryfikację względem metody referencyjnej pokazało zaledwie kilku. Za to część surowych danych, na których się opierają, jest mierzona całkiem przyzwoicie.

Body Battery, Recovery, Readiness: 14 „ocen gotowości” u 10 marek — i ani jednej opublikowanej formuły

7 maja 2026 roku Google wypuścił Fitbit Air — opaskę bez ekranu za $99,99. Waży 12 gramów razem z paskiem, sama niczego nie wyświetla, a najważniejsze, co użytkownik widzi rano w aplikacji, to Readiness Score, czyli „gotowość” do obciążenia. Ta sama idea żyje w urządzeniach Garmin (Body Battery i Training Readiness), WHOOP (Recovery), Oura (Readiness) i Polar (Nightly Recharge). Jedna liczba od 0 do 100 decyduje, czy dziś biec interwały.

Pytanie, które warto zadać, zanim zaczniesz przebudowywać plan: czym jest ta liczba i czy ktokolwiek sprawdził, że oznacza to, co obiecuje?

Co sprawdzono

W 2025 roku Cathal Doherty i współautorzy — wśród nich Marco Altini, twórca aplikacji HRV4Training — opublikowali w Translational Exercise Biomedicine pierwszą systematyczną analizę takich wskaźników. Autorzy nazywają je złożonymi wskaźnikami zdrowia (Composite Health Scores): to jedna liczba zbudowana z kilku sygnałów czujnika.

Metoda jest prosta i wymowna. Badacze zebrali wszystko, co producenci publikują sami: techniczne white papers, instrukcje, ekrany aplikacji, artykuły naukowe, jeśli takie istnieją. I sprawdzili, z czego zbudowana jest każda ocena.

Znaleziono 14 ocen u 10 producentów:

  • Fitbit — Daily Readiness;
  • Garmin — Body Battery i Training Readiness;
  • Oura — Readiness i Resilience;
  • WHOOP — Strain, Recovery i Stress Monitor;
  • Polar — Nightly Recharge;
  • Samsung — Energy Score;
  • Suunto — Body Resources;
  • Ultrahuman — Dynamic Recovery;
  • Coros — Daily Stress;
  • Withings — Health Improvement Score.

Co jest w środku

Skład jest u wszystkich podobny:

  • zmienność rytmu serca (HRV) — w 12 ocenach z 14 (86%);
  • tętno spoczynkowe — w 11 z 14 (79%);
  • aktywność w ciągu dnia — w 10 z 14 (71%);
  • długość snu — w 10 z 14 (71%).

Dalej zaczynają się rozbieżności. Różne okna zbierania danych: jedne oceny liczy się na podstawie ostatniej nocy, inne uśredniają kilka dni, a Body Battery Garmina w ogóle „zużywa się” w ciągu dnia. Różne wagi składników. Różne zasady liczenia.

I najważniejsze: żaden producent nie ujawnił dokładnej formuły. Empiryczną weryfikację lub recenzowane dane potwierdzające, że ocena jest dokładna i coś znaczy dla zdrowia lub wyników, przedstawiło zaledwie kilku. Wniosek autorów: idea jest obiecująca, ale naukowe uzasadnienie, przejrzystość i kliniczna użyteczność takich wskaźników pozostają niejasne.

To nie znaczy, że te liczby są przypadkowe. To znaczy, że nikt z zewnątrz nie jest w stanie powiedzieć, na ile można im ufać.

A surowe dane pod oceną?

Tu dane są. W tym samym 2025 roku Michael Dial i współautorzy (Physiological Reports) sprawdzili nocne tętno spoczynkowe i HRV z pięciu urządzeń względem EKG: 13 zdrowych dorosłych (6 kobiet) spało jednocześnie z referencyjnym EKG i kilkoma gadżetami, łącznie 536 nocy.

HRV — zgodność z EKG (współczynnik zgodności Lina, CCC) i średni błąd bezwzględny:

  • Oura Gen 4 — CCC 0,99, błąd 5,96%;
  • Oura Gen 3 — 0,97, 7,15%;
  • WHOOP 4.0 — 0,94, 8,17%;
  • Garmin Fenix 6 — 0,87, 10,52%;
  • Polar Grit X Pro — 0,82, 16,32%.

Tętno spoczynkowe jest mierzone lepiej: w Oura błąd wynosi 1,67–1,94%, w Polarze — 2,71%, w WHOOP — 3,00%. Garmina wyłączono z analizy tętna spoczynkowego z powodu rozbieżności metodologicznych.

Jedno zdanie z sekcji ograniczeń tej pracy warto przytoczyć choćby w parafrazie: każde urządzenie ma własny algorytm i prawie nic nie wiadomo o tym, jakie metryki i z jaką wagą składają się na „gotowość” czy „regenerację”, które ostatecznie widzi użytkownik. Algorytmy są ponadto co jakiś czas aktualizowane.

Dlaczego jedna liczba wprowadza w błąd

Nakładają się na siebie trzy warstwy niepewności.

  1. Błąd czujnika. Jeśli nocna HRV myli się średnio o 10–16%, to poranne „minus 8% względem normy” może być szumem urządzenia, a nie zmęczeniem.
  2. Sen jest liczony gorzej, niż się wydaje. Trackery nieźle wychwytują sen, ale słabo — czuwanie: noc z przebudzeniami wygląda na dłuższą i lepszą, niż była. A długość snu wchodzi w skład 71% ocen.
  3. Nieznane wagi i okna. Dwie oceny u tej samej osoby mogą różnić się zupełnie zasadnie tylko dlatego, że jedna patrzy na ostatnią noc, a druga — na cały tydzień.

Dlatego porównywanie „gotowości” między markami nie ma sensu, a po zmianie zegarka lub aktualizacji oprogramowania starej historii lepiej nie uznawać za porównywalną.

Jak to stosować

  • Patrz na składniki, a nie na wynik końcowy. Poranne HRV i tętno spoczynkowe względem twojej osobistej normy — to coś, co zostało przynajmniej częściowo zweryfikowane. Jak planować treningi według HRV bez oszukiwania samego siebie — w tekście o treningu sterowanym HRV.
  • Jeden dzień to szum, kilka dni to sygnał. HRV poniżej normy i podwyższone tętno spoczynkowe przez kilka poranków z rzędu znaczą więcej niż jedna czerwona liczba.
  • Konfrontuj ocenę z odczuciami. Czerwona „gotowość”, ale rozgrzewka idzie lekko, a tętno w zwykłym tempie jest normalne — trening można zrobić, ewentualnie skracając objętość. Zielona liczba przy ciężkich nogach i wysokim odczuwanym wysiłku — to nie powód, żeby cisnąć.
  • Jedno urządzenie, te same warunki. To samo urządzenie, ta sama ręka lub ten sam palec, pomiar w nocy. Nie porównuj ze sobą liczb z różnych marek.
  • Wybierasz gadżet ze względu na HRV — w weryfikacji Diala pierścień Oura i WHOOP były bardziej zgodne z EKG niż zegarki Garmin i Polar. Na samych treningach interwałowych tętno wciąż dokładniej mierzy pas piersiowy.
  • Strefy ustalaj na podstawie testów, a nie „gotowości”. Ocena nie zna twojego progu — to zadanie generatora stref, który korzysta z wyników testu.

Najważniejsze

  • Analiza z 2025 roku znalazła 14 złożonych ocen u 10 producentów — Fitbit, Garmin, Oura, WHOOP, Polar, Samsung, Suunto, Ultrahuman, Coros, Withings.
  • W środku prawie zawsze są HRV (86%), tętno spoczynkowe (79%), aktywność i sen (po 71%), ale okna, wagi i formuły są u wszystkich różne i nieujawnione; walidację przedstawiło zaledwie kilku.
  • Surowe dane są mierzone nierówno: nocna HRV w Oura myli się o 6–7%, w WHOOP — o 8%, w Garmin Fenix 6 — o 10,5%, w Polar Grit X Pro — o 16%.
  • Korzystaj z trendu HRV i tętna spoczynkowego z kilku dni oraz z własnych odczuć, a liczbę „gotowości” traktuj jako przypomnienie, żeby na nie spojrzeć, a nie jako decyzję.

Źródła: Doherty C., Baldwin M., Lambe R., Burke D., Altini M. „Readiness, recovery, and strain: an evaluation of composite health scores in consumer wearables”. Translational Exercise Biomedicine, 2025;2:128–144. DOI: 10.1515/teb-2025-0001 · Dial M.B., Hollander M.E., Vatne E.A., Emerson A.M., Edwards N.A., Hagen J.A. „Validation of nocturnal resting heart rate and heart rate variability in consumer wearables”. Physiological Reports, 2025;13(16):e70527. DOI: 10.14814/phy2.70527