Life style

스마트워치 수면 점수 정확도

테크플렉스 2026. 8. 26. 13:14
반응형

아침마다 손목시계가 점수를 줍니다. 깊은잠 42분, 렘수면 1시간 8분, 수면 점수 78점. 이 숫자들이 어디까지 검증된 것인지 실제 비교 연구를 찾아봤습니다.

잠든 건 잘 맞히고, 깬 건 못 맞힙니다

수면 연구의 기준은 수면다원검사(PSG)입니다. 뇌파·안구운동·근전도·호흡을 동시에 재서 사람이 30초 단위로 판독합니다. 손목시계는 이걸 맥박과 움직임으로 흉내 냅니다.

학술지 Sleep Advances 에 2025년 실린 검증 연구는 성인 62명에게 웨어러블 6종을 채우고 같은 밤 수면다원검사를 함께 돌렸습니다. 결과는 한쪽으로 확실히 기울었습니다.

진한 부분은 6종 중 가장 낮은 값, 연한 부분은 가장 높은 값까지의 범위입니다. 이 글의 도해 3개는 개념 설명을 위해 직접 그린 것입니다.

 

이 비대칭이 무슨 뜻인지가 중요합니다. 손목시계는 가만히 있으면 자고 있다고 판단합니다. 그래서 실제로 잠든 시간은 거의 놓치지 않습니다. 반대로 새벽에 눈을 뜨고 천장을 보며 뒤척이지 않고 누워 있으면, 시계는 그 시간을 수면으로 셉니다. 잠이 안 와서 힘든 사람일수록 시계가 관대해지는 구조입니다.

깊은잠·렘수면 비율이 흔들리는 이유

같은 연구가 4단계(각성·얕은잠·깊은잠·렘수면) 판정을 코헨 카파(κ)로 쟀습니다. κ 는 우연히 맞을 확률을 빼고 남은 일치도입니다. 1이면 완전 일치, 0이면 찍은 것과 같습니다.

가장 잘한 기기도 κ 0.53 입니다. 통계학에서 0.41~0.60 은 '보통 수준의 일치'로 읽습니다.

 

가장 잘한 애플워치 시리즈 8이 0.53, 가장 낮은 가민 비보스마트 4가 0.21입니다. 두 배 넘게 벌어집니다. 어제 쓰던 시계와 오늘 바꾼 시계의 '깊은잠 42분'은 같은 뜻이 아닙니다. 기기를 바꾼 뒤 깊은잠이 늘거나 줄었다면 몸이 아니라 알고리즘이 바뀐 것일 가능성이 큽니다.

연구진의 결론도 조심스럽습니다. 카파가 높은 축인 핏빗 센스·차지 5·애플워치 정도는 오래 이어지는 큰 변화를 따라가는 데 쓸 수 있지만, 임상 진단에서 수면다원검사를 대신하지는 못한다고 못 박았습니다.

그런데 수면 데이터 자체는 대단한 걸 담고 있습니다

여기서 헷갈리기 쉬운 뉴스가 하나 있습니다. 2026년 1월 6일 네이처 메디신에 실린 스탠퍼드의 SleepFM 연구입니다. 하룻밤 수면 기록으로 앞으로 생길 질환 130가지의 위험을 예측하는 모델입니다.

질환 C-index
파킨슨병 0.89
치매 0.85
고혈압성 심장질환 0.84
심근경색 0.81

약 6만 5천 명의 수면 기록 58만 5천 시간으로 학습했고, 130개 질환에서 C-index 0.75 이상을 냈습니다. C-index 는 0.5가 동전 던지기, 1.0이 완벽한 예측입니다.

다만 이 모델이 먹은 데이터는 수면다원검사 기록입니다. 뇌파를 포함한 다채널 신호이지 손목시계의 맥박·가속도 데이터가 아닙니다. "잠을 재면 병이 보인다"는 결론은 맞지만, 그 문장이 내 손목시계에 그대로 적용되지는 않습니다. 기사 제목만 보고 시계 점수를 건강검진처럼 읽으면 곤란합니다.

무엇을 보고 무엇을 흘려들을까

총 수면시간과 취침·기상 시각은 움직임만으로도 비교적 안정적으로 잡힙니다. 단계별 비율은 기기마다 다르게 나옵니다.

 

수면 점수가 낮게 나온 날 기분이 나빠지고, 그 기분이 다음 밤을 망치는 경우가 실제로 있습니다. 점수는 알고리즘이 만든 합성 지표일 뿐이고, 그 재료가 되는 단계 판정이 위에서 본 수준입니다.

코골이가 심하거나 자다가 숨이 멎는 느낌이 있거나 낮에 견디기 어려울 만큼 졸리다면, 시계 점수를 더 들여다볼 게 아니라 수면다원검사를 받아야 합니다. 이건 건강보험이 적용되는 검사입니다.

오늘 해볼 것 하나

앱을 열어 지난 2주의 취침 시각만 적어보세요. 깊은잠도 점수도 보지 말고 잠든 시각만 봅니다. 그 편차가 한 시간을 넘는다면, 손볼 것은 매트리스도 영양제도 아니고 잠자리에 드는 시각입니다. 손목시계가 가장 정확하게 재주는 것이 바로 그 시각입니다.

참고 자료

반응형