我戴了一个睡眠追踪器大约一年半。头几个月,我每天早上还没坐起身就先看一眼评分,而我可以很有把握地告诉你,那个评分对我这一天心情的影响,远远超过睡眠本身。
那不是一个反对追踪器的论点。而是一个「要理解它们实际在测量什么」的论点,好让你知道哪些数字该信、哪些该忽略。因为其中有些相当好、有些相当糟,而 App 用同样自信的小数点把它们全都显示出来。
一个可穿戴设备实际测量什么
睡眠,按睡眠科学家的定义,是一件发生在大脑里的事。那些阶段——浅睡眠、深睡眠、快速眼动睡眠——是由脑活动的模式、连同眼动和肌张力来分类的。要正确地测量那个,意味着在睡眠实验室里把电极贴在头皮上,一种叫作多导睡眠图(polysomnography)的方法。它是参考标准,因为它看的是那件事本身。
一条腕带看的不是那件事本身。它看的是替代指标:你的手臂动了多少、你的心跳有多快、那个心率在每一次跳动之间怎么变化,有时还有皮肤温度或血氧。从这些信号里,一个算法推断你的大脑大概在做什么。
那个推断不是胡说。深睡眠确实往往伴随着一个缓慢、稳定的心率和极少的运动。快速眼动睡眠往往伴随着一个更多变的心率,以及因为肌肉被关闭而几乎完全的静止。但「往往」在那些句子里承担了很多分量,而算法是隔着好几层假设、从腕部去猜测大脑状态。
追踪器测得准什么
在大量把消费级设备与实验室测量作对比的研究里,一个已经确立的结论是:可穿戴设备在总睡眠时长上还不错,在阶段判断上很差。这就是那句要记住的话。
总睡眠时长是那个简单的问题。「醒着」和「睡着」在一个运动传感器和一个心率传感器上看起来非常不同。设备能大致判断你什么时候停止了运动、心率安定下来,以及早上什么时候两者都重新活跃起来。它通常会差几分钟,而且倾向于把「静止但醒着」的时间算作睡眠,但作为「我昨晚睡了多久」的估计,它是可用的。
那两个最要紧的时间戳也一样:你什么时候睡着、什么时候醒来。这些恰恰是你想修一个就寝时间时会想要的数字,而它们正是追踪器最可靠的那些数字。那是一个幸运的对齐,也是那个「明智地使用它」的方式的基础,我一会儿会讲到。
追踪器测不准什么
阶段判断是那个困难的问题,而腕部是解决它的一个糟糕的地方。
当研究者把一个可穿戴设备逐阶段的读数与实验室对比时,一致性比总时长弱得多。设备会自信地告诉你,你得到了 1 小时 12 分钟的深睡眠,而那个数字上诚实的误差范围宽到,它合理地可能是 40 分钟、也可能是一小时四十。同一个人在同一晚戴着的不同设备会彼此不一致,而同一个设备会根据它被绑得多紧产生不一致的结果。
这很要紧,因为那些阶段正是 App 把它全部叙事分量都压上去的地方。评分、那个「恢复性睡眠」百分比、你那一夜的小柱状图——其中大部分都建立在测量里最不可信的那部分上。如果你想知道深睡眠和快速眼动睡眠实际上做什么、你大概需要多少,我分别写过深睡眠和快速眼动睡眠。简短版:它们很重要,而你的追踪器没法可靠地告诉你,你得到了它们中的多少。
所以当 App 说你昨晚深睡眠偏低,正确的反应不是担心。而是「也许吧,也许不是」。
正确睡眠症:当评分变成了问题
睡眠临床医生给头几个月发生在我身上的事起了个名字。他们叫它 orthosomnia(正确睡眠症)——一种对睡眠追踪器数据的执念,严重到干扰了睡眠。
它是这样的。你得了个差分。你为那个分数发愁。发愁让今晚的睡眠更糟。明天的分数也差,这就「证实」了你的睡眠有问题,而这现在部分成真了,因为你已经为它焦虑了两晚。有些陷在这个循环里的人说,他们早上感觉挺好,然后一看到那个数字就感觉累了。App 在做和它的工作相反的事。
之所以会这样,是因为一个每晚的打分邀请了一次每晚的评判。而一个基于「大多在猜」的测量的评判,是你对自己身体感受的一个糟糕的基础。这有点像在一个精确度只到四公斤的秤上称自己,然后为一个 300 克的变化而纠结。
如果你本来就带着一团焦虑醒来,你最不需要的就是在你还没喝上一杯水之前、腕上就有一份裁决在等着你。对某些人来说,诚实的解法是留着追踪器、但别看评分。对另一些人,是把这东西摘下来一个月、注意自己没有它是不是睡得更好。我做了第二个,而我睡得更好了。
智能闹钟的承诺
有一个追踪器功能值得单独一提,因为它正好坐在阶段判断问题的头顶上:那个「在浅睡眠里的最佳时刻」叫醒你的智能闹钟。
这套说辞很吸引人。设一个三十分钟的窗口,设备盯着你的阶段、挑那个你睡得最浅的时刻,于是你醒来感觉神清气爽、而不是昏沉。而它底下有一个真实的想法,因为被从深睡眠里拽出来确实感觉比从浅睡眠里醒来更糟。
问题在于执行。要在浅睡眠里叫醒你,设备必须此刻、实时地、从一个腕部传感器知道你的阶段。那正是它最不擅长的事。所以你实际得到的,是一个基于猜测、在半小时窗口里某处响起的闹钟,而在那些猜对了的早晨,它感觉像变魔术,在那些没猜对的早晨,它只是一个提早响了的随机闹钟。我写过一篇更长的《睡眠周期闹钟》拆解,和一篇单独看《90 分钟法则站不站得住脚》的文章,而两者的结论一样:理论没问题,传感器交付不了它,而它引入的那个浮动的起床时间本身就是一个代价。
因为一个起床窗口意味着你的起床时间会漂移。而一个漂移的起床时间,正是那个最可靠地与「早晨感觉更糟」相关联的东西,不管你碰巧从哪个阶段醒来。
我会怎么实际使用一个
说了这么多,我还是认为一个追踪器可以有用。关键在于问它那些它能回答的问题。
**看趋势,别看单晚。**单独一晚的数据既有噪声、又有一部分是猜的。一个四周的就寝时间、起床时间和总睡眠平均值则是真实的信息,因为误差被抹平了、趋势幸存下来。如果你的平均就寝时间在一个月里悄悄晚了四十分钟,那是你能采取行动的东西。
**把它当作一个稳定性核查。**我的追踪器给我看过的最有用的东西不是一个评分。而是一个月里起床时间的散点图——工作日一个紧密的簇,然后每个周末都有两个点飘到右边三小时开外。那张图对我周一的解释,胜过任何深睡眠百分比。
**忽略阶段判断和评分。**或者至少,别让它们决定你的感受。如果你感觉休息够了、而 App 不同意,那你是对的、它是错的。它是一个绑在你手臂上的传感器,不是一个关于你大脑的权威。
**如果它让你更糟,就停。**这是正确睡眠症的检验。如果查看数据让你更平静、更稳定,它就配得上它的位置。如果它让你焦虑,它就不配,而坚持下去没有奖品。
什么比评分更重要
这是我最终落到的地方。那两个最可靠地改善了我早晨感受的行为,都跟「测量我的睡眠」毫无关系,而跟「决定我的睡眠」息息相关。
第一个是一个我每天都兑现的固定起床时间,包括周末。不是一个窗口,不是一个智能区间——一个时间。它是其他一切的锚点,也是修复作息里唯一最有效的变量。它不需要一个传感器就能起作用。它需要一个真正能把我弄下床的闹钟,而我用 Captain Wake 来做这件事,因为不完成一件身体上的事它就不会停——拍卫生间镜子、扫麦片盒上的条形码——而这是治「我等下一个闹钟再起床」那场谈判的一味非常有效的药。
第二个是在夜晚发生之前去看它,而不是在事后给它打分。同一个 App 的睡眠预报会显示,如果我现在上床、按照明天的闹钟,我正朝着什么样的结果走去,而那个数字改变我行为的程度,远超任何早晨的评分,原因很简单:我还能对它做点什么。我详细写过《为什么预报胜过报告》,但核心是:一份报告告诉你你失去了什么,一份预报告诉你你还能保住什么。
一个追踪器测量已经发生的事。那没问题,就其本身而言。但睡眠主要不是一个测量问题。它是一个决策问题,而那些决策是在晚上 11 点和早上 6:30 做出的,不是在第二天早上的 App 里。