![]()
AI正在让越来越多的随身设备学会“感知”周围。手表在录你的对话,眼镜在拍你身边的人,公共场合里,你越来越难判断自己是不是正在被记录。
苹果这次给Apple Watch新增的AI录音功能,很可能让它的用户,也落入Meta眼镜用户那样的处境,招来周围人的警惕和白眼。
![]()
苹果新任CEO约翰·特努斯这次算是被“贴脸开大”了。
秋季发布会后,主持人直接把Meta眼镜的“变态眼镜”绰号甩到了台面上,问苹果高管怎么看这个说法。苹果全球营销高级副总裁乔斯维亚克率先打趣:“真是个营销口号。”他是在调侃“变态眼镜”这个绰号本身,言下之意,这不过是舆论贴给Meta的标签,代表不了产品本质。
一旁的特努斯笑了笑,随即正面回应了外界对苹果AI录音功能的担忧,讲了一整套“让用户和周围人都能放心”的设计逻辑。这套逻辑的核心,是让每一次录音都“看得见、可感知”:功能必须由用户主动触发,一旦激活,提示音、全屏动画和麦克风标志会同时提醒周围人,生成的文字不标记说话人身份,苹果自己也拿不到原始音频。
这段很容易被当成一次公关化解的漂亮案例。但如果把镜头拉远一点,会发现这背后牵出的东西远比一次采访大得多:这些设计凭什么让人放心?“看得见的隐私设计”被一次次讨论,那其他大多数人看不到的风险呢?苹果这次看似普通的手表功能,会不会只是它更大棋局里的一步棋?
这不是苹果一家公司的公关战。这是一场每个人都已经被卷入、却大多数人还没意识到的战争。
AI录音踩中了哪根红线?
这次秋季发布会上,苹果宣布Apple Watch Series 12搭载了一套叫“Audio Intelligence”(音频智能)的新功能,核心是两项能力。
- Live Rewind:连按两下数码表冠,就能把过去15秒的对话转成文字显示出来,专治“服务员说太快没听清”这种尴尬场景。生成的文字还能转给Siri继续处理,或存进Siri App里。
- Siri Recap:通过环境收听,为你的对话自动生成标题、摘要和要点。用户可以选择一直开启、按日程开启,或者干脆关掉。
问题出在Live Rewind这个“回放过去15秒”的设计上。它意味着设备要持续处理最近的一段环境音频,不管你有没有说唤醒词。
然而一众科技账号迅速发文提醒:苹果Watch用户很可能会尝到Meta眼镜用户尝过的那种被白眼包围的日子。
而Meta眼镜为什么会落到需要被这样警惕的地步,说来是一整条已经发酵了一年多的舆论链条。
Meta的AI眼镜靠着和雷朋、Oakley的合作,早早占据了智能眼镜市场的主导份额。但从2025年开始,一批网红和“搭讪艺人”开始用这款外形和普通墨镜没有区别的设备,偷偷拍下和陌生女性的互动视频发到网上,对方往往完全不知情。
喜剧演员Jimmy Kimmel在全国电视节目上公开叫它“变态眼镜”;也有餐厅贴出告示,“请把你的Meta眼镜留在家里,本店保护隐私,拒绝偷窥”;甚至有开发者专门做了一款App,用来检测周围是不是有人戴着智能眼镜,上线半年下载量就有11万,用户里有脱衣舞俱乐部老板、佛教僧侣,也有普通家长。
苹果显然是带着这整套背景走进这次发布会的。所以特努斯这次给出的,不只是一句公关辞令,而是一份几乎条条针对性的“防偷录”设计清单:
- Live Rewind只能由用户主动按下数码表冠触发,不会在后台悄悄常驻转录;
- 一旦激活,表冠会发出提示音。即便设备处于静音状态、或者已经连上耳机,这个提示音依然会响;
- 屏幕同时会出现全屏动画和麦克风标志,明确提醒周围人这个功能正在运行;
- 生成的文字不含说话人身份,端到端加密,苹果自己也无法访问原始音频,屏幕熄灭约30秒后就会自动消失,除非用户手动把它保存进Siri App。
![]()
Siri Recap走的是另一条路子。它不追求实时提醒,而是把一整天听到的对话,悄悄整理成一份同样不带说话人身份的摘要,用户如果不主动保存,7天后会自动清空。
提示音会响,指示灯会亮,承诺写得清清楚楚。这些设计,理论上应该足够让人放心了。
但,真的能放心吗?
美好的设计畅想,与残酷的现实
苹果这次的设计逻辑,说穿了就一句话:只要触发条件设计得足够明确、足够显眼,风险就是可控的。
事实上,苹果自己已经用过同一套底层原理,那就是Siri的唤醒机制。
而Siri,狠狠地翻车了。
Siri事件:“不喊它,它不听”,结果呢?
Siri的设计承诺是,你得先喊一声“Hey Siri”,它才会被唤醒、开始录音、开始理解你在说什么。这和这次Live Rewind“必须按两下表冠才触发”的逻辑,本质上是同一种东西,用一个明确的触发动作,把“什么时候在录、什么时候没在录”这件事变得清楚可辨。
但七年前,这个触发条件已经彻底失控过一次。
2019年,一名曾为苹果外包公司工作的匿名人士向《卫报》爆料,说Siri经常在完全没人呼叫它的情况下被意外激活。
最离谱的诱因之一是拉链的声音。拉一下外套或包的拉链,在设备的识别模型听来,有时候就和“Hey Siri”的声纹接近到足以触发。
更麻烦的是Apple Watch。它的设计是只要你抬起手腕、同时检测到有人在说话,Siri就会自动开始录音。而“抬手腕+周围有人说话”这个组合,在日常生活里出现的频率高得吓人。做家务、开车换挡、甚至亲密时刻的肢体动作,都可能撞上这个条件。
结果是,那些真正被误触发录下来的片段,恰恰是最没有防备、最私密的那些瞬间。这名爆料人告诉《卫报》,他在日常的“录音评分”工作里,听到过医生和病人讨论病史的对话,听到过背景有引擎声、疑似正在进行的毒品交易,也听到过情侣之间的亲密接触过程录音。这些录音还会附带用户的位置信息、联系人数据。
这些内容不是用户主动问Siri产生的,而是用户以为自己没有被录音、毫无防备时产生的。
舆论爆发后,苹果连夜整改:把录音评分从默认开启改成明确的opt-in,音频只允许苹果内部员工听、不再给外包承包商接触,新增了删除Siri历史记录的功能。六年后的今天,苹果依然在用同一种逻辑说服公众:“只要设计好触发条件,风险就是可控的”。
只是这一次,触发条件从“喊一声”变成了“按两下表冠”。
Meta事件:宣传里的隐私,与肯尼亚工人眼里的现实
如果说Siri的教训在于“触发机制本身会失控”,那Meta最新爆出的官司揭露的是另一种更隐蔽的风险。即便设备没有被误触发,你的隐私也可能通向一个你完全想象不到的地方。
2026年2月,瑞典两家报纸联合发布了一篇调查报道。Meta AI眼镜用户使用AI视觉问答等功能时,素材会被无感上传处理,视频有一定概率会被传送到肯尼亚内罗毕的一家数据标注外包公司Sama。那里的工人日常工作是给视频里的画面打标签,用来训练Meta的AI视觉识别模型。一名工人公开表示:“我们什么都看得到,从客厅到裸体,Meta的数据库里就是有这类内容。”
报道里提到的具体场景包括:有人上厕所,有人换衣服(其中一起明确提到,当事女性显然并不知道自己正在被拍摄),有人发生性行为,还涉及银行卡、账户信息等敏感财务资料。
Meta此前声称会对画面中的人脸做模糊处理,但知情人士透露,这套模糊机制并没有被稳定地执行。
一个月后,两名美国消费者在加州北区联邦法院把Meta和眼镜制造合作伙伴Luxottica一并告上法庭。诉状的核心指控是“虚假宣传”:Meta的广告语反复强调“为隐私设计,由你掌控”“为你和他人的隐私而打造”,甚至具体承诺“使用摄像头的AI功能时,我们会采取措施保护隐私,比如移除关键身份识别信息”,但从未告诉用户,你的素材可能会被地球另一端一个素不相识的陌生人,用肉眼一帧一帧看过。
目前这起诉讼仍在早期阶段,Meta方面也否认了“随意把素材送去审核”这种说法,坚持称素材只有在用户“主动分享”后才可能进入人工审核环节。但这里的“主动”,和普通人理解的“主动”其实不是一回事。用户真正主动做的,只是在设置账号时点下的那一次概括性同意,条款写的是“你与AI功能的互动可用于训练AI模型”。点完这一次之后,往后每一次正常使用AI功能(比如抬手问一句“这是什么”),素材就会在用户毫无察觉的情况下自动上传、进入审核队列。
一个是用户凭直觉就能警惕的风险,这设备会不会拍到我;一个是用户几乎没有能力识别的风险,我点下的这个“分享”按钮,到底通向哪里。
这不只是手表的问题,也不只是眼镜的问题。这是所有“AI感知设备”共同的困境。
AI感知设备的隐私战争
AI感知设备的隐私战争其实已经打了十几年,而且每一轮都遵循着同一个模式:上一代产品因为某个具体漏洞翻车,下一代产品把这个漏洞打上补丁,然后在另一个谁都没想到的地方暴露出新的漏洞。
- 2013年的Google Glass是第一个倒下的。它连一个明显的录制指示灯都没有,旁人完全没办法判断自己是不是正在被拍。结果是它被赌场、医院、体育场、电影院、大学课堂集体拒之门外,“Glasshole”这个带着嘲讽意味的称呼迅速流行开来。2015年,这款消费级产品被谷歌彻底叫停,距离首个原型机推出只有四年。
- Meta从Google Glass的失败里学到了教训,给眼镜加上了录制指示灯。但指示灯这道防线,同样没能撑住。它可以被遮挡,可以被移除。直到2026年7月,Meta才被迫推送一次强制固件更新:一旦指示灯被物理破坏或遮挡,摄像头会自动锁定,无法继续拍摄,这是消费级可穿戴设备里第一个这样的“摄像头自毁”机制。
- 而苹果这次的提示音、全屏动画,几乎是在这两代教训基础上做的进一步加固。如果指示灯能被遮挡,那就同时用声音提醒;如果声音能被静音,那就设计成静音状态下依然强制发声。
没有一家公司是提前把这件事彻底解决后再发布产品的。每一次“更完善的设计”,都是上一次舆论危机之后被动补上的。
监管这条线也在同步收紧,但节奏永远慢半拍。
苹果内部代号N50的首款智能眼镜项目早已被多次报道,但具体发布时间被一路往后推。
拖延的理由几乎每一次都指向同一个词:隐私。
而这位项目的主要推动者,正是苹果新CEO特努斯本人,也就是这次在采访里笑着回应“变态眼镜”提问的那个人。一年半后,他要亲手把一款真正带摄像头的AI眼镜卖给消费者。
有报道称苹果内部在“彻底砍掉摄像头”和“保留摄像头但取消拍摄存储权限”这两个方案之间反复拉锯。据称苹果最终倾向的折中方案,是保留摄像头用于AI环境感知,同时直接照搬Meta事后才被迫加装的防篡改指示灯机制。摄像头工作时指示灯强制点亮,一旦被遮挡或破坏,图像采集自动锁定。
把这几条线索放在一起:项目负责人是这次主角、眼镜项目因隐私问题两次跳票、两款产品几乎共用同一套“防偷录”设计哲学。
这次手表上的“音频智能”功能,很可能不是一个孤立的效率工具,而是苹果在一个“风险最低的容器”里,提前给“设备贴身感知你”这件事,做了一次公众心理压力测试,也给“视频智能”做了前置的脱敏。
手表没有摄像头,天然规避了“被偷拍”这个最敏感的痛点,只保留了“环境声音被采集”这个相对温和的部分。等用户已经习惯“手表可以帮人录对话”这件事之后,“眼镜也在记录”这件事的心理门槛就会被提前拆掉一部分。
这套逻辑最值得警惕的地方在于,它未必需要苹果“主观蓄意”才会生效。
不管一家公司是不是刻意为之,“温和版本先出现、大众逐渐适应、更激进的版本再跟进”这种产品节奏,客观上都会产生脱敏和“登门槛”式的效果。这不是苹果一家的阴谋,而是这整个品类扩散过程里一条相当普遍的规律。
技术采纳史上有过很多类似的先例。照相手机、行车记录仪,都曾在刚问世时引发过“这是不是在偷拍我”的社会性恐慌。但随着渗透率不断提高,“默认怀疑每一个持有者”这种警惕心,因为基数太大而难以持续维持,最终逐渐让位给了“默认接受,除非有具体证据”。
如果公众只盯着摄像头和指示灯,对“分享给AI用于改进体验”这类条款始终无感,那么“常态化”的方向,大概率会朝着对企业更有利的一侧滑动。
事实上,Meta 已在 2025 年悄悄调整过政策:语音录音默认开启、默认上传云端存储,用户需要主动手动关闭,才能禁用相关的 AI 分析。
但这也是一场双向的拉锯。公众的反应,同样在实实在在地塑造下一代产品的设计。加州的SB 1130、纽约州法院的禁令、Meta被迫加装的防篡改固件,全都是公众用抵触、诉讼、立法这些方式,逼着企业让步的证据。
这场战争打到现在,双方都还没有决定性的胜负。(本文首发钛媒体APP,作者 | 硅谷Tech-news,编辑 | 郝敬钰)








快报
根据《网络安全法》实名制要求,请绑定手机号后发表评论