果核Pulse
AI苹果隐私

苹果手表听懂对话,原始音频锁进芯片保险箱

苹果手表听懂对话,原始音频锁进芯片保险箱

Apple Watch Series 12和Ultra 4首发一个功能集合,叫Audio Intelligence。它靠手表麦克风、Apple自研芯片和端侧及云端AI模型工作。手表能识别周围的声音和音乐,也能在错过对话时帮忙找回内容。

Audio Intelligence有四个功能:声音识别、Shazam音乐识别、Live Rewind、Siri Recap。前两个到手即用;后两个要等今年晚些时候的beta版,且只支持英语。

Live Rewind对应一个常见场景:有人刚说了句话,你没听清。双击数码表冠,手表就把最后15秒的语音文本显示在屏幕上。它只在双击时工作,不在后台持续转录。文本默认不保存,除非你主动向Siri问这段内容,或存到Siri App。想开启,去iPhone的Watch App:Siri栏里找到Live Rewind,打开“双击数码表冠”选项。

Siri Recap做定时或按地点触发的总结。开启后能设日程,比如“仅在工作时”运行,或“夜间从不”运行。想手动控制,随时从控制中心开关。

Audio Intelligence的每个功能都由你决定开不开。开之前,手表不会记录任何对话。系统不把语音对应到某个说话人。Siri Recap还被设计成能过滤掉潜在有害内容和敏感信息。Live Rewind触发时会发出提示音,屏幕也有视觉提示,提醒附近的人。

Apple还发了一份11页的隐私白皮书,讲音频怎么处理。

Live Rewind的音频从麦克风流入S11芯片上Secure Exclave(安全隔离区)的音频缓冲区。新音频不断替换旧音频,不会累积。原始音频只存在于这个受保护缓冲区内。

Siri Recap的路径不同。S11芯片先跑一个轻量级AI模型,只检测附近是否有人开始说话,不转录也不记录。一旦检测到对话,音频才流入Secure Exclave的受保护缓冲区。这个缓冲区在硬件层面隔离,佩戴者、操作系统、应用,甚至Apple都访问不了。

端侧处理,通常指数据不出设备。Apple这版的区别是,数据在设备内部也被隔离。芯片上划出一块区域专门处理对话音频,任何软件层面的代码都进不去。

还有几点没说清楚。Audio Intelligence同时调用端侧和云端AI模型。云端模型负责什么任务、音频是否上传,Apple没有交代。Siri Recap的日程里,“仅在工作时”怎么判定工作地点,也没定义。

beta版只说了今年晚些时候,具体日期未定;之后支不支持英语以外的语言,也没提。这些功能是Series 12和Ultra 4独占,还是会下放到旧款机型,同样不清楚。

Apple Watch从健康追踪器跨出一步,开始做听觉助手。最核心的音频处理,留在了芯片内的硬件隔离区里。

相关话题 # 苹果# 隐私
原文来源 9to5Mac

📬 订阅 果核Pulse

每日早间更新,不错过重要信号

▲ 回到顶部