在9月9日的iPhone Duo发布会上,苹果宣布了多项全新的Siri AI语音智能功能,包括Siri回顾、实时回听、声音识别和音乐识别。伴随这一发布,苹果同时公布了一份文档,说明其如何在AI"环境聆听"能力与用户隐私保护之间取得平衡。文档指出,新功能所处理的原始音频"在专用硬件中处理,不会以文件形式保存,操作系统、应用程序以及苹果公司均无法访问该数据"。

苹果解释称,语音智能功能依赖于S11芯片中的安全隔区技术,该芯片同时也是新款Apple Watch Series 12和Apple Watch Ultra 4的核心处理器:

Apple Watch Series 12和Apple Watch Ultra 4搭载的S11芯片内置安全隔区——这是一个构建在芯片中的硬件隔离区域,用于独立处理传感器数据,与系统其他部分分开。在安全隔区中处理和分析的数据,无法被watchOS系统、应用程序、用户本人或苹果公司访问。来自麦克风的音频进入Apple Watch的安全隔区后,会先针对语音、声音或音乐进行初步处理,过程中不会转录或存储原始音频。这一缓冲区是持续被覆写的数据流,仅存在于受保护的硬件内部,不会生成任何录音文件。

苹果还表示,用户可以自主控制语音智能功能"是否启用以及何时启用"——例如实时回听功能,每次使用前都需要用户双击数码表冠才能激活。此外,如果语音智能数据需要传输至iPhone,传输过程会通过两台设备各自的安全隔区进行加密处理。用户还可以自主选择保留Siri回顾和实时回听生成的哪些文本内容,而如果设备设置了密码并启用了iCloud双重认证,语音智能生成的文本将通过端到端加密方式进行同步。

Q&A

Q1:苹果的语音智能功能会不会一直在偷听用户?

A:不会。苹果表示原始音频在专用硬件的安全隔区中处理,不会保存为文件,操作系统、应用程序和苹果公司都无法访问这些数据,用户也可以自主控制功能的启用时机。

Q2:安全隔区技术是如何保护音频数据的?

A:安全隔区是S11芯片内置的硬件隔离区域,专门用于独立处理传感器数据。麦克风采集的音频进入安全隔区后仅做初步处理,不转录也不存储原始音频,处理完的数据流会持续被覆写,不会生成录音文件。

Q3:语音智能生成的文本内容安全吗?

A:用户可以自主选择保留哪些由Siri回顾和实时回听生成的文本内容。如果设备设置了密码并开启iCloud双重认证,这些文本数据在同步时会采用端到端加密方式进行保护。

The Verge