我们如何在 WhatsApp 上构建具备端到端加密与可验证性保证的“诈骗提醒”功能
摘要
WhatsApp正在构建Scam Alert,一个可选的设备端机器学习功能,在端到端加密下检测诈骗消息,消息内容不出设备。
核心要点
- Scam Alert通过设备端机器学习模型对来自非联系人的消息进行诈骗模式分类,所有推理均在手机上完成。
- 消息内容不会被自动发送至WhatsApp、Meta或任何第三方;仅当用户明确选择举报时才会共享。
- 用户可随时开关该功能,误报时可标记聊天为“信任”,之后该聊天不再提醒;也可选择共享最近5条消息以改进准确率。
- 遥测数据采用差分隐私聚合,在机密虚拟机(TEE)中处理,Meta和WhatsApp只能获得匿名聚合统计。
- 每个模型版本(含实验变体)在公开的透明账本上发布,模型权重也将公开,便于独立验证。
原文佐证
- No message content leaves the device for classification or is auto-reported to WhatsApp, Meta, or anyone else.
- Every model version, including experimental variants, is published on a public transparency ledger before it is deployed.
AI 洞察
设备端AI正在成为隐私敏感场景的核心方案,Scam Alert把模型权重和透明账本公开,把可验证性作为卖点,这或将成为端到端加密产品中引入AI功能的标准路径。未来,用户对AI系统的信任不再只看效果,还看能否独立审计其行为。