8月26日·星期三 15:00·来源:InfoQ

WhatsApp 测试 AI 反诈:消息无需上传云端

WhatsApp正在测试一项名为Scam Alert的可选端侧机器学习功能,用于识别非联系人发来的疑似诈骗消息并发出警告。该功能将小型模型下载至设备本地,依据用户历史举报的诈骗对话模式进行训练,并利用对话结构与语言信号评估消息。若识别为诈骗,用户可选择屏蔽、举报或继续对话,也可将聊天标记为可信,此后不再收到警告,并可选择分享最近5条可信消息以协助改进功能。 该架构将消息分类与性能衡量分离,设备本地汇总警告事件与用户操作计数,通过匿名凭据经Oblivious HTTP中继传输,并在机密虚拟机内处理,应用最小群组阈值与差分隐私,仅向Meta提供总体统计数据。模型分发亦设安全边界,每个模型版本及其SHA-256哈希值在部署前发布至第三方仅追加账本,客户端加载前验证账本条目、签名与时效性,下载使用匿名凭据,实验分组在本地完成,防止服务器定向选择模型变体。 该方法基于Meta的PAPAYA联邦分析系统,该系统于USENIX NSDI 2025发布,采用可信执行环境与端侧处理实现隐私保护联邦分析。Google Messages亦采用类似端侧检测机制。Meta表示,小范围测试将联合Bug Bounty社区对实现进行压力测试,并扩大赏金计划覆盖机密联邦分析管线,发布机密虚拟机二进制文件及隐私相关源代码组件供独立审查。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(InfoQ)→