Anthropic 8 月 26 日宣布,把内部一直在用的隐私保护分析工具 Clio 改名为 Anthropic Insights,并第一次让外部研究机构用它分析真实的 Claude 使用数据。
首批三家试点是斯坦福的 Social and Language Technologies Lab、牛津大学的 Human Information Processing Lab,以及评估前沿模型的非营利机构 METR。每个团队自己设计研究问题,各分析约 25 万条来自 Claude.ai 或 Claude Code 的对话,取样时间是 2026 年 4 月到 5 月。研究者拿到的只有聚合输出,也就是类别和各类别的对话占比,从头到尾不接触原始对话记录。三个项目的聚合数据已经发在 Hugging Face 上。
合同里 Anthropic 保留的审查权限被写得很窄,只有用户隐私、可能帮助他人违反使用政策的内容、Anthropic 机密信息和研究准确性这四类。协议里写明伙伴可以发布对 Anthropic 不利的结论。实际执行中动过的部分低于 5%,限于那些会暴露用户如何绕过防护的类别,被改动的簇会告知研究者并说明原因。
隐私这块请了帝国理工学院做第三方审计,覆盖所有对外共享的数据,并附了威胁模型文档。三家伙伴先在公开对话数据集 WildChat 上试跑问题,Anthropic 提到 WildChat 偏休闲用途,有些在上面成立的问题放到真实流量上会得出误导性的类别。开放节奏官方只说会慢慢来,没有给时间表,也没有说下一批怎么申请。