法国数据保护监管机构 CNIL 8 月 26 日更新了 Genmod,一个用来追踪开源发布 AI 模型血缘的工具。它由 CNIL 的 AI 服务部门与数字创新实验室 LINC 联合开发,首版在 2025 年 11 月上线,托管在 Hugging Face 的 cnil/genmod 空间。
它能从一个模型上溯祖先模型,也能下溯衍生模型,文中举的例子是 Kimi K3、Mistral Medium 和 LLaMa。数据源是 Hugging Face 的公开模型与数据集,数据库每周自动重建,页面上显示最近更新日期,下载量高的模型会排在建议和结果列表前面。
这次更新加了法语英语双语界面,图遍历引擎做了优化,不限深度的完整检索平均约 20 秒。另外加了检索进度显示、剩余时间估算、多检索并发处理和高峰期排队位次提示,并针对主流浏览器和不同屏幕尺寸统一了排版。
监管落点写得很明确,是 GDPR,文中没有援引欧盟 AI 法案。核心问题是训练数据的记忆化,从一个已知记忆了个人数据的模型出发,找到同一血缘里可能同样保留这些数据的其他模型,这项工作服务于 LINC 关于数据主体如何行使权利的研究项目。工具覆盖的模型数量、援引的具体 GDPR 条款、产出能否作为执法证据,官方都没有说明,模型血缘出现断裂时怎么处理也没有交代。