首页 / 国际

国际

欧盟开始要模型卡备案,而不只是参数披露

地球夜景与网络
资料图:集装箱码头作业。

通用模型的义务从“告诉我有多大”变成“告诉我训练数据、评测方法和已知风险分别是什么”。

欧盟针对通用人工智能模型的备案要求进入操作阶段。监管要的不再只是参数量,而是模型卡:数据来源、评测方法和已知风险。只报一个总参数量,会被视为未完成披露。

这对习惯发技术博客的团队是一次措辞训练。博客可以讲故事,备案材料必须能被后来的审计员按条目勾选。含糊的“主要来自公开网络”,在这里不够用。能被勾选的句子,往往比发布会更短,也更疼。

备案看什么

文件要求写清训练数据的主要类别、红队测试和能源估算。开源权重并不自动豁免。提供下载和提供 API,被放进不同档的义务里。律师说,社区协议和商业 API 要分开归档,不能用一份 README 应付两种角色。

评测方法也要可复核。写“我们在内部基准上达到领先”,却不说明题目是否泄漏、是否包含用户数据,等于没写。监管要的是可追踪,不是第一名。能源估算同样会被追问方法:是测一台机器乘以小时,还是把冷却和空载算进去。

开源也要填表

权重公开降低了复制成本,也让训练数据的争议更容易被复现。社区里一次“这份数据不该被包含”的讨论,可能变成备案里的已知风险条目。维护者需要决定:是修改模型卡,还是撤回某个版本的权重。

这会改变发布节奏。过去可以周五晚上丢一个 checkpoint,现在要先问:模型卡、过滤说明和投诉渠道是否同步上线。晚一周发布,往往比缺一张表就上线更便宜。

对面向欧洲用户的接口

国内团队只要把推理接口开给欧洲用户,就开始补模型卡和内容过滤说明。产品排期里多了一列:合规文本谁来写、谁来签。这列通常不会出现在发布会演示里,却会卡住上线日。

过滤策略本身也要可解释。只说“我们有安全层”,却说不清哪些类别被拦截、误伤如何申诉,仍然像未完成的义务。工程上这是策略配置,法律上这是程序正义。日志还要能证明过滤在请求路径上确实发生过,而不是只存在于设计文档。

合规文本会成为产品的一部分

模型卡写得好不好,会影响采购。企业客户已经开始把“能否提供可审计的模型卡”写进选型表。监管只是把这件事从可选项,变成了欧洲市场的入场券。

以后比较两家模型,除了延迟和价格,还会多一问:出事之后,你能不能把训练与评测的故事讲成可核对的档案。讲不成的,不一定不能卖,只是更难卖给要签字的人。