当地时间 9 月 13 日,据外媒报道,知情人士透露,Anthropic、OpenAI 与谷歌三大前沿人工智能企业正在展开磋商,计划合作成立人工智能行业标准机构,聚焦大模型安全测试、独立审计相关规则制定。这项行业自律构想,在 Anthropic 首席执行官 Dario Amodei 公开呼吁 AI 行业协同开展模型测试与审核之前,相关工作组就已经启动多轮线下会谈。

根据报道信息,三家企业组建的工作组由各公司高管之下的核心业务代表构成,定期开会研讨机构架构、权责边界与落地路径,最近一轮会议已于上周完成。OpenAI 首席执行官山姆・奥特曼在内部员工大会上对此表态,他支持搭建面向 AI 行业的测试审核机构,同时提出,前沿大模型实验室应当在不依赖美国政府直接主导的前提下,自主建立这套行业组织。这一思路,与 Dario Amodei 近期提出的行业自律主张高度契合。
该拟成立机构的核心定位,属于行业自主发起的自律组织,对标金融行业监管自律机构的模式。核心工作内容,是为前沿大模型建立统一安全测试规范、标准化风险评估流程,推动第三方独立审计机制落地。当前各大 AI 实验室的安全评估方案各自独立,测试基准、风险分级标准并不统一,外部第三方很难横向对比不同大模型的安全能力。新机构的目标就是补齐这套通用评估体系,形成行业通用的检测标准,减少企业各自为战带来的标准割裂。

在此之前,三家企业曾共同参与前沿模型论坛(Frontier Model Forum),开展 AI 安全相关研究协作。而本次讨论的新机构,定位与前者有所区别,更加侧重标准化审计、统一测试流程,试图建立具备更强约束力的行业自律机制。行业人士分析,随着大模型能力持续迭代,模型带来的安全风险、数据隐私、内容安全等问题日趋复杂,单家企业的安全管控很难建立足够公信力,巨头联手制定统一标准,能够向监管、公众展示行业自主治理的能力。
不过这项计划推进过程中,内部仍存在不少分歧。报道提及,工作组层面推进顺利,但三家企业高层尚未完全达成共识。不同公司在商业利益、技术路线、风险偏好上存在差异,如何平衡各家诉求、保证机构的中立性,是磋商阶段最大难点。同时,机构的成员准入规则、第三方审计的独立性、标准是否对开源模型同等适用,都还没有形成确定方案。

全球范围内,AI 治理已经进入多方博弈阶段。各国都在加快 AI 相关立法,同时鼓励行业自律。美国、欧盟、英国相继出台 AI 监管法案与风险分级框架,行业组织、第三方评估机构也在不断增多。本次三家头部实验室商讨共建标准机构,代表前沿 AI 企业希望主动参与规则制定,争取在全球 AI 治理中掌握更多主动权。
截至目前,三方仍处于协商阶段,尚未发布正式的联合公告,机构名称、成立时间表、组织架构均未对外公布。后续谈判能否落地,取决于三家企业能否在治理规则、标准细则上达成共识,也将受到美国监管机构、学术界与开源社区多方力量的影响。
AI 行业的标准化建设,是平衡创新与安全的关键一环。如果本次机构顺利落地,将会改变前沿大模型安全评估的行业格局;若磋商受阻,也会侧面反映巨头之间,在商业竞争与安全治理之间存在难以调和的矛盾。市场将持续跟进三家企业谈判进展,观察这套行业自律构想能否落地成型。