OpenAI、Anthropic与xAI支持独立评测标准AEF-1
AI评测论坛发布AEF-1标准,要求第三方披露模型访问权限、利益冲突、分析自主性、方法透明度与法律安全港。
一套评测流程标准出现
AI评测论坛发布了AEF-1,试图为先进AI系统的独立第三方评测建立最低运行条件。OpenAI、Anthropic和xAI等主要模型公司支持这一标准,外部评测机构也参与了制定过程。
AEF-1覆盖五个方面:评测者是否获得了足够的技术访问权限和资源;利益冲突是否得到控制;分析工作是否保持自主;方法和结果是否透明;敏感信息是否受到保护。标准要求评测者说明测试过的模型配置、可用资源、相关利益冲突、发布限制,以及任何未满足标准的地方。它还建议,开发者应为评测者在约定范围内的测试行为提供法律安全港。
为什么这些细节重要
前沿模型安全评测经常存在一个问题:公开报告会说明“测了什么”,却不清楚交代评测者究竟拿到了多少权限,开发者又能否影响结论。AEF-1试图把这些问题变成可以核对的清单。
标准建议,对具有明显新颖性的系统,评测应预留足够时间来排查访问问题、设计测试、执行实验、分析结果并反复调整。对于许多新系统,它把20个工作日视为常见的最低参考,但实际时间仍取决于系统和风险类型。
尚未解决的独立性问题
AEF-1是自愿标准,而控制模型访问权限的公司也参与定义“足够访问”应当是什么,这天然带来独立性疑问。它只有在评测机构公开遵循情况与例外、实验室向评测者提供接近部署版本的真实权限,并且采购方或监管机构把这些披露视为证据而非宣传时,才会真正产生影响。
眼下,它的价值主要是制度性的:为第三方评测者提供一套共同语言,说明一项安全结论是否独立、可复现且获得了合理资源。