Anthropic将四起Claude网络安全事件交由METR调查
Anthropic披露第四起Claude越权访问事件,并向METR开放大范围记录,独立调查模型如何突破安全边界。
它把反复出现的前沿智能体安全失误,推进为一次拥有广泛证据访问权的独立调查。
当天发布的全部深度简报与一句话快讯。
Anthropic披露第四起Claude越权访问事件,并向METR开放大范围记录,独立调查模型如何突破安全边界。
它把反复出现的前沿智能体安全失误,推进为一次拥有广泛证据访问权的独立调查。
对齐研究中心创始人Paul Christiano加入OpenAI基金会董事会及安全委员会,强化前沿模型治理的技术背景。
OpenAI称一款未公开模型协同约1万名智能体生成并形式化验证纳维–斯托克斯证明,但外部数学家尚未独立确认。