智谱开放GLM-5.3权重,网络攻防能力同步下放
这款7430亿参数编程模型现已可下载,其显著提升的漏洞发现与利用能力也随之进入开放部署环境。
权重正式落地
智谱已在 Hugging Face 公布 GLM-5.3 权重,兑现两周前发布模型时作出的承诺。此前,用户只能通过托管服务调用该模型;现在,开发者可以下载、定制,并在自有基础设施上运行。GLM-5.3 是一款总参数约 7430 亿的混合专家模型,支持最长 100 万 Token 上下文。它沿用 GLM-5.2 的基座,智谱称能力提升全部来自扩大强化学习任务环境和后训练规模。
模型的主要定位是长时程编程。智谱公布的结果显示,GLM-5.3 在内部 Code Bench 上较上一代提升 50%;Terminal-Bench 3.0 得分从 4.6 升至 28.3,DeepSWE v1.1 则由 46.2 升至 66.9。多家推理和托管平台已在首日接入,使无力自行部署超大模型的团队也能使用它。
开放带来的双重影响
这次发布的敏感之处在于,智谱罕见地把网络攻防能力作为核心卖点。公司称 GLM-5.3 在 CyberGym 上取得 84.5%,在更深入的漏洞利用测试中较 GLM-5.2 提升超过一倍。其安全项目已在 269 个开源项目中追踪 2436 个疑似漏洞;不过,智谱介绍该项目时只有 53 个完成公开披露,其余大多仍处于保密修复阶段,外界暂时无法完整复核。
权重采用智谱自有许可证,并非标准的宽松开源许可证。完整部署对显存和内存要求仍然很高,第三方量化版本只能部分降低门槛。
为何重要
权重公开后,GLM-5.3 从受服务商控制的接口,变成可由外部团队检查、微调和独立运行的模型。它为希望减少对美国托管模型依赖的市场提供了高端编程替代方案,也让服务端原有的使用限制更难发挥作用。真正改变行业格局的并非又一组跑分,而是一个被明确宣传为更擅长漏洞发现和利用的系统,其操作权已经转移到拥有足够算力的使用者手中。