阿里拟训练5万亿至10万亿参数规模千问模型
阿里披露下一代千问模型或扩展至5万亿至10万亿参数,并把模型扩张与自研芯片、云算力和智能体部署绑定。
阿里巴巴在杭州举行的云栖大会上披露,未来千问模型的规模可能扩展至5万亿至10万亿参数。阿里巴巴集团首席执行官吴泳铭同时介绍了新一代AI芯片、云基础设施和面向智能体的产品布局。
这不是新模型发布
这一目标远超目前约2.4万亿参数的千问3.8-Max,但阿里尚未公布具体发布时间、模型架构、训练数据、算力需求或评测成绩。换言之,这是训练规划,而不是用户今天可以下载或调用的产品。
参数规模本身也不能直接等同于模型能力。稀疏架构、专家路由效率、训练数据质量和推理成本,都会决定超大模型能否带来实际收益。如果规模增长没有同步改善训练效率和服务经济性,参数扩张也可能转化为更沉重的工程负担。
阿里把这一模型路线与平头哥芯片、数据中心扩容及智能体云平台放在同一套战略中发布。公司释放的信号是,前沿模型、芯片、云服务和应用不再是相互独立的业务,而是需要协同建设的完整系统。
为什么值得关注
这项计划的重要性在于,它是中国头部科技公司准备冲击超大训练规模的明确信号,也意味着国产算力和数据中心能力将承受更高压力。与此同时,千问此前的开放模型对开发者生态影响较大,但阿里没有说明未来5万亿至10万亿参数模型是否会开放权重。
今天真正发生的并不是一个新模型上线,而是阿里公开押注下一轮前沿模型竞赛,并准备以芯片、云和智能体产品共同承接这项投入。