腾讯混元发布 Hyra-1.0:会自我迭代的研究智能体
腾讯混元推出研究智能体 Hyra-1.0,能对科研与工程任务递归生成、执行并优化方案,在三项基准上超过同类系统已公布成绩。
腾讯混元团队 7 月 21 日发布 Hyra-1.0,即混元研究智能体(Hunyuan Research Agent)的首个版本——一个面向性能导向型科研与工程任务、能递归改进自身方案的自主系统。
轻量框架,充分放权
Hyra 的工作方式是一个持续循环:智能体生成候选方案、实际执行、度量结果,再基于跨轮次积累的经验继续打磨。架构上,腾讯刻意选择了极简的异步框架——脚手架越简单越好,把自主权尽量交给智能体,而不是预先编排僵硬的工作流。官方给出的应用方向包括 AI 研发、科学发现和创意设计,早期演示已覆盖数学、量子计算和药物设计等任务。
基准成绩方面,腾讯称 Hyra-1.0 在三项主打任务上全面超过同类递归改进系统此前公布的结果:将 NanoChat 的验证集 BPB 压到 0.9015,把 NanoGPT 达到目标损失的时间缩短至 76.4 秒,并在侧重执行能力的 SOL-ExecBench 上取得 0.771 的平均分。
这也是腾讯 AI 团队高产一周的收官之作:开源模型 Hy3 本周刚登上 Frontend Code Arena 开源模型第二名,公司同期还在整合旗下智能体产品团队。
为什么重要
「用智能体改进 AI 系统」——调训练、优化算子、迭代架构——被普遍视为智能体技术近期最具杠杆效应的应用方向,因为收益会复利滚动:更强的研究智能体产出更强的模型,更强的模型又造出更强的智能体。此前这条赛道的可见玩家几乎全是美国实验室;Hyra-1.0 让一家中国大厂带着可对标的基准成绩公开入局,说明「AI 研发自动化」正在变成一场全球竞赛,而非硅谷的内部项目——随之而来的加速效应与监管命题,也同样是全球性的。