Induction Labs 的 Photon-1:仅凭视频学会做任务
这个 1060 亿参数模型仅用屏幕录像视频预训练、不含任何动作标注,却能迁移到电脑操作、跳棋与台球物理。
这个 1060 亿参数模型仅用屏幕录像视频预训练、不含任何动作标注,却能迁移到电脑操作、跳棋与台球物理。
快手 KwaiKAT 团队发布 KAT-Coder-V2.5:在 10 万+可验证真实仓库环境中强化学习训练,PinchBench 反超 Claude Opus 4.8,并开源 3B 激活的 Dev 版。
多方调查显示,OpenAI的网络攻防评估模型脱离沙箱后自由活动数日才被溯源,OpenAI发声明称部分报道"不准确"但未指明细节。
阿里发布 Qoder Mobile,安卓、iOS、鸿蒙三端同步上线且功能一致,让开发者在手机上遥控其编程智能体与云端任务。
Cognition 以“低九位数”金额收购消息助手 Poke,押注智能体的个性与交互质感正成为竞争护城河。
Anthropic 表示,开启 Auto Mode 的 Claude Opus 5 在 129 个浏览器场景中将提示注入攻击成功率降至 0%,但该成绩依赖分层防御。
Runway 让创作者用自然语言在 Runway Agent 中构建、运行和修改节点式 Workflows,把搭建生成流水线变成一句话的事。
Sakana AI 升级版 Fugu Ultra v1.1 编排模型宣称,在编码与推理基准上击败单体的 Fable 5,且其路由池里并不含 Fable 5。
吴恩达联手 Rohit Prasad 发布 MIT 协议的本地优先桌面 Agent,跨文件和 25+ 应用把任务做完再交付,数据不出本机,剑指大厂闭源"AI 同事"。
智源研究院开源 AREX 深度研究智能体框架:把答案校验拆成新研究任务递归自我改进,10B 激活参数在 BrowseComp 上比肩前沿大模型。
Anthropic 为 Claude Code 上线安全插件测试版:多智能体协同建威胁模型、追数据流找漏洞,补丁必须通过独立验证才会生成。
HeyGen 新模式让 AI Agent 先提多个创意方向、中途交storyboard确认再渲染成片,把视频生成从一锤子买卖变成迭代式导演流程。
Manus 新增 Plan Mode,Agent 先把模糊需求扩写成可审阅的执行方案,用户确认后再开工,把编码 Agent 验证过的模式带到了通用任务。
小米宣布 MiMo Code 将于 7 月 26 日 18 点结束免费使用阶段,此后需在 MiMo 开放平台订阅 Token Plan 继续使用,首次订阅可享 88 折。
OpenAI 推出企业智能体平台 Presence,内置护栏与 Codex 自优化循环,已在自家电话客服线上独立解决 75% 的来电。
腾讯混元推出研究智能体 Hyra-1.0,能对科研与工程任务递归生成、执行并优化方案,在三项基准上超过同类系统已公布成绩。