月之暗面开源 Kimi K3:2.8 万亿参数权重登陆 Hugging Face
月之暗面在 7 月 27 日 0 点(UTC)如约放出 Kimi K3 全部 2.8 万亿参数权重,采用 Modified MIT 许可证,成为迄今最大的开源权重模型。
月之暗面在 7 月 27 日 0 点(UTC)如约放出 Kimi K3 全部 2.8 万亿参数权重,采用 Modified MIT 许可证,成为迄今最大的开源权重模型。
快手 KwaiKAT 团队发布 KAT-Coder-V2.5:在 10 万+可验证真实仓库环境中强化学习训练,PinchBench 反超 Claude Opus 4.8,并开源 3B 激活的 Dev 版。
ARC Prize 公布 Claude Opus 5 在 ARC-AGI-3 上拿下 30.2%,约为 GPT-5.6 Sol 的四倍,第三方评测再次改写前沿模型座次。
Anthropic 推出 Opus 5,多项基准接近 Fable 5,在 ARC-AGI-3 上把对手甩开三倍,且沿用 Opus 定价、token 消耗更低。
Midjourney 让 V8.2 结束预览、升为默认模型,这次以美学与个性化为重心,强化画质与风格参考表现。
Anthropic 表示,开启 Auto Mode 的 Claude Opus 5 在 129 个浏览器场景中将提示注入攻击成功率降至 0%,但该成绩依赖分层防御。
Sakana AI 升级版 Fugu Ultra v1.1 编排模型宣称,在编码与推理基准上击败单体的 Fable 5,且其路由池里并不含 Fable 5。
DeepSeek V4 系列今日转正:deepseek-chat 与 reasoner 旧接口停止服务强制迁移,国内大模型首个 API 峰谷计费同步落地。
FLUX 图像模型背后的德国实验室发布多模态旗舰 FLUX 3,单次生成 20 秒带原生音频的视频,并预告年内开源多模态底座。
阿里云宣布基于平头哥自研芯片的真武 M890 超节点在百炼平台承接旗舰模型 Qwen3.8 的生产推理,称推理成本直降四成——国产超节点首次伺服 2 万亿参数级模型。
Cursor推出请求级模型路由Router,为每个编码任务自动匹配最合适的模型,早期企业客户实测成本降低30%-50%且质量不打折。
英国 AISI 与美国 CAISI 联合测评月之暗面 Kimi K3:开源模型中网络攻击能力最强,但与美国前沿模型差距悬殊,蒸馏疑云再起。
阿里通义本周连发 Qwen-Image-3.0 与 Qwen-Audio-3.0-TTS:前者单次生成整版信息图、连 10 像素小字都清晰可读,后者登顶 Artificial Analysis 语音榜。
思科 Foundation AI 开源 350M 和 1B 两款安全小模型,能把公开漏洞情报精准映射到代码库具体文件,成本仅为前沿大模型零头。
Poolside 发布 118B 参数、8B 激活的开源编码模型 Laguna S 2.1,SWE-Bench Multilingual 达 78.5%,OpenRouter 定价仅每百万 token 一两毛美元。
65 位作者的 SLAI T-Rex 论文登顶 Hugging Face 日榜,详解在华为昇腾 SuperPOD 上对万亿参数 DeepSeek-V4 系列完成全参数后训练,全程未用英伟达硬件。
谷歌发布 Gemini 3.6 Flash、3.5 Flash-Lite 和网络安全特化版 Flash Cyber,以更少输出 token 和更低价格押注智能体生产负载,3.5 Pro 仍在测试中。
英伟达开源 40 亿参数世界模型 Cosmos 3 Edge,推理与动作生成全部在端侧完成,Jetson Thor 上实现 15 Hz 实时控制。
K3 上线 48 小时需求暴涨约六倍逼近 GPU 极限,月之暗面暂停新用户订阅;第三方评测显示这款 2.8 万亿参数开源路线模型已与 Claude Fable 5 几乎打平。