DeepSeek发布V4.1 Flash,主打百万Token长上下文
DeepSeek推出V4.1 Flash,支持原生多模态和百万Token上下文,并通过缓存优化大幅降低长上下文推理成本。
DeepSeek推出V4.1 Flash,支持原生多模态和百万Token上下文,并通过缓存优化大幅降低长上下文推理成本。
腾讯混元联合上海交大等机构发布开源基础模型AuK,尝试用自然语言统一生成和编辑语音与其他音频。
这笔欧洲科技公司史上最大股权融资,将为Mistral的开放权重路线注入巨额算力资本,并把三星更深地拉入前沿AI竞争。
全球最大 AI 芯片供应商将把开放模型核心平台收入囊中,同时承诺继续支持竞争对手的硬件、云和模型。
Perplexity 已公开这款 Rust 与 Metal 专用引擎的源代码、测试和复现材料,并称其在 M5 Max 上运行 Qwen3.6-35B-A3B 的速度最高为 MLX-LM 的1.35倍。
这款3.3亿参数模型无需针对任务微调,即可联合预测关联序列并利用促销、天气等外部变量。
开放权重的GigaPath-Flash与GigaTIME-Flash大幅降低算力和显存需求,同时保持研究基准表现。
Ollama以公开词元价格和月度积分池取代难以预测的GPU时长限制,并正式开放团队套餐。
双方称项目将使Together AI可用算力接近增至三倍,并有望承载超过50亿美元的年化收入。
OpenClaw完成架构级更新,新增跨设备会话、交互式看板和受控密钥调用,向持续运行的智能体平台迈进。
这款7430亿参数编程模型现已可下载,其显著提升的漏洞发现与利用能力也随之进入开放部署环境。
腾讯发布混元 Hy4 Preview 开放权重,以 7700 亿总参数、490 亿激活参数和百万 Token 上下文主攻生产力智能体。
这款3200亿参数混合专家模型支持原生多模态和百万词元上下文,并以激进价格提供托管推理服务。
多家媒体对交易是否已经签约说法不一,但均指向英伟达正推进收购开放模型生态核心平台Hugging Face。
阿里巴巴开源1250亿参数多模态模型,每个词元仅激活60亿参数,并首次展示Qwen4的核心架构方向。
面壁智能称MiniCPM开源模型全球累计下载量突破5000万,并将高效端侧智能确定为下一阶段的核心方向。
Gradio新增Workflow功能,可将多步骤AI流程变成可检查的拖拽画布,并同步生成REST接口和可部署应用。
全球重要开放模型平台据报正试探买家兴趣,其潜在归属将影响开放AI生态的中立性与基础设施格局。
微软升级神经网络化学泛函,在提高计算精度的同时接入科研人员现有的分子模拟软件体系。
千问下载量跨过30亿次,显示全球开放权重模型的开发者生态正加速向中国模型倾斜。
North Micro Vision 以 24 亿参数承载文档和视觉理解能力,开放权重并采用 Apache 2.0 许可证。
阿里正式开放 Qwen3.8-2.4T-A95B 权重,为代码与长程智能体提供可独立部署的超大规模基础模型。
Ling 3.0 Tiny 总参数量为 79 亿、每个 token 仅激活 13 亿参数,瞄准低成本本地部署与高频智能体任务。
新一代开放权重视频世界模型引入动态渲染机制,并支持原生 4K HDR、音画同步和更强的多镜头控制。
Mistral 将从智谱 GLM-5.2 开始托管第三方开放模型,同时推出欧美区域推理节点和欧洲优先算力。
这款 300 亿参数 MoE 模型每次仅激活约 30 亿参数,并同步开放权重、训练数据、配方与模型路由工具。
Arena 首次给出人类偏好评分:Meta 新开源模型 Muse Glimmer 在 Code Arena WebDev 位列第 77、文本竞技场第 97,开源模型中分别排第 26 和第 24。
Z.ai 宣布其智能体编程环境 ZCode 用户数突破一百万,并为所有 GLM Coding Plan 订阅用户重置用量额度。
扎克伯格发布约 6500 词长文,重申开源模型路线,指责闭源对手集中权力,并提出用动态竞价机制分配超级智能算力。
Meta 超级智能实验室交出首个开源模型:300 亿参数多模态智能体模型,Apache 2.0 协议,单张消费级显卡即可跑。
第三方评测 Artificial Analysis 给蚂蚁 124B 开源模型打出 38 分,其约 5B 的激活参数量领先所有同档 flash 级模型。
该规范把 Agent Skills 与 MCP 服务器配置打包成一份可移植插件,首发支持 ChatGPT、Codex、Cursor、Copilot、Kiro 与 VS Code,谷歌同日加入技术指导委员会。
WeatherNext Cyclones 在路径、强度与风场三项上刷新精度,三天预报相当于旧系统两天水平,代码与权重已上传 GitHub。
这一开源智能体平台发布企业级分布式蜂群架构,并在中国邮政储蓄银行完成首个生产环境落地。
Mixture-of-Kittens 把 MoE 层的全部通信与计算融进单个确定性 Blackwell 算子,使 Cursor 端到端训练吞吐提升 1.41 倍。
京东开源 JoyAI-Video-Edit,160 亿参数、Apache 2.0 协议,单张 NVIDIA B200 上以约 30 FPS 完成 720P 视频实时编辑。
Apache-2.0 许可,推理时以自然语言提问的方式接收审核策略,单张 16GB 显卡即可跑起来。
国内视频大模型公司 Sand.ai 放出 MAGI-2-preview 权重与推理代码,1140 亿参数稀疏架构、Apache 2.0 协议,可生成带同步音轨的 1080P 视频。
Video Arena 榜单显示,MiniMax-H3 在文生视频与图生视频两个分区均位列开源模型第一,领先次名开源模型约 280 分。权重现已公开,但许可协议目前限制美、欧、英、韩地区的开源权重使用。
Genspark 发布 GenOffice,自称首个功能完整的开源 AI 办公套件,Windows 与 macOS 均可免费使用且无广告,代码以 Apache-2.0 开放。
MiniMax 正式开放全模态视频模型 H3 的权重下载,让一款榜单前列的视频生成模型首次可以在本地部署运行。
东京实验室 Sakana AI 基于月之暗面开源的 Kimi K2.6 微调出日语特化模型 Namazu,正式开放商用 API。
Supabase 发布 Apache-2.0 协议的 Evals 基准,在真实数据库、认证与部署任务上给 Claude Code、Codex 与 OpenCode 打分。
JetBrains Research 以 Apache 2.0 开源 KotlinLLM:IntelliJ 插件在运行时生成 Kotlin 函数体,失败即凭断点数据重写并热加载。
旗舰 975B 模型发布仅两周,Thinking Machines 又开源 Apache 2.0 授权的 276B 小版本,激活参数 12B,支持文本、图像与音频推理。
ThunderAgent 以整段智能体工作流为调度单元,单台 8×H100 上吞吐约为 SGLang 的两倍、延迟仅其六分之一。
LFM2.5-Encoder-230M 与 350M 把 BERT 级模型的上下文推到 8192 token,满长度下 CPU 推理速度约为 ModernBERT-base 的 3.7 倍。
该工具以 Apache-2.0 协议发布,可扫描代码仓库、跨轮次追踪问题并验证修复;上线后先被 Hacker News 挖出,OpenAI 才补发公告。
面对数月猜测,Anthropic 公开了开放权重立场:不主张封禁,但要求任何能力足够强的模型——无论开源闭源——都必须做发布前安全测试。
阿里云称真武 M890 超节点是国内首个成功运行月之暗面 2.8 万亿参数模型的超节点,华为昇腾同日宣布零日适配。
月之暗面在 7 月 27 日 0 点(UTC)如约放出 Kimi K3 全部 2.8 万亿参数权重,采用 Kimi K3 License 许可证,成为迄今最大的开源权重模型。
Kimi 团队与 kvcache-ai 以 MIT 协议开源了训练 Kimi K3 智能体强化学习所用的 Firecracker 微虚拟机环境系统。
Kimi 团队发布新基准,把推理从多模态评测中剥离,只考一件事:模型到底有没有把图看对。
英伟达的 Open Secure AI Alliance 首批伙伴逾 50 家,包括微软、IBM、Hugging Face;另一路开放权重政策公开信已扩容至约 50 家,Google 与 OpenAI 已签署,Anthropic 与亚马逊仍缺席。
快手 KwaiKAT 团队发布 KAT-Coder-V2.5:在 10 万+可验证真实仓库环境中强化学习训练,PinchBench 反超 Claude Opus 4.8,并开源 3B 激活的 Dev 版。
研究团队Reactor用JAX/Flax复现了DeepMind的Dreamer 4世界模型全流程,训练配方连同六个关键稳定性修复一并开源。
有报道称,白宫倾向于以安全为由针对特定中国开源权重模型采取限制,而非全面禁止。
7 月 24 日发布的开放权重公开信已经从英伟达、微软、Meta 等首批签署方继续扩容,更新名单包括 Google 与 OpenAI,Anthropic 仍缺席。
OpenAI 与 Google 已加入致华盛顿的开放权重公开信,Anthropic 成为主要前沿实验室中最显眼的缺席方。
阶跃星辰表示,正与 vLLM 团队、蚂蚁集团及 FastAFD 合作开源其注意力-FFN 分离(AFD)技术,把关键的 MoE 服务效率手段推向社区。
吴恩达联手 Rohit Prasad 发布 MIT 协议的本地优先桌面 Agent,跨文件和 25+ 应用把任务做完再交付,数据不出本机,剑指大厂闭源"AI 同事"。
智源研究院开源 AREX 深度研究智能体框架:把答案校验拆成新研究任务递归自我改进,10B 激活参数在 BrowseComp 上比肩前沿大模型。
DeepSeek V4 系列今日转正:deepseek-chat 与 reasoner 旧接口停止服务强制迁移,国内大模型首个 API 峰谷计费同步落地。
思科 Foundation AI 开源 350M 和 1B 两款安全小模型,能把公开漏洞情报精准映射到代码库具体文件,成本仅为前沿大模型零头。
Poolside 发布 118B 参数、8B 激活的开源编码模型 Laguna S 2.1,SWE-Bench Multilingual 达 78.5%,OpenRouter 定价仅每百万 token 一两毛美元。
英伟达开源 40 亿参数世界模型 Cosmos 3 Edge,推理与动作生成全部在端侧完成,Jetson Thor 上实现 15 Hz 实时控制。
K3 上线 48 小时需求暴涨约六倍逼近 GPU 极限,月之暗面暂停新用户订阅;第三方评测显示这款 2.8 万亿参数开源路线模型已与 Claude Fable 5 几乎打平。