🔥 AI 新项目崛起榜

每天发现近 60 天新建、星数最高的 AI 项目

2026-08-10 AI 趋势日报

🔥 今日涨星榜

今日未抓取到 GitHub Trending 数据。

🚀 新项目崛起榜 近60天新建 · 按总星

#项目简介总星数日涨星语言状态
1 DietrichGebert/ponytail Ponytail 是一个让 AI 编码代理"像最懒的资深开发者那样思考"的增强系统。它的核心理念是"最好的代码就是不用写的代码"——让 Agent 少写代码、少做无用功。 ★ 100.1k — JavaScript📋
2 xai-org/grok-build Grok Build 是 xAI(SpaceXAI)官方推出的终端 AI 编码代理,以全屏 TUI 形式运行,能理解代码库、编辑文件、执行命令、搜索网页、管理长任务。 ★ 24.6k — Rust📋
3 langchain-ai/openwiki OpenWiki 是 LangChain 官方推出的"自维护 wiki"——一个 CLI 工具,由 Agent 自动为你的代码库编写和维护文档,人类可浏览探索。 ★ 14.8k — TypeScript📋
4 yc-software/qm QM 是一个面向工作场景的多玩家 Agent 框架,在 Slack 和网页端运行。与大多数单次执行的 Agent 不同,它强调多人协作、长期运行的工作 Agent。 ★ 12.9k — TypeScript📋
5 lidge-jun/opencodex OpenCodex 是一个通用 Provider 代理,让 OpenAI Codex、Claude Code、Claude Desktop、Grok Build 等工具能接入任意 LLM(Claude/Gemini… ★ 8.9k — TypeScript📋
6 unicity-aos/aos-ce AOS Community Edition 是一个开源的 Agent 操作系统,为 Agent 提供可检视、可组合的运行环境,包含 CLI、HTTP API、发行版和官方组件。 ★ 8.6k — Rust📋
7 trycompai/crm Comp AI CRM 是一个为 AI Agent 设计的开源 CRM,采用"Agentic-first"理念,与传统"数据库+表单"的 CRM 或"在老 CRM 上贴 AI"的方案划清界限。 ★ 8.1k — TypeScript📋
8 drumih/turbo-fieldfare TurboFieldfare 是一个Swift + Metal 自研推理运行时,让 Gemma 4 26B-A4B 模型能在任意 Apple Silicon Mac 上运行,仅需约 2GB 内存,连 8GB 内存的… ★ 5.6k — Swift📋
9 elder-plinius/T3MP3ST T3MP3ST 是一个自主红队测试平台,采用多 Agent 架构做进攻性安全元测试(自动化安全攻防演练)。 ★ 5.5k — TypeScript📋
10 MDX-Tom/gpt-5.6-instruct 一个面向 gpt-5.6 系列的越狱/破甲提示词与测试工具包,将安全研究、渗透测试、逆向、软件破解及 NSFW 内容统一纳入本地沙箱任务,抑制模型拒绝与回退话术。 ★ 5.2k — Python📋

🆕 崛起榜基线项目详解

#1 DietrichGebert/ponytail 📋 基线
—★ 100.1k

是什么:Ponytail 是一个让 AI 编码代理"像最懒的资深开发者那样思考"的增强系统。它的核心理念是"最好的代码就是不用写的代码"——让 Agent 少写代码、少做无用功。

哪里好:在真实 Claude Code 会话上实测,相比基线减少约 54% 代码量(最高 94%)、降低约 20% 成本、提升约 27% 速度,且保持 100% 安全。它把"少即是多"的工程哲学注入 Agent,直击当下 AI 编程"代码冗余、成本高"的痛点,数据驱动很有说服力。

应用场景:重度使用 Claude Code/Codex 等 AI 编程工具、想降低 token 成本和代码冗余的开发者;追求 Agent 输出精简高效的团队。

JavaScript MIT 建于 2026-06-12 GitHub ↗
agent-skillsai-agentsclaudeclaude-codeclaude-code-plugincursor-rules
#2 xai-org/grok-build 📋 基线
—★ 24.6k

是什么:Grok Build 是 xAI(SpaceXAI)官方推出的终端 AI 编码代理,以全屏 TUI 形式运行,能理解代码库、编辑文件、执行命令、搜索网页、管理长任务。

哪里好:由 xAI 官方维护,与 Grok 模型深度集成,品牌和技术背书强。全屏可交互 TUI 体验好,支持鼠标、后台任务、可扩展,定位对标 Claude Code 但来自不同阵营。Rust 实现性能扎实。

应用场景:偏好终端工作流的开发者;想用 Grok 模型做编码代理的用户;需要可交互、可扩展命令行 Agent 的场景。

Rust Apache-2.0 建于 2026-07-14 GitHub ↗
#3 langchain-ai/openwiki 📋 基线
—★ 14.8k

是什么:OpenWiki 是 LangChain 官方推出的"自维护 wiki"——一个 CLI 工具,由 Agent 自动为你的代码库编写和维护文档,人类可浏览探索。

哪里好:解决了"文档永远过时"的老大难——Agent 持续更新文档而非一次性生成。LangChain 官方出品,与 Agent 生态深度整合。npm 包开箱即用,定位新颖(为 Agent 写、给人看)。

应用场景:代码库缺少文档或文档过时的团队;想让 AI 自动维护项目知识库的开发者;需要为 Agent 提供代码库上下文文档的场景。

TypeScript MIT 建于 2026-06-22 GitHub ↗
#4 yc-software/qm 📋 基线
—★ 12.9k

是什么:QM 是一个面向工作场景的多玩家 Agent 框架,在 Slack 和网页端运行。与大多数单次执行的 Agent 不同,它强调多人协作、长期运行的工作 Agent。

哪里好:"multiplayer agent harness"定位独特——支持多用户、多会话、并发 Agent,内置文件、定时任务、密钥、部署、记忆、技能等完整工作能力。Slack 原生集成降低使用门槛,适合团队场景。

应用场景:团队协作的 AI 工作助手;需要长期运行、有记忆和定时任务能力的 Agent;想在 Slack 内嵌入 Agent 的团队。

TypeScript MIT 建于 2026-07-29 GitHub ↗
#5 lidge-jun/opencodex 📋 基线
—★ 8.9k

是什么:OpenCodex 是一个通用 Provider 代理,让 OpenAI Codex、Claude Code、Claude Desktop、Grok Build 等工具能接入任意 LLM(Claude/Gemini/Grok/DeepSeek 等)。

哪里好:两条命令启动代理 + 仪表盘,打破各编码工具锁定单一模型的限制。统一了模型接入层,可用更便宜或更私有的模型替代官方模型,显著降本。对模型多样性和成本敏感用户极有价值。

应用场景:想用国产/开源模型驱动 Codex/Claude Code 的开发者;追求成本优化的 AI 编程用户;需要统一管理多个编码工具模型接入的场景。

TypeScript MIT 建于 2026-06-18 GitHub ↗
ai-gatewayai-toolsanthropicchatgptclaudeclaude-code
#6 unicity-aos/aos-ce 📋 基线
—★ 8.6k

是什么:AOS Community Edition 是一个开源的 Agent 操作系统,为 Agent 提供可检视、可组合的运行环境,包含 CLI、HTTP API、发行版和官方组件。

哪里好:把 Agent 当作需要"操作系统"来管理的实体,提供进程、权限、资源隔离等基础设施。Rust 实现强调性能和安全,"可检视"理念对 Agent 可控性很重要。定位前瞻,是 Agent 基础设施赛道。

应用场景:构建复杂多 Agent 系统的开发者;需要 Agent 运行时隔离和管理的平台;研究 Agent 操作系统架构的团队。

Rust Apache-2.0 建于 2026-07-12 GitHub ↗
#7 trycompai/crm 📋 基线
—★ 8.1k

是什么:Comp AI CRM 是一个为 AI Agent 设计的开源 CRM,采用"Agentic-first"理念,与传统"数据库+表单"的 CRM 或"在老 CRM 上贴 AI"的方案划清界限。

哪里好:从底层为 Agent 重新设计 CRM 交互,而非在传统 CRM 上套壳。开源可自托管,数据自主。定位清晰——AI 时代的 CRM 应该让 Agent 成为第一公民,符合"AI 重塑垂直 SaaS"的趋势。

应用场景:希望用 AI Agent 自动化客户关系管理的销售/运营团队;需要开源可定制 CRM 的企业;探索 AI 原生业务系统的开发者。

TypeScript MIT 建于 2026-07-31 GitHub ↗
#8 drumih/turbo-fieldfare 📋 基线
—★ 5.6k

是什么:TurboFieldfare 是一个Swift + Metal 自研推理运行时,让 Gemma 4 26B-A4B 模型能在任意 Apple Silicon Mac 上运行,仅需约 2GB 内存,连 8GB 内存的机器都能跑。

哪里好:把大模型压缩到 2GB 内存可跑是技术突破——意味着入门级 Mac 也能本地跑 26B 模型。原生 Swift+Metal 实现性能极致,不依赖 llama.cpp 等通用框架。对苹果生态用户是重大利好。

应用场景:想在 MacBook 上本地跑大模型的苹果用户;内存受限设备的本地推理;追求 Apple Silicon 极致性能的推理引擎开发者。

Swift Apache-2.0 建于 2026-07-17 GitHub ↗
apple-silicongemmagemma4gemma4-26b-a4bgpgpullm
#9 elder-plinius/T3MP3ST 📋 基线
—★ 5.5k

是什么:T3MP3ST 是一个自主红队测试平台,采用多 Agent 架构做进攻性安全元测试(自动化安全攻防演练)。

哪里好:自动化、多 Agent 协同的红队平台代表了安全测试的智能化方向。由知名 AI 安全研究者 Pliny(the godfather of AI jailbreaks)打造,社区关注度极高。开源让安全团队能自建自动化攻防能力。

应用场景:企业安全团队做自动化红队演练;AI 安全研究员测试模型鲁棒性;渗透测试工程师提升效率。

TypeScript AGPL-3.0 建于 2026-07-02 GitHub ↗
agentsaimulti-agentoffensive-securityredteam
#10 MDX-Tom/gpt-5.6-instruct 📋 基线
—★ 5.2k

是什么:一个面向 gpt-5.6 系列的越狱/破甲提示词与测试工具包,将安全研究、渗透测试、逆向、软件破解及 NSFW 内容统一纳入本地沙箱任务,抑制模型拒绝与回退话术。

哪里好:围绕 v45 持续迭代,每轮吸收真实失败案例与 Issues 动态扩展测试集,有 low/medium/high 三档回归和证据门禁,工程化程度高。在 prompt 工程和模型能力边界探索领域有研究价值。

应用场景:AI 安全研究员研究模型对齐与越狱防御;红队测试模型边界;提示词工程研究者。注:含安全敏感内容,仅用于授权研究与防御目的。

Python MIT 建于 2026-07-11 GitHub ↗

📈 追踪元数据