用户收藏的 AI Agent / 大模型应用开发相关优质仓库,持续更新。 所有仓库均已 ⭐ Star。
今天筛选出的新项目,共 9 个
标签:Agent 开发
详细描述:递归自改进 Agent 框架,把"自我迭代"作为核心设计目标。它内置了完整的记忆系统、进化机制、质量门禁、身份体系等模块,开箱即用自动注册 40+ 工具。学习"Agent 如何在运行中持续变强"这一前沿方向必看,也适合用来对比传统固定 Prompt Agent 范式。
stars: 167 | language: Python | created: 2026-05-25
标签:Agent 开发 / 工具链
详细描述:面向 Claude Code 的可视化多 Agent 编排平台。可视化创建多个 Agent、按 DAG 串成流水线,实时观察它们协作的全过程。降低多 Agent 编排门槛,让不会写编排脚本的同学也能玩转多 Agent。适合作为 Claude Code 多 Agent 工作流的图形化设计器。
stars: 64 | language: JavaScript | created: 2026-05-25
标签:工具链
详细描述:面向 AI 创业运营者的可复用 Claude Code 技能集,MIT 协议开源。每个 Skill 都聚焦"AI 创业运营"这一具体岗位的真实场景。学习"如何为某个垂直岗位定制一整套 Skill 库"的实战范例,比读 Prompt Engineering 文档更具体。
stars: 38 | language: Python | created: 2026-05-25
标签:Agent 开发 / 工具链
详细描述:严格的系统级行为约束协议,主打"代码库优先执行"和严格的 Token 经济学机制。强制 Agent 行为确定性、可审计,避免 Token 失控。对正在研究 Agent 治理、可控性、安全护栏的工程师是少见的、把"硬约束"做到协议层的参考实现。
stars: 35 | language: N/A | created: 2026-05-25
标签:学习资源 / 工具链
详细描述:社区精选的真实生产级 Claude Code 动态工作流合集——多 Agent 编排脚本,以斜杠命令形式安装。源自生产环境第一线经验,每一条都经过实际项目验证。学习 Claude Code 高级用法、研究多 Agent 协作模式必看的一份 awesome list。
stars: 20 | language: Shell | created: 2026-05-25
标签:工具链
详细描述:LLM Agent 运行时安全网。检测 Token 失控循环、提前终止注定失败的任务,并清晰说明终止原因。Rust 核心 + Python SDK,性能可控、集成简单。安装方式:pip install state-harness。对生产环境跑长任务 Agent 的人是刚需工具,避免一次失控烧光预算。
stars: 16 | language: Python | created: 2026-05-25
标签:工具链
详细描述:LLM 与 Agent 基准的自动审计流水线,自动揭示任务歧义、环境冲突、评测 Bug 等常见问题。对正在做 Agent Eval、构建 Benchmark 的同学很有价值——做 Eval 最怕的不是模型分数低,而是 Bench 本身设计就有问题却没人发现。
stars: 13 | language: HTML | created: 2026-05-25
标签:Agent 开发
详细描述:Rust 语言实现的 Agent SDK、CLI 与平台一体化项目。整套技术栈用 Rust 写,关注 Agent 性能、内存安全、低延迟等底层实现层面的同学可以重点研究。Python Agent 一统天下的当下,Rust 实现往往意味着不同的工程取舍。
stars: 6 | language: Rust | created: 2026-05-25
标签:工具链
详细描述:基于 WebDriver BiDi 协议的 AI Agent 浏览器驱动框架,灵感源自 browser-use/browser-harness。BiDi 是浏览器自动化的下一代标准协议,比经典 WebDriver 更适合 AI Agent 的事件流式控制。正在做浏览器 Agent、网页自动化 Agent 的同学可以参考。
stars: 5 | language: Python | created: 2026-05-25
今天筛选出的新项目,共 5 个
标签:Agent 开发 / 学习资源
详细描述:《如何从零构建 7×24 小时 AI Agent》——一本系统性拆解 30 万行真实 AI Agent 平台代码的技术书。不只是讲"怎么写一个 Agent",而是把生产级 AI Agent 平台从架构选型、模块拆分、可靠性工程到长期运维的全过程摊开来讲。对正在做 Agent 平台化、生产化部署的工程师来说,是少见的、能从案例里学到方法论的实战读物。
stars: 64 | language: TypeScript | created: 2026-05-24
标签:学习资源 / Agent 开发
详细描述:面向小白的 AI/LLM 学习入口平台,把 AI 基础、提示词工程、工具使用、RAG、Agent、部署、评测、安全常识等模块串成一条可走通的路径。每个模块都配有案例、练习和可复现项目,零基础读者可以一步步把这条路走通。适合作为 Agent 开发的入门导航地图,也适合用来给团队新人做 Onboarding。
stars: 34 | language: Python | created: 2026-05-24
标签:Coding Agent / Agent 开发
详细描述:手把手教你用 Next.js + Supabase + Gemini AI + Cline SDK + Shadcn UI 完整搭建一个 Full Stack Agentic App 的实战教程。从前端界面、后端数据层到 Agent 编排层全链路覆盖,看完能自己撸出一个完整的 Agent 应用。学习 Agent 应用如何与主流 Web 技术栈结合的真实范式。
stars: 26 | language: TypeScript | created: 2026-05-24
标签:Agent 开发
详细描述:双 Agent 协作框架:左脑负责结构化编码、语法校验、Debug 这种"硬"工作;右脑负责宏观架构、创意模式、UX 流程这种"软"工作。把一个 Agent 干不了的认知负载拆给两个 Agent 协同,既能减少幻觉又能提升系统可扩展性。多 Agent 协作设计模式值得学习,对 Agent 编排、Task 拆分、Prompt 角色化设计都有启发。
stars: 19 | language: Python | created: 2026-05-24
标签:Agent 开发 / 工具链
详细描述:50+ 个开箱即用的 AI Agent 自动化实战案例精选集,覆盖真实业务工作流。每个案例都可以直接跑起来,适合想快速看到 Agent 在不同场景下落地形态的开发者。本质上是一份 Agent Patterns 速查表,研究 Agent 如何在真实业务里工作,看这一份仓库就够入门了。
stars: 6 | language: Python | created: 2026-05-24
今天筛选出的新项目,共 16 个
标签:Agent 开发
详细描述:开源的 AI Agent 元调度框架,号称 Agent 的 'meta-harness'。它可以在 Claude Code、Codex、Cursor 等多种编程 Agent 之间做统一调度与任务分发,让多个 Agent 协同完成大型项目。对正在做多 Agent 协作或多工具整合的开发者很有借鉴价值。
stars: 4320 | language: Python | created: 2026-06-11
标签:工具链
详细描述:BuilderIO 官方维护的 Coding Agent Skills 集合,覆盖前端代码生成、组件构建、设计稿还原等高频场景。每个 Skill 都遵循标准化结构,便于直接挂载到 Claude Code 或 Codex 中。学习如何为 Agent 写高质量 Skill 必看。
stars: 2329 | language: JavaScript | created: 2026-06-10
3. vercel/eve
标签:Agent 开发
详细描述:Vercel 官方开源的 Agent 构建框架,主打生产级工程化能力。它提供声明式的工具定义、状态管理与函数调度抽象,让开发者用熟悉的 Next.js 风格搭建可观测、可扩展的 Agent 应用。适合想了解 Web 端 Agent 部署范式、与 Vercel Functions 深度集成的工程师。安装方式:npm i @vercel/eve。
stars: 2053 | language: TypeScript | created: 2026-06-16
标签:Coding Agent
详细描述:面向复杂代码库的 Agent Harness,强调「项目记忆 → 规划 → 执行 → 验证」四阶段闭环。它通过持久化的项目状态、任务分解与自动验证机制,让 Agent 在大型 codebase 上保持长期一致性。适合做大型项目长期 Agent 协作的工程师学习。
stars: 1711 | language: TypeScript | created: 2026-05-25
标签:工具链
详细描述:为 Hermes Agent 量身定制的 7 层记忆操作系统,集成 Qdrant 向量库与结构化事实存储。它把 Agent 记忆分成短期上下文、长期事实、用户偏好等多个层级,让 Agent 真正实现「跨会话记忆」。研究 Agent 长期记忆架构的必读项目。
stars: 1178 | language: Python | created: 2026-05-31
标签:Coding Agent
详细描述:面向 vibe coder、产品经理、CEO 的 Spec-driven 编码脚手架:先写规约再写代码,避免 AI 写完即忘。它通过强约束的 Spec 模板,让非工程师也能驱动 AI 完成结构化开发。学习 Agent 协同开发流程的好样本。
stars: 957 | language: JavaScript | created: 2026-05-27
7. agent0ai/dox
标签:工具链
详细描述:自动化维护项目 AGENTS.md 的工具,让 Agent 始终有一份最新、自描述的项目说明书。它能扫描代码、生成结构化的 Agent 可读文档,避免 Agent 接手项目时「两眼一抹黑」。学习 Agent 项目治理与上下文准备的好案例。
stars: 934 | language: N/A | created: 2026-06-01
8. yorgai/ORG2
标签:Coding Agent
详细描述:开源的 Cursor 风格 Agent IDE,主打可审查性和可控性。它不只是追求编码速度,更强调每次代码改动都有清晰的理由与可回滚的路径。适合想自建 Agent IDE、或对 Agent 行为透明度有要求的同学参考其架构。
stars: 876 | language: TypeScript | created: 2026-06-01
标签:工具链
详细描述:Coding Agent 的质量门禁 Skills,专门拦截 AI 生成的代码、测试、配置中的失败模式。它通过一组预定义的 Quality Gate Skill,在 Agent 提交前自动审查并拒绝不合格的产出。学习 Agent 质量保障体系的优秀范例。
stars: 868 | language: N/A | created: 2026-06-06
标签:Coding Agent
详细描述:基于 Claude / Codex Agent SDK 的 Tree-of-Thought Skills,带剪枝逻辑,让 Agent 在编码时主动展开多路径推理,再根据评估函数剪除低效分支。它把经典的 ToT 算法包装成可挂载的 Skill,降低了工程化门槛。
stars: 865 | language: TypeScript | created: 2026-05-25
标签:学习资源
详细描述:精选的可免费使用的 AI 模型、API、工具清单,按任务类型分组并标注使用限制。对于想低成本搭建 Agent 原型、试验多模型路由策略的同学非常实用,是 awesome list 的典范。
stars: 787 | language: N/A | created: 2026-06-06
标签:Coding Agent
详细描述:微软开源的 Coding Agent 训练框架,核心是高效的代码仓库上下文检索器,用于训练更快更准的 Repo Explorer Agent。它解决了 Agent 在大型代码库中如何快速定位相关代码的难题。学习 Agent 训练数据工程的同学可以重点关注。
stars: 758 | language: Python | created: 2026-06-02
13. duckbugio/flock
标签:Agent 开发
详细描述:自主 AI 开发团队机器人,多 Agent 协作自动完成开发任务。它把开发流程拆给不同的 Agent 角色并行执行,再统一汇总结论。对研究「Autonomous Engineering Team」范式的同学有参考价值。
stars: 748 | language: Go | created: 2026-06-08
标签:学习资源
详细描述:《Loop Engineering 橙皮书》中英文双语 PDF,面向 Agent 工程师讲解循环式 Agent 工程方法论。从概念到实践的系统性入门读物,覆盖 loop 设计原则、常见反模式与实战案例。
stars: 724 | language: N/A | created: 2026-06-15
标签:学习资源
详细描述:工程、评测、运维、内容、设计等多场景的 AI Agent 可复用工作流集合。本质是一份「Agent Loop Patterns」速查表,覆盖从需求分析到结果验收的完整 loop 模板。适合作为实战模板库直接借鉴使用。
stars: 713 | language: HTML | created: 2026-06-12
标签:工具链
详细描述:把含糊的 Codex 任务转成结构化的 /goal 命令,明确结果、验证步骤、约束条件、迭代策略与完成证据。它是任务分解与目标工程化的优秀 Skill 范例,适合学习如何让 Agent 任务更可观测、可验证。
stars: 699 | language: Python | created: 2026-06-11
今天筛选出的新项目,共 5 个
标签:学习资源 / Agent 开发
这是一份精心整理的 Agent 演化方向综述,覆盖自我进化、记忆机制、skill 系统、harness 设计、benchmark 以及多 agent 协同等前沿主题。非常适合想系统梳理 Agent 技术演进的开发者快速建立知识地图。仓库采用 awesome list 形式,每个主题都附带论文、博客与开源项目链接,按主题分组便于纵深阅读。
stars: 171 | language: JavaScript | created: 2026-05-22
标签:Agent 开发 / 工具链
项目聚焦一个真实痛点:高风险改动如何获得第二意见。它把多个顶级代码 Agent(Codex、Claude Code、GLM、DeepSeek、Qwen)组织成对抗性评审场,每个 Agent 独立 review、红队攻击、互相质询,最终给出裁决建议。学习价值在于如何设计"多 Agent 辩论协议"与"evidence-first"的协作模式,对 Agent 编排爱好者很有参考意义。
stars: 26 | language: Markdown | created: 2026-05-22
3. chinaykc/atm
标签:工具链 / Agent 开发
项目提出了一种 Markdown 扩展格式,把多 Agent 协作任务写成像运维 runbook 一样的可读文档,再用 CLI 执行。它的亮点是把"任务定义"与"任务执行"解耦——任务写在 Markdown 里、便于版本管理与审查;执行由 CLI 解析与调度。适合想了解 Agent 工作流标准化与可观测性设计的同学。
stars: 11 | language: Go | created: 2026-05-22
标签:Coding Agent / Agent 开发
这是典型的"造 Agent 轮子"项目:把 Agent 主循环(model ↔ tool ↔ observation)抽象成 SDK,让开发者只关心"用什么模型"和"暴露哪些工具"。代码量不大,但展示了如何用 TypeScript 干净地封装 Agent runtime,适合想自己写 Agent 框架的开发者参考。
stars: 6 | language: TypeScript | created: 2026-05-22
标签:Coding Agent / Agent 开发
项目主张"先思考后编码":Agent 接到任务后,必须先产出完整 Spec(接口、行为、边界条件),再据此生成代码。这种 Spec-driven 思路能显著降低 Agent 直接写代码的出错率,是工程化 Agent 的重要方向。适合研究 prompt 工程与 Agent 规划能力的同学。
stars: 5 | language: TypeScript | created: 2026-05-22
今天筛选出的新项目,共 7 个
标签:Agent 开发 / 多 Agent 协作
详细描述:基于 LangGraph 编排的多 Agent 旅行规划系统,结合高德地图 POI 数据、路线聚类算法与 LLM 行程生成能力。完整演示了 LangGraph 在多步骤、可中断、可恢复的真实业务流中的工程实践。适合学习 LangGraph 状态机设计、多 Agent 分工、地图 API 与 LLM 协同的开发者。
stars: 33 | language: Python | created: 2026-05-21
标签:Agent 开发 / 工具链
详细描述:面向 ACP(Agent Client Protocol)协议的独立多 Agent 聊天客户端。直连 GitHub Copilot CLI、Claude Code 等支持 ACP 的 CLI 工具,把多个 Agent 编排到统一聊天界面。适合学习 Agent 通信协议、多 Agent UI 编排以及 CLI Agent 互操作的开发者。
stars: 13 | language: TypeScript | created: 2026-05-21
标签:Skill 系统 / 学习资源
详细描述:面向 Agent 的设计工程技能图谱,覆盖动画、转场、品味、字体、配色、组件、反模式七大主题。是一份把设计工程知识整理成 Agent 可调用 Skill 形式的系统性资料。适合研究 Agent Skill 设计、跨领域知识封装以及前端设计工程化的开发者。
stars: 7 | language: - | created: 2026-05-21
标签:Coding Agent / 工具链
详细描述:以「规划 → 审批 → 验证 → 记录」四阶段强制门控为核心理念的 AI 工作流外壳。兼容 Claude Code、Codex、Antigravity 与 Cursor 等多种 Agent 工具,提供人工优先、可审计的开发流程。适合学习 Agent 工程化治理、人工审批流程嵌入与多 Agent 工具协同的实践者。
stars: 11 | language: Shell | created: 2026-05-21
标签:Agent 开发 / Coding Agent
详细描述:面向 LLM Agent 的「代码优先」确定性命令行工具框架。基于 Zod schema 与结构化输出契约,让 Agent 能零猜测地发现、校验并调用 CLI 工具。适合学习 Agent 工具系统设计、Schema 驱动开发以及确定性接口与概率模型结合的工程师。
stars: 7 | language: TypeScript | created: 2026-05-21
标签:Skill 系统 / 多 Agent 协作
详细描述:33 个 AI 设计 Agent 跨 7 个能力层级,配合 REJECT 拒答机制的多 Agent 设计语言技能包。兼容 Claude Code、Codex CLI、Copilot CLI 等主流 CLI Agent。v2.5 新增 AI 原生 Path G,覆盖流式输出、工具调用、推理、引用与产物生成。适合学习多 Agent 设计系统、Skill 跨平台适配以及 AI 原生 UI 范式的开发者。
stars: 6 | language: JavaScript | created: 2026-05-21
标签:Coding Agent / 工具链
详细描述:为本地 Codex Agent 打造的「图像优先」交互画布。把 Codex 的工作区可视化为画布视图,让 Agent 在图片、文件、代码之间自由编排。适合研究 Agent 本地可视化、Codex 工作流增强以及多模态 Agent 交互界面的工程师。
stars: 51 | language: TypeScript | created: 2026-05-21
今天筛选出的新项目,共 8 个
标签:Agent 长会话 / 上下文保鲜
详细描述:这是一个解决 AI Agent 长会话「操作漂移」问题的极简项目。它把防退化策略打包成一个 MIT 开源文件,让 AI 编码 Agent 在长任务中保持稳定输出,避免上下文腐烂导致的逻辑跑偏。适合希望学习 Agent 长会话管理、上下文保鲜策略以及最小可用配置的开发者。
stars: 30 | language: HTML (单文件) | created: 2026-05-20
标签:Coding Agent / 多模型协作
详细描述:这是一个为 Claude Code 量身定做的多 Agent 代码审查委员会。它并行调度 Codex(GPT-5.5)、Gemini 3.1 Pro 以及 4 个 Claude 专家子 Agent,分别覆盖安全、性能、逻辑、回归四个维度,把多模型协作评审工程化。适合希望学习多模型协作评审、多 Agent 分工模式以及集成第三方大模型到编码工作流的工程师。
stars: 16 | language: - | created: 2026-05-20
标签:Agent 记忆 / MCP 工具链
详细描述:这是一个面向多 Agent 团队的集体记忆系统。它内置十阶段 GAMR 检索引擎、基于 Apache AGE 的知识图谱、文档摄入接口以及 32+ MCP 工具,让多个 Agent 共享一份可检索的记忆库。适合希望学习 Agent 团队级共享记忆、知识图谱结合向量检索以及 MCP 工具链集成的工程实践者。
stars: 11 | language: HTML | created: 2026-05-20
标签:Coding Agent / 本地优先
详细描述:这是一个本地优先、零运行时依赖的编程工作流 CLI Agent。它 Provider 中立、工具类型化,以北欧神话中侏儒铁匠 Dvalin 命名,致敬「极简锻造」哲学。适合学习极简 Agent CLI 架构、Provider 解耦设计与类型化工具系统的开发者。
stars: 9 | language: TypeScript | created: 2026-05-20
标签:学习资源 / 知识整理
详细描述:这是一个专门为 Agent 设计的语言目录集合,整理了 Agent 专用的 DSL 与新型编程范式。可作为 Agent 语言生态的速查 awesome list。适合希望系统性了解 Agent 编程语言生态、寻找合适 DSL 切入点的研究者与开发者。
stars: 8 | language: TypeScript | created: 2026-05-20
标签:Agent 安全 / 审计引擎
详细描述:这是一个 AI Agent 的授权、委派、来源追溯与可验证审计引擎。它已发布 MCP 适配器,可通过 MCP 协议接入主流 Agent 框架。适合学习 Agent 安全治理、权限委派链设计、可追溯执行与可验证审计等企业级关键能力的工程师。
stars: 6 | language: Python | created: 2026-05-20
标签:多 Agent 合议 / 评审框架
详细描述:这是一个把 LLM Council 方法适配到 Codex 工作流的框架。它设计了五个独立角色、紧凑角色输出、匿名评审、评分量规、异议捕获与主席综合决策机制,把多 Agent 合议决策系统化。适合学习多 Agent 评审模式、合议决策工程实现与匿名评审策略的研究者与开发者。
stars: 6 | language: Python | created: 2026-05-20
标签:Skill 系统 / Coding Agent
详细描述:这是一个作者历时六个月打磨的 Claude Agentic Skills 2.0 版本,聚焦 Agent 可复用技能的封装、调用与版本管理。适合学习如何为 Claude Agent 设计、组织与迭代技能库的开发者。
stars: 6 | language: - | created: 2026-05-20
今天筛选出的新项目,共 4 个
标签:Agent 开发
详细描述:这是一个元 Agent 系统——让 Agent 自己造 Agent 的闭环 AI 平台。核心思路是 Agent 主动访谈需求、设计架构、测试验证、再交付可独立运行的 Python Agent。适合研究 Agent 自动生成、多 Agent 编排、自我演化架构的同学。
stars: 13 | language: Python | created: 2026-05-17
标签:Agent 开发 / Coding Agent
详细描述:基于 LangGraph.js 与 MCP/WebMCP 协议的实验性 Chrome 侧边栏浏览器 Agent。支持本地模型接入和语义化浏览器自动化操作。技术栈同时覆盖 LangGraph 与 MCP 两大核心,适合研究多协议浏览器 Agent 架构、本地 LLM 集成的同学。
stars: 14 | language: JavaScript | created: 2026-05-17
标签:Coding Agent
详细描述:"蜂鸟编码 Agent"——极简、模型无关、可组合的 Coding Agent。从第一性原理出发实现,基于树形记忆、精确文件编辑、富终端 UI。适合想从底层理解 Coding Agent 架构、不依赖 LangChain 等重型框架的同学。
stars: 8 | language: Python | created: 2026-05-17
标签:Agent 开发
详细描述:基于 LangGraph + DeepSeek + Tavily 构建的多 Agent 研究编排器。核心特性包括 critic 循环(自我批评迭代优化)、HITL 人机协同、并行工具调用。是学习 LangGraph 实战模式、DeepSeek 接入、Tavily 搜索集成的入门示例。
stars: 4 | language: Python | created: 2026-05-17
今天筛选出的新项目,共 3 个
Agent 开发
Claude Code 的自纠正学习引擎——持久化身份、行为模式追踪与跨会话记忆。让 Claude Code 具备"长程学习能力":记住用户的反馈模式、纠错历史和偏好习惯,越用越懂你。TypeScript 实现,适合研究 Agent 长程记忆、行为学习、个性化定制的同学。
stars: 83 | language: TypeScript | created: 2026-05-16 标签:Agent 开发
Agent 开发
OpenClaw 的自主 AI 决策引擎——给 AI 装一个会自己拿主意的大脑。核心定位是"自治决策":不只是被动响应 prompt,而是主动判断下一步该做什么、何时该调用工具、何时该停下来确认。把 Agent 从"工具执行者"升级为"决策者"。Python 实现,适合研究 Agent 自主决策、OpenClaw 生态、决策树建模的同学。
stars: 28 | language: Python | created: 2026-05-16 标签:Agent 开发
Agent 开发
以项目为中心的多 Agent 记忆操作系统——SmartAgentic 把对话和代码决策转化为持续演化的知识图谱。解决团队多 Agent 协作中的核心痛点:上下文丢失、决策矛盾、协作断层。让每个 Agent 都能在长程协作中保持对项目历史和团队共识的"长期记忆"。Python 实现,适合研究 Agent 记忆架构、知识图谱、多 Agent 协作的同学。
stars: 13 | language: Python | created: 2026-05-16 标签:Agent 开发
今天筛选出的新项目,共 12 个
Skill 系统
中文小黑怪诞正文配图生成 Skill,16:9 白底手绘风格,配少量红橙蓝批注,专为 Codex 设计的视觉生成技能包。适合做公众号长文插图、Substack Newsletter 配图。
stars: 4241 | language: - | created: 2026-05-27 标签:Skill 系统
Skill 系统
小红书图文与公众号封面生成 Skill。融合编辑设计与瑞士视觉系统,28 套布局、10 套主题,单文件 HTML 转 PNG 输出。适合内容创作者批量生产社媒素材。
stars: 3458 | language: HTML | created: 2026-05-27 标签:Skill 系统
Skill 系统
为编程 Agent 而生的本地视频生成库。把 HTML、CSS 和数据转成真实 MP4,21 套模板、可插拔渲染引擎、AI 配乐、Apache-2.0 开源,无每帧费用。
stars: 3022 | language: HTML | created: 2026-05-27 标签:Skill 系统
工具链
微软官方出品的 Windows Terminal 智能分叉,原生集成 Agent 能力到命令行。基于 C++ 改造,适合研究终端侧 Agent 集成与 shell-native AI 体验。
stars: 978 | language: C++ | created: 2026-05-18 标签:工具链
Agent 开发
当前最难的搜索基准测试之一,覆盖模糊、多轮、主动搜索三类真实场景,200 个长程任务,采用无 schema 知识图谱三元组 F1 打分。Agent 搜索能力评估必备。
stars: 928 | language: Python | created: 2026-05-20 标签:Agent 开发
Agent 开发
通用 Agent 控制中枢,把 AI Agent 接到 WPS、Office、Zotero、Photoshop 等桌面软件,覆盖 47 个 CLI 命令与 27 个学术技能,附带 SVG 转 PPTX 工具。
stars: 741 | language: Python | created: 2026-05-27 标签:Agent 开发
Skill 系统
Codex 上的幻灯片图片转可编辑 PPT 技能,把图片、PDF、图像型 PPTX 一键还原为可二次编辑的演示文稿,办公自动化神器。
stars: 530 | language: Python | created: 2026-05-21 标签:Skill 系统
工具链
Hermes Agent 的中文桌面客户端,Windows 优先,基于 Tauri + TypeScript + Rust 构建,隔离内嵌 Hermes Agent 核心。国产 Agent 桌面化方向参考。
stars: 405 | language: TypeScript | created: 2026-05-21 标签:工具链
Agent 开发
华为出品的 vLLM 原生 KV-cache 量化后端,Agent 场景下 3-5 倍上下文提升、超越 FP16 吞吐、保持 FP16 级精度,免校准,一行 flag 启用。
stars: 395 | language: Python | created: 2026-05-29 标签:Agent 开发
Agent 开发
用 Agent 学 Agent 的实战课程骨架,聚焦生产级 AI Agent 的设计、构建与运营。涵盖系统架构、提示工程、评测与可观测性,适合进阶学习者。
stars: 374 | language: JavaScript | created: 2026-05-23 标签:Agent 开发
Agent 开发
把分子当代码呈现,让大模型能像操作代码一样推理化学分子,连接 LLM 与化学领域的 Agent 桥接项目,开源化学研究新范式。
stars: 277 | language: Python | created: 2026-05-30 标签:Agent 开发
工具链
本地优先的 AI 助手记忆操作系统,提供 L0-L3 分层记忆、Wiki++ 知识管理、技能路由与 TokenLess 上下文压缩,与 Hermes 记忆体系互为参照。
stars: 260 | language: TypeScript | created: 2026-05-28 标签:工具链
今天筛选出的新项目,共 8 个
标签:MCP 服务器 / 多模型协作
详细描述:一个 MCP 服务器聚合 400+ OpenRouter 模型(Qwen/Kimi/DeepSeek 等),让 Claude Code、Codex、Cursor、Kiro、OpenCode 等 Agent 拿"第二意见"或通过仲裁者达成共识。内置评估机制衡量哪些模型真正"够格",是研究多模型协作与 MCP 服务器设计的实用参考。JavaScript 实现,单 MCP server 即可接入多种 IDE。
stars: 70 | language: JavaScript | created: 2026-05-13
标签:AI JupyterLab / Coding Agent 实战
详细描述:开源的 AI 原生 JupyterLab——被称为"笔记本里的 Cursor"。提供 Cmd+K 行内编辑、Cell 级读写运行的多步 Agent、@cell/@file 上下文聊天、ghost-text 补全、一键 traceback 修复。模型自带(Anthropic/OpenAI/Gemini/Ollama/vLLM),本地优先、隐私优先、完全开源。适合研究 Agent IDE 集成、Cell 级工具调用、本地优先 AI 的同学。
stars: 51 | language: TypeScript | created: 2026-05-13
标签:Prompt 工程 / Awesome List
详细描述:114 份 source-backed 的 /goal 合约模板库 + 200 个独立种子模式,把 coding agent 的目标描述规范化成可直接复用的 Prompt 契约。覆盖 Goal/Context/Constraints/Done when/On block 五段式结构,可作为研究 Prompt 工程、Agent 任务规范化的参考。
stars: 33 | language: Python | created: 2026-05-13
标签:Skill 安全 / Agent 审计
详细描述:Skill 扫描 Agent——自动扫描、识别并评估 SKILL 的安全风险。在 Skill 生态爆炸式增长的今天,这个工具帮你审查第三方 skill 是否可信。Python 实现,适合研究 Agent 安全工程、Skill 系统设计、自动化审计的同学。
stars: 32 | language: Python | created: 2026-05-13
标签:Agent 行为约束 / 跨 CLI 通用
详细描述:通用 AI 行为规则框架——把 5-10 条核心规则"钉住",防止 AI 在长任务中漂移。内置开发场景预设,一行切换任意场景。兼容 Claude/Codex/Cursor/Hermes,零 LLM 调用、零网络、零依赖。轻量级但解决长任务失控这一普遍痛点。
stars: 30 | language: Python | created: 2026-05-13
标签:Agent 记忆 / 跨 CLI 工具
详细描述:Brigade CLI——为 Codex、Claude Code、OpenCode、Hermes、OpenClaw 提供 Agent 记忆、任务交接和本地护栏。解决"长任务上下文丢失"和"多 Agent 协作交接"两个核心痛点,跨多种 CLI 通用。适合研究 Agent 长期记忆、跨 CLI 生态、护栏机制的同学。
stars: 27 | language: Python | created: 2026-05-13
标签:Hermes 生态 / SOUL 治理
详细描述:Hermes Agent 的 SOUL.md 治理框架——结构化记忆、Skill 管理和操作规则的完整方案。给 Hermes 生态用户提供开箱即用的"治理模板",参考价值大于直接使用价值。Python 实现,适合研究 Hermes 生态、Agent 治理模式、SOUL.md 设计的同学。
stars: 13 | language: Python | created: 2026-05-13
标签:Agent 通信 / 本地优先
详细描述:Claude Code、Codex 与其他 MCP Agent 的本地消息总线——一个 SQLite 文件、20 个工具、零守护进程、零云依赖。让多个本地 Agent 之间能直接通信协作,是研究 Agent 通信层和本地优先架构的轻量参考实现。TypeScript 实现,适合研究 Agent 协作协议、消息总线设计、本地优先架构的同学。
stars: 11 | language: TypeScript | created: 2026-05-13
今天筛选出的新项目,共 3 个
标签:MCP / Agent 记忆
详细描述:mori 是一个面向 AI 编程 Agent 的 MCP 共享记忆服务器——让多个 Agent 在协作中持续累积知识,避免每次从零开始。Python 实现,定位是 MCP 生态中"记忆即服务"的轻量中间层。适合研究 Agent 长期记忆、跨会话上下文共享、MCP 服务器设计的同学。
stars: 19 | language: Python | created: 2026-05-12
标签:AWS 官方 / Agent 实战
详细描述:AWS 官方整理的 Agentic AI 实战样例合集——来自韩国 Agentic AI Acceleration 计划,覆盖 Bedrock、AgentCore 及端到端 Agent pipeline 的参考实现与配套工具链。Python 实现,强调 AWS 原生模式(Bedrock 部署、AgentCore 编排),适合研究 AWS Agent 平台、参考架构、云原生 Agent 部署的同学。
stars: 17 | language: Python | created: 2026-05-12
标签:Skill 设计 / Prompt 方法论
详细描述:Agent Skill 设计方法论 Skill——把粗糙目标描述规范化为 /goal prompt,定义 Goal / Context / Constraints / Done when / On block 五段式契约,跨 Codex、Claude Code、Droid、Auggie 等多种 CLI Agent 通用。Shell + Markdown 实现,定位是"prompt 结构化"的即用模板,适合研究 Skill 设计模式、Prompt 工程、Agent 任务规范化的同学。
stars: 9 | language: Shell | created: 2026-05-12
今天筛选出的新项目,共 15 个
标签:代码审查 / 阿里开源
详细描述:阿里巴巴开源的代码审查工具——经阿里生产环境打磨的混合架构 Code Review 平台,确定性流水线与 LLM 智能判断协同,定位是大厂级 Code Review 经验的平价开源版。Go 实现,提供完整 Web 服务,可私有化部署。
stars: 5763 | language: Go | created: 2026-05-18
标签:安全 Harness / Agent 工具链
详细描述:Anthropic 官方开源的安全代码参考 Harness——涵盖威胁建模、扫描、分诊、补丁的完整 Skill 集,并附一个可定制的自动扫描 Agent Harness。Python 实现,适合研究 Agent 安全工程、自动化代码审计、Anthropic 最佳实践的同学。
stars: 5554 | language: Python | created: 2026-05-22
标签:学习路线 / 中文资源
详细描述:Datawhale 出品的 AI Agent 学习路线与资料库——从入门到进阶系统化梳理中文社区最全 Agent 学习资源。HTML 站点呈现,适合所有想系统入门 Agent 开发的同学作为路线图起点。
stars: 3315 | language: HTML | created: 2026-05-17
标签:Coding Agent / CLI
详细描述:月之暗面开源的 Kimi Code CLI——下一代 Agent 编程助手的命令行入口,支持模型驱动的代码生成与编辑流程。TypeScript 实现,适合研究国产 Coding Agent、CLI 工具设计、Agent IDE 集成的同学。
stars: 2164 | language: TypeScript | created: 2026-05-22
标签:Agent 最佳实践 / Skill 设计
详细描述:厂商无关的 Agent Skill 集——覆盖 Codex、Claude Code 与 Agentic Harness 设计的最佳实践指南。聚焦于跨厂商通用的 agent 设计原则、提示工程与 harness 架构。
stars: 1888 | language: - | created: 2026-05-15
标签:桌面 App / 设计 Skill
详细描述:一份让 Agent 设计的跨平台桌面 App 拥有原生手感的 Skill——提炼自 Raycast 2.0 深度拆解与重现实践。适合研究桌面 UI 设计规范、跨平台一致性、AI 设计辅助的同学。
stars: 1775 | language: - | created: 2026-05-14
标签:科学 Agent / DeepMind 官方
详细描述:Google DeepMind 官方科学 Skill 集——用于提升 Agentic 科研工作流的上下文质量与 token 效率。覆盖 grounding、工具调用、实验规划等关键环节。Python 实现,适合研究科学 Agent、DeepMind 工具链的同学。
stars: 1768 | language: Python | created: 2026-05-13
标签:系统设计 / 架构教程
详细描述:架构优先的系统设计资源库——26 套架构教程、25 个架构模板、6 个端到端实战案例,覆盖分布式、AI 原生与自治 Agent 场景。Vue 实现双语教程 + 配套 architecture-copilot skill,可在 Claude Code/Codex 里引导你一步步设计架构。
stars: 1233 | language: Vue | created: 2026-05-23
标签:Agent 记忆 / Hermes 生态
详细描述:Hermes Agent 的 7 层记忆操作系统——基于 Qdrant 向量库的持久记忆、结构化事实、自动召回与 fabric 编织能力,专为 Hermes 生态深度集成。Python 实现,适合研究 Agent 记忆架构、向量存储、长期上下文管理的同学。
stars: 1049 | language: Python | created: 2026-05-31
10. rpamis/comet
标签:Skill Harness / 阶段守卫
详细描述:Agent Skill Harness 阶段守卫式自动化平台——从想法到归档全流程受控执行,把 agent 工作流拆分为带 phase 守卫的子任务避免失控。TypeScript 实现,适合研究 Agent 工作流编排、阶段校验、自动化管线的同学。
stars: 979 | language: TypeScript | created: 2026-05-14
标签:OpenClaw / Skill 合集
详细描述:OpenClaw 官方维护的 Agent 实用 Skill 合集——日常开发高频使用的可复用技能集合,覆盖文档处理、代码生成、工作流编排等典型场景。TypeScript 实现,适合研究 OpenClaw 生态、Skill 系统设计的同学。
stars: 771 | language: TypeScript | created: 2026-05-22
标签:Coding Agent Harness / 大型 codebase
详细描述:面向复杂代码库的 Agent Harness——项目记忆、规划、执行、校验一体,专治大体量 codebase 的 Agent 协作难题。TypeScript 实现,适合研究 Agent 项目记忆机制、复杂代码库自动化、Coding Agent 架构的同学。
stars: 806 | language: TypeScript | created: 2026-05-25
标签:Agent 推理 / Tree-of-Thought
详细描述:Coding Agent Skill:基于 Claude 与 Codex Agent SDK 实现 Tree-of-Thought 剪枝与并行发散,让 Agent 思考更稳更深。TypeScript 实现,适合研究 Agent 推理增强、并行搜索、Tree-of-Thought 落地的同学。
stars: 796 | language: TypeScript | created: 2026-05-25
标签:代码优化 / Codex Skill
详细描述:Codex 安全代码复杂度分析与性能优化报告 Skill——让 Agent 自动扫描代码库生成可执行的复杂度分析与优化建议报告。Python 实现,适合研究代码度量、自动化代码审查、Codex Skill 设计的同学。
stars: 894 | language: Python | created: 2026-05-15
标签:Agent 评测 / SWE 基准
详细描述:面向前沿 Coding Agent 的长周期工程任务评测基准——在原创、长周期的真实软件工程任务上衡量 Agent 的真实水平。Shell 工具集,适合研究 Agent 评测方法论、SWE 基准设计、代码任务自动化的同学。
stars: 724 | language: Shell | created: 2026-05-15
今天筛选出的新项目,共 8 个
1. Kaelio/ktx
标签:Agent 上下文层 / 数据分析
详细描述:面向数据分析 Agent 的可执行上下文层——让 Claude Code、Codex 等任意 AI Agent 都能精准查询企业数据,自动补充业务上下文,避免瞎答数据。核心思路是把上下文当作可执行层而不是静态文档,让 Agent 拿到正确的数据语境。TypeScript 实现,适合研究 Agent 上下文工程、企业数据接入、RAG 增强的同学。
stars: 954 | language: TypeScript | created: 2026-05-10
标签:Coding Agent / TUI
详细描述:开源 TUI 编码 Agent——支持多模型路由、MCP、LSP,内置 Plan/Agent/YOLO 三种模式覆盖从规划到执行的全流程。与 Claude Code、Codex 同台竞技,定位是终端里的全能编码助手。TypeScript 实现,适合研究 TUI 设计、Coding Agent 架构、多模式协作的同学。
stars: 320 | language: TypeScript | created: 2026-05-10
标签:深度研究 Agent / 多智能体编排
详细描述:生产级深度研究 Agent 系统——从零搭建多智能体编排、Red-Blue 对抗降噪、语义级上下文压缩、跨 Agent 共享记忆四大核心能力,配套 165 次独立实验 + Bootstrap 统计显著性检验的完整评测体系。Python 实现,适合研究多智能体编排、Agent 评测方法论、生产级 AI 系统的同学。
stars: 27 | language: Python | created: 2026-05-10
标签:Skill 合集 / 产品全生命周期
详细描述:覆盖产品全生命周期的 122 个 AI Agent 技能合集——从探索发现到增长运营,横跨产品、设计、后端三大领域,可直接复用的技能库。每个技能都是独立模块,可灵活组合。JavaScript 实现,适合研究 Skill 系统设计、产品级 Agent 工具链的同学。
stars: 18 | language: JavaScript | created: 2026-05-10
标签:Agent 记忆 / 卡片盒笔记
详细描述:OpenClaw 插件,把 AI 对话转化为永久的卡片盒知识库——原子笔记、双向链接、知识蒸馏、智能检索,专为 AI Agent 设计的第二大脑。TypeScript 实现,适合研究 Agent 记忆架构、知识管理自动化、Zettelkasten 方法论数字化的同学。
stars: 14 | language: TypeScript | created: 2026-05-10
标签:多 Agent 共识 / 决策工具
详细描述:多 Agent 共识决策 CLI 工具——同时问多个 AI Agent 取多数意见,用于关键设计决策场景,已支持 Kiro、Claude Code、Copilot。核心价值是把模型陪审团思想产品化。JavaScript 实现,适合研究多 Agent 共识机制、AI 辅助决策、CLI 工具设计的同学。
stars: 13 | language: JavaScript | created: 2026-05-10
标签:AI OS / 自进化 Agent
详细描述:语音控制、自进化的 AI 操作系统——能感知屏幕、记住一切、产出生产级代码,每周自我升级,一人即一支团队。代表 Agent 即操作系统的极致愿景。Python 实现,适合研究 Agent OS 架构、自进化机制、语音交互设计的同学。
stars: 6 | language: Python | created: 2026-05-10
标签:Agent Swarm / 群体智能
详细描述:受生物启发的多 Agent 群体智能架构——用于集体 LLM 推理的开源 Swarm 框架,探索群智涌现的设计哲学。把蚁群、蜂群等自然 Swarm 思想映射到 LLM Agent 协作。Python 实现,适合研究 Swarm 智能、群体涌现、多 Agent 协调机制的同学。
stars: 5 | language: Python | created: 2026-05-10
今天筛选出的新项目,共 6 个
标签:流程编排 / 步骤持久化
详细描述:把 AI 任务跑成"可保留、可复用、可迭代的步骤流",而不是一次性对话。Flowtrace 把每次执行拆成有向步骤图,步骤可命名、复用、refine,从单次 prompt 升级为可累积的 Agent 工作流。TypeScript 实现,适合研究 Agent 流程编排、步骤复用机制、可演化 prompt 链路的同学。
stars: 105 | language: TypeScript | created: 2026-05-09
2. dosco/aithy
标签:本地 Agent / 记忆系统
详细描述:可在你本机安全运行的个人 AI Agent,核心是"上下文持久记忆 + 数据不出本地"。记住有用的上下文、调用工具完成任务、整套数据归你控制——是典型的"主权 Agent"实现路径。TypeScript 实现,适合研究本地优先 Agent 架构、记忆工程化、Agent 隐私边界的同学。
stars: 87 | language: TypeScript | created: 2026-05-09
标签:Coding Agent / DeepSeek 驱动
详细描述:VS Code 上的 Copilot 风格 AI 编程代理,但底层是 DeepSeek V4 而非 OpenAI 闭源模型。展示如何在 IDE 内接入国产开源大模型做代码补全与编辑。JavaScript 实现,适合研究 Coding Agent 接入方案、国产 LLM IDE 集成、开源大模型落地编程场景的同学。
stars: 66 | language: JavaScript | created: 2026-05-09
标签:沙箱执行 / Harness Protocol
详细描述:Harness Protocol 的参考实现,让 Claude Code、GAP、LangGraph DeepAgents 等任意 AI Agent 跑在 hermetic 沙箱里。核心价值是把 Agent 隔离 + 协议化执行变成可复制的工程模式,破解"Agent 太危险不敢放"和"各家 Agent 行为不一致"两大难题。JavaScript 实现,适合研究 Agent 沙箱设计、Harness 协议、Agent 互操作性的同学。
stars: 12 | language: JavaScript | created: 2026-05-09
标签:Agent 内核 / 异步 Python
详细描述:受 Pi 启发的异步优先 Python Agent 内核,专门为 Coding Agent、工具调用、连续会话场景设计。提供清晰的核心抽象,把"Agent = 持续会话 + 工具调度"这件事收敛为一个小而美的运行时。Python 实现,适合研究 Agent 运行时内核、异步 Agent 架构、Coding Agent 系统设计的同学。
stars: 8 | language: Python | created: 2026-05-09
标签:技能迭代 / 子代理角色
详细描述:基于证据的 AI Agent Skill 和子代理角色短文迭代 review 循环——教你用数据反馈而非直觉去打磨 Agent 的技能定义和子代理角色 prompt。属于 Agent 工程化中"技能质量"这一被忽视维度的最佳实践,适合研究 Skill 系统设计、Agent Prompt Engineering、子代理角色 brief 迭代方法论的同学。
stars: 7 | language: - | created: 2026-05-09
今天筛选出的新项目,共 5 个
标签:MCP 服务器 / 代码分析
详细描述:本地 Go 静态分析引擎,内置 MCP Server。为 AI 编程 Agent 提供确定性的结构感知能力:调用图、影响分析、符号搜索等。Go 实现,适合研究 MCP 集成、代码结构分析、Agent 工具链设计。
stars: 163 | language: Go | created: 2026-05-08
标签:AI 员工框架 / 循环工作流
详细描述:"半人马环"——构建 AI 员工的最小工作单元框架。把复杂岗位拆解为由 AI 接管、由人类治理、由反馈和记忆持续进化的循环工作流。TypeScript 实现,适合研究 Agent 角色设计、人机协作、循环工作流架构。
stars: 81 | language: TypeScript | created: 2026-05-08
标签:本地大模型 / Agent 部署
详细描述:Cogni-Brain:基于 DGX Spark + vLLM 部署 Nemotron-3-Super-120B,131K 本地上下文窗口,~24 tok/s,硬化 Agent 工具链,可复现的基准测试方法论。适合研究本地大模型部署、Agent 推理性能、长上下文架构。
stars: 6 | language: Python | created: 2026-05-08
标签:Agent 记忆 / 跨会话状态
详细描述:解决 AI Agent 跨会话失忆问题——Backlog 让 Agent 在不同会话之间保留记忆与上下文。HTML 实现,定位简洁。适合研究 Agent 状态持久化、跨会话记忆系统设计。
stars: 4 | language: HTML | created: 2026-05-08
标签:多 Agent 协作 / SDLC 自动化
详细描述:开源自治 SDLC 平台——一个能每日自动提交 PR 的自治产品团队,附带人类审批关卡保证生产质量。TypeScript 实现,展示"多 Agent + 人工 Gate"的标准企业级模式,适合研究 Coding Agent、多 Agent 协作、企业级工作流。
stars: 4 | language: TypeScript | created: 2026-05-08
今天筛选出的新项目,共 9 个
标签:多 Agent 编排 / 工作流引擎
详细描述:多 Agent 编排与工作流引擎,主打声明式 YAML 配置 + 中心辐射型 LLM 协调器 + 竞态安全的消息投递机制。整个系统收敛为一个 Go 二进制即可运行。核心设计是把多 Agent 协作抽象成可声明的工作流,兼顾工程化与可读性,适合学习多 Agent 编排架构、Hub-and-Spoke 模式以及 Go 实现 AI 系统的同学。
stars: 18 | language: Go | created: 2026-05-07
标签:MCP 记忆 / 本地优先
详细描述:本地优先的 MCP 记忆服务器,自动索引 Claude Code、Cowork、Telegram 等聊天记录,让 Cursor、Cline、Continue 等任何兼容 MCP 协议的 AI Agent 都能搜索自己的历史对话。代表了一种新的 Agent 记忆架构方向:把记忆层下沉为独立的 MCP 服务,与具体 Agent 解耦。适合研究 MCP 协议、Agent 记忆系统、跨客户端上下文连续性的同学。
stars: 14 | language: JavaScript | created: 2026-05-07
标签:多 Agent 编排 / 记忆架构
详细描述:多 Agent 编排框架,核心创新在于"个人到组织的循环记忆"设计——把个人 Agent 的经验沉淀回流到组织级记忆库,形成闭环。Apache 2.0 开源协议,Python 3.11+ 实现。适合研究多 Agent 协作、记忆架构设计、经验学习机制的同学。
stars: 8 | language: Python | created: 2026-05-07
标签:Claude Code / 自动化工程
详细描述:面向 Claude Code 的全生命周期 Agent 工具包:定时审计 → 产出就绪态 Issue → Developer Agent 自动开 PR → 多人格顾问评审。内置 6 个具名 PR 评审员、5 个审计扫描器和一键安装器。设计目标是 Claude 专属。代表了一种用 Agent 串联完整工程流水线的思路,适合研究 Claude Code 深度集成、自动化代码审计、多人格评审机制的同学。
stars: 7 | language: - | created: 2026-05-07
标签:Agent Swarm / 仿写学习
详细描述:仿写闭源 Kimi K2 的 Agent Swarm 实现。Swarm 模式强调大量轻量 Agent 的并行协作,与传统单体 Agent 或多 Agent 框架不同。Python 实现,适合想研究 Agent Swarm 架构、群体智能、以及参考闭源大厂设计做逆向学习的同学。
stars: 6 | language: Python | created: 2026-05-07
标签:ReAct 入门 / 极简教学
详细描述:极简、纳米级的 ReAct 模式 AI Agent 库。代码量小到可以一次性读完,是理解 ReAct(Reasoning + Acting)范式最直接的入口。适合 Agent 开发新手用来打底,搞清楚 Agent 如何思考、如何调用工具、如何完成循环。
stars: 5 | language: Python | created: 2026-05-07
标签:Skill 进化 / Agentic 编排
详细描述:面向 Agentic LLM 编排的流驱动递归技能进化框架。核心思路是让 Skill 在工作流执行过程中递归演化——技能不是静态定义,而是随调用不断迭代。与 Hermes Agent 的 skill 系统思路同源,适合研究 Skill 体系、自演化 Agent、递归编排机制的同学。
stars: 4 | language: Python | created: 2026-05-07
标签:轻量框架 / 最小核心
详细描述:轻量级 Agent 框架,主打"最小核心 + 按需扩展"。反对大而全的框架设计,理念是让你从一个清晰的内核出发,只引入你真正需要的模块。适合不想被框架绑架、希望理解 Agent 框架最核心抽象的同学。
stars: 4 | language: Python | created: 2026-05-07
标签:Agent 协作 / 评估基准
详细描述:专门评估多 Agent 协作能力的基准测试框架,特色是"强制角色隔离"机制——在评测中严格区分各 Agent 的角色边界,避免串谋。研究多 Agent 协作评估、Agent 角色设计、协作质量度量必备。
stars: 4 | language: Python | created: 2026-05-07
今天筛选出的新项目,共 3 个
标签:多智能体实战 / 学习项目
详细描述:didilili/deepsearch-agents 是面向系统学习 DeepAgents 的多智能体实战项目。围绕 LangGraph + RAGFlow + Tavily + FastAPI + WebSocket 搭建端到端深度研搜对话系统,前后端全栈代码可直接运行,Docker 一键部署,配套免费教程 ai-agents-from-zero 提供分章节代码分支。适合想从零到工程化落地学习多智能体协作与企业级 AI 应用的同学。
stars: 28 | language: Python | created: 2026-05-06
标签:工作流方法论 / 多 Agent 协作
详细描述:tianji-qingtian/AI-Native 提出了一套 AI-Native 通用开发工作流方法论,提炼 4-Phase 框架,覆盖空项目和已有源码两种典型场景,并整理了反模式速查表。核心思想是"共享契约"——让 Claude Code 等 AI Agent 在统一协议下并行协作。适合正在尝试把 AI 编程助手纳入团队协作流程、研究多 Agent 协同开发的工程师。
stars: 53 | language: - | created: 2026-05-06
3. tya5/reyn
标签:Agent 架构 / 可观测性
详细描述:tya5/reyn 是一个 AI Agent 工作流操作系统,主打"约束、验证、可重放执行"——用确定性换取可预测性,让 Agent 行为可追溯、可回放。核心观点是:在生产场景中,Agent 自主性必须让位于行为可控性,约束和验证比自由度更重要。Python 实现,适合研究 Agent 可靠性、可观测性、状态管理与确定性执行的设计与工程实现。
stars: 6 | language: Python | created: 2026-05-06
今天筛选出的新项目,共 10 个
1. myICOR/myPKA
标签:个人知识库 / 方法论
详细描述:myPKA 是一个基于 ICOR 方法论构建的 AI 个人知识助手——所有内容存放在一个文件夹里,纯 Markdown 格式,与任何大语言模型兼容,数据完全归用户所有。它解决了一个根本问题:个人知识管理不应该被某个 AI 服务锁定,方法论应该独立于工具。Python 实现,适合想搭建本地优先知识库、学习知识结构化方法论的同学。
stars: 209 | language: Python | created: 2026-05-05
标签:游戏化学习 / Agent 实战
详细描述:Jumping-Agent-platform 把 Agent 构建变成一种游戏化体验——通过关卡式玩法引导用户一步步搭建属于自己的 AI 智能体。它的核心理念是"边玩边学",把抽象的 Agent 概念转化为可执行的游戏任务。Python 实现,适合想用轻松方式入门 Agent 开发的初学者,以及寻找教学互动设计灵感的开发者。
stars: 145 | language: Python | created: 2026-05-05
标签:课程 / 学习资源
详细描述:Deep Agents 实战是一套体系化的 Agent 进阶课程网站,配套源码与文档讲解深度 Agent(Deep Agents)的设计模式、实现技巧与生产落地经验。Astro 框架构建的静态站点,内容覆盖 Agent 架构、工具调用、记忆系统、反思机制等关键主题。适合想从入门进阶到深度 Agent 工程的开发者,作为系统化学习路径使用。
stars: 126 | language: Astro | created: 2026-05-05
标签:Agent 记忆 / 经验学习
详细描述:gini-agent 是一个强调"会记忆、会学习"的智能体——长期记忆 + 经验回流机制,让人格化 Agent 不再是无状态对话机器人。核心突破在于把"经验"作为一等公民,让 Agent 在多次交互中持续积累知识并优化行为。TypeScript 实现,适合研究 Agent 记忆系统、经验学习、人格化 Agent 设计的同学。
stars: 76 | language: TypeScript | created: 2026-05-05
标签:多 Agent / 代码审查
详细描述:codebase-argus 是一个面向 PR、CI 与下游 Fork 同步的多 Agent 代码审查框架。它把代码评审拆解为多个 Agent 分工协作的流水线,覆盖 PR 审核、CI 检查、跨仓库同步等典型场景。TypeScript 实现,展示了"多 Agent 协作"在 DevOps 流程中的落地方式,适合做 Code Review Agent、多 Agent 协作平台、CI/CD 智能化的同学。
stars: 57 | language: TypeScript | created: 2026-05-05
标签:Agent 模板 / 实战示例
详细描述:nitro-imessage-agent-template 是 Vercel Labs 出品的生产级 iMessage AI Agent 模板——支持可重试的大模型调用、工具回调与完整可观测性,开箱即可部署到 Vercel。它解决了"通过 iMessage 与 Agent 对话"这一具体场景的工程问题:消息重试、上下文保持、工具失败恢复等。TypeScript 实现,是 Agent 模板化、生产化部署的典型参考。
stars: 47 | language: TypeScript | created: 2026-05-05
标签:Agent 框架 / 任务编排
详细描述:aura-agent 是一个目标驱动的长时任务智能体,专为需要多日持续运行、多面深度探索的复杂项目设计。它把复杂目标自动拆解为子任务,分发给 Pro/Flash 两类 Worker,支持 Docker 隔离的执行环境与基于验收标准的持续验证。Python 实现,集成 Claude Code、Qwen Code、Codex、ds_code、OpenCode 等多种 Worker 后端。适合研究多模型协作、长时任务调度、Agent 编排框架的开发者。
stars: 41 | language: Python | created: 2026-05-05
标签:Coding Agent / 自进化
详细描述:sagent 是一个多 Provider、自进化的编码 LLM CLI,核心理念是"Agent 在运行中自我修改"。基于强类型 Python API 构建,支持异步/解耦工具调用、双向通信的递归子 Agent 派生。这意味着 Agent 可以根据任务需要动态创建子任务、修改自己的代码路径。适合研究 Agent 自我进化、代码生成链路、强类型 Agent 框架的开发者。
stars: 12 | language: Python | created: 2026-05-05
标签:MCP 服务器 / 认知算子
详细描述:ejentum-mcp 是 Ejentum 认知 API 的 MCP 服务器实现,提供 8 个认知算子覆盖 4 类 Harness(推理、编码、反欺骗、记忆),并支持动态与自适应两种运行模式。它把"认知能力"抽象为可调用的算子,让任何 MCP 兼容 Agent 都能通过统一接口使用 Ejentum 的认知服务。JavaScript 实现,是 MCP 服务器开发、认知算子设计的典型案例。
stars: 8 | language: JavaScript | created: 2026-05-05
10. asim266/macvis
标签:本地 Agent / macOS
详细描述:macvis 是一个本地优先的开源 macOS AI 智能体,核心理念是"数据不出本机"。支持 Claude、GPT、Gemini、Ollama 等多模型,通过 MCP 获得完整 Mac 访问权限,自带 Key(BYOK)、无后端依赖、无遥测上传。TypeScript 实现,是 macOS 平台本地 Agent 的完整范例,适合研究本地优先 AI 架构、Mac 系统集成 Agent、隐私优先 AI 工具的同学。
stars: 5 | language: TypeScript | created: 2026-05-05
今天筛选出的新项目,共 8 个
标签:多 Agent 编排 / 跨厂商
详细描述:reevesagents 解决了一个非常现实的问题——多 Agent 协作需要多个 LLM 提供商,但不同厂商各自有订阅套餐和 API Key 管理逻辑。它把 Claude、Codex、Gemini 的会话统一封装成一套多 Agent 编排协议,用户用一个客户端就能调度所有订阅里的模型,零 API Key 成本。TypeScript 实现,展示了 Provider 抽象层设计、多厂商会话管理、统一编排接口的完整方案。适合想学习多 Agent 跨厂商协作、统一 LLM 客户端架构的开发者。
stars: 95 | language: TypeScript | created: 2026-05-04
标签:Agent 框架 / 工作流编排
详细描述:AgentLoom 把多 Agent 协作从代码层提到配置层——YAML 声明式定义 Agent 流水线,强调运行时安全、可观测性、断点续跑这三个常被忽视的生产级特性。设计上参考 CI/CD 的工作流抽象,让 Agent 流水线像 GitHub Actions 一样可声明、可追踪、可恢复。Python 实现,是 Workflow-as-Code 思路在多 Agent 场景的典型落地。适合做 Agent 编排平台设计、声明式工作流、Agent 调试可观测性研究的同学。
stars: 33 | language: Python | created: 2026-05-04
标签:技能系统 / Agent 方法论
详细描述:oh-my-agent-skills 是一套按方法论组织的 Agent 技能合集——不是按"功能"罗列(如 chat、search、code),而是按"方法论"组织(如角色分工、规划、反思、记忆等)。每个 Skill 解决一类 Agent 设计问题,整套包兼容 Hermes 生态。对于正在做 Agent 技能系统的同学,这是一份难得的"技能分类学"参考——它示范了如何让技能库从"工具仓库"升级为"方法论知识库"。
stars: 22 | language: Python | created: 2026-05-04
标签:可观测性 / Tracing 工具
详细描述:smartcomment 是一款轻量级 Python 追踪工具包,核心理念是给已有系统(不只 Agent)记录执行图,把代码真实运行路径可视化出来。在 Agent 开发场景下特别有用——能看到 Agent 每一步内部状态流转,定位死循环、误调用等问题。来自浙大 zjunlp 团队(ZhipuAI 系),Python 包设计简洁,可作为 Agent 可观测性、Tracing 工具链的底层组件。适合 Agent 调试、Evals、Tracing 系统学习的开发者。
stars: 15 | language: Python | created: 2026-05-04
标签:MCP 服务器 / 深度研究
详细描述:gigaxity-deep-research 是一个面向"深度研究"场景的 MCP 服务器——通过 OpenRouter 调用通义 30B 模型,为 Claude Code、Codex、Cursor、Hermes 等所有兼容 MCP 的 Agent 提供带引用来源的网页综合研究能力。设计亮点是"轻量 LLM 跑研究 + 主流 Agent 消费结果"的协作链——把研究能力作为独立服务暴露,Agent 不需要内嵌大模型。Python 实现,是 MCP 服务器开发、Agent 工具调用解耦的典型案例。
stars: 13 | language: Python | created: 2026-05-04
标签:多 Agent 协作 / Claude Code
详细描述:SelfClaude 是 Claude Code 之上的多 Agent 编排层,展示了"Supervisor + Specialist + Human Gate"的标准企业级模式——Supervisor 拆任务,Specialist 执行,Human 把关质量。整套系统跑在本地优先的浏览器 IDE 里,TypeScript 全栈实现,不依赖云服务。对于想用 Claude Code 做"准生产级"多 Agent 系统的同学,这是个非常轻量、容易 fork 和改造的参考实现。
stars: 11 | language: TypeScript | created: 2026-05-04
7. Tz-WIND/ATRI
标签:本地 Agent 架构 / 跨域集成
详细描述:ATRI 是一个跨领域 Agent 集成的范例——把 AI Agent 架构(多模型 Runtime、工具调用、上下文压缩、子 Agent 调度、MCP/Skills)和音乐工作站(Web DAW、MIDI 工程、Rust 实时音频/VST 宿主)融合在一起,让 Agent 能直接读写音乐工程、生成 MIDI、控制播放。本地优先架构,Python + Rust 混合栈。适合研究 Agent 架构设计、跨领域 Agent 集成(音乐+AI)、本地优先 AI 工作站的开发者。
stars: 10 | language: Python | created: 2026-05-04
标签:多 Agent 团队 / Harness 模板
详细描述:agent-teams 是构建在 Ejentum 认知 Harness 之上的多 Agent 团队模板库——内置对抗式代码评审、Eval 三件套、并排评测、n8n 快速接入、Harness 集成模式等开箱即用的团队设计。可作为任何 Agent 运行时的即插即用工件,省去从零设计多 Agent 协作流程的功夫。HTML(很可能是文档/演示站点)形式展示,适合做 Agent 评测、Code Review Agent、Harness 框架学习的同学参考。
stars: 7 | language: HTML | created: 2026-05-04
今天筛选出的新项目,共 4 个
标签:Agent 框架 / 工作流引擎
详细描述:skelm 是一个面向工程化的 Agent 工作流引擎。它的核心价值在于把长时运行、混合代码与模型调用、需要权限隔离这三类典型 Agent 系统需求,整合到一套类型化管道(typed pipeline)抽象里。默认采用拒绝优先权限模型——所有外部调用必须显式声明授权,这与当前主流 Agent 框架的默认全开做法形成鲜明对比,对做企业级 Agent 落地很有借鉴意义。适合做 Agent 架构设计、权限模型、安全沙箱相关的学习者。
stars: 23 | language: TypeScript | created: 2026-05-03
标签:多 Agent 协作 / Claude Code
详细描述:roster 把多 Agent 协作从演示级推到准生产级——它不是几个 prompt 互相调用的小 demo,而是按真实公司职能划分了 GTM、产品、设计、运维四类 Agent 角色,并提供计划管理、项目基座(Agent 共享的工作上下文)以及强化学习回路(让 Agent 累积经验,越用越聪明)。整套架构跑在 Claude Code 之上,TypeScript 实现。适合想深入学习多 Agent 角色分工、Agent 间记忆与上下文共享、强化学习回路设计的开发者。
stars: 12 | language: TypeScript | created: 2026-05-03
标签:最佳实践 / AGENTS.md 模式
详细描述:EstreGenesis 解决了一个非常实际但被忽视的问题:当你同时用 Claude Code、Cursor、Copilot、Gemini CLI 等多个 AI 编程工具时,每个工具都有自己的规则文件,导致规则冲突和重复维护。它的做法是统一以 AGENTS.md 为单一事实源,再由各类工具自动派生自己的规则文件。提供中英韩三语种子模板,覆盖三个核心场景:新项目引导、旧项目迁移、多 Agent 协调。非常适合做 AI 编程工具集成、规范工程实践的开发者参考。
stars: 5 | language: JavaScript | created: 2026-05-03
标签:Agent 设计 / 技能系统
详细描述:Harmes-House 是一套自我进化多 Agent 系统的完整实现,最大的亮点是内置了 116+ 技能库,可以直接拿来研究 Agent 技能系统的设计。两个特色 Agent 值得关注:TrendRadar 负责追踪技术趋势并自动更新技能库;Reviewer 负责对 Agent 输出做质量评审与反馈。这种技能库加趋势雷达加评审反馈的三件套,是当前 Agent 系统走向长期可用性的关键架构。适合研究 Agent 技能管理、自我进化机制、长期记忆的开发者。
stars: 5 | language: HTML | created: 2026-05-03
把技术书籍和文档转成 AI Agent Skill 的工具链。
支持格式:PDF、EPUB、DOCX、HTML、Markdown、纯文本、RTF、MOBI/AZW(通过 Calibre)。输入一本书,输出一个结构化的 Claude Code Skill——自动提取框架、概念、代码示例,生成可随需加载的 agent 上下文。适合把权威技术书变成可复用的 skill,如《设计数据密集型应用》《重构》这类书籍。
安装:npx skills add virgiliojr94/book-to-skill
md/html/docx 多向流水线,四个能力一站式。
- 万物 → md:任意文件(PDF/DOCX/PPTX/XLSX/EPUB/图片/音频/YouTube/网页 URL)转成干净 markdown
- md → 精美 html:4 套反 AI slop 精挑主题,支持本地 HTML 文件直接打开
- html → md:html-to-markdown + trafilatura 高质量反向转换
- md → 出版社级 docx:自动嵌图、加封面、做目录、配页眉页脚
封装 markitdown + Pandoc + html-to-markdown + trafilatura,适合内容创作、博客归档、出版投稿等场景。
安装:npx skills add alchaincyf/huashu-md-html
面向全球初学者、创作者、开发者与团队的 OpenAI Codex 完整实践指南。
覆盖 Codex 全生态:CLI、桌面 App、Web/Cloud、IDE extension、移动端协同、浏览器自动化。内容包括入口地图、学习路线、配置专题(config.toml、MCP、Skills、Subagents、安全审批)、官方资料索引。中文撰写,适合国内用户系统掌握 Codex。
代表仓库(freestylefly 账号还有):openclaw-wechat(OpenClaw 接微信)、mcp-server-weread(微信读书 MCP)、canghe-skills(Skills 合集)。
21 张真实系统的架构图谱 + 系统设计语言无关教程。
核心观点:"机器几秒就能吐出能跑的代码,知道 for vs map、某个 API、某种语法这些曾经的看家本领,一夜之间一文不值。未来的伟大开发者,首先是能做正确架构判断的人,其次才是写代码的人。"
Templates 目前共 25 个模板(16 经典/通用 + 5 AI 原生 + 4 AI 编码/自治 Agent),每个模板末尾附真实开源项目/工程文档链接。涵盖:AI 对话产品(Claude、ChatGPT)、搜索引擎(Google、Elasticsearch)、Claude Code、RAG、向量数据库、AI Gateway、推理服务等。
配套 skill:architecture-copilot——可在 Claude Code / Cursor / Codex 里引导你一步步设计架构的交互式 skill。
给 AI 编程 agent 用的像素风桌面宠物。
tray-first 桌面伴侣应用,在你的桌面上显示像素艺术宠物,实时可视化 agent 工作状态:用了什么工具、跑了什么测试、当前在哪个文件上。连接方式支持 MCP(Claude Code、OpenCode 等)、专用 CLI、Hook/Plugin 扩展。
安装一次,连接后随时看 agent 在干什么,解决"agent 在跑但我不知道它在干啥"的盲区问题。支持多种宠物形象,适合开发时挂在后台。
AI agent 的本地调试器——你的 agent 缺少的那个本地调试工具。
核心功能:
- 实时 trace 可视化:agent 的每个 LLM 调用、tool 调用、推理步骤以零延迟流式输出到浏览器
- MCP 集成:Claude Code 可直接读取 trace,写 evals,修复问题
- 本地运行:所有数据不离开你的机器,隐私优先
工作流:运行 bunx raindrop-workshop 启动 daemon + Vite UI,在你 coding agent 里运行 instrument 命令,即可在浏览器看到实时 trace。
适合:agent 开发调试、eval 编写、失败回归排查。
Provider-neutral 的 Agent Skill:设计、生成 MVP 蓝图、审计、重构和解释 agentic 系统。
覆盖全生命周期:agent loops、tool design、permissions、system prompts、planning、goals、context compaction、 memory、skills、MCP/外部连接器、observability、evals、prompt caching、agent-legible environments、feedback loops、safety。 编码 agent 只是其中一个子域——同样的原则适用于研究、金融、法律、支持、运营、销售、医疗、教育、数据分析、采购和工作流自动化。
模型提议动作,harness 负责验证、授权、执行、记录、总结并返回观察结果。保持循环简单,让运行时严格。然后加载最相关的参考文件,而不是默认加载所有文件。
微软开源的 VS Code 插件——分析你的 AI 编程助手使用情况,任何 harness,一个仪表盘。
读取本地 AI 会话日志,生成可行动的洞察,数据不离开你的机器。
核心能力:
- 检测 45 种不良 AI 使用习惯(anti-patterns)
- 统计 AI 帮你写了多少代码
- 找出反复问的问题 → 转成可复用 Skill
- 项目上下文质量评分(Context Health Score)
- Gamified 技能进阶:Bronze → Silver → Gold → Diamond
100% 本地运行,隐私优先。适用于 GitHub Copilot、Azure AI Foundry、Microsoft Sentinel、Defender XDR 等安全敏感环境。
为 AI coding agent 设计的 HTML 幻灯片模板库——让 agent 只需一句话就能生成一套精美的演示文稿。
每套模板都有完整的设计规范:字体(Cormorant Garamond、Source Serif 4 等)、配色(sage/blush/lemon 或 forest green/dusty pink/warm cream 等)、布局。agent 读取 index.json 理解模板结构,匹配用户需求,clone 并填充内容即成。
支持多种风格:Pentagram 风格(简洁优雅)、Neo-Grid Bold(编辑新粗暴主义)、Editorial 等。适合 AI 生成报告、Demo 展示、季度回顾等场景。
AI Agent 中文学习地图——从零开始的 8 阶段结构化学习路径,三语对照(繁中/简中/English)。
核心构成:学习路线图 + 145+ 资源 curation + 简单 illustrative cases,三支柱帮你从"不知道从哪开始"到"能设计多 agent 系统"。
8 阶段主路径:从 LLM 基础(token 怎么算)到 multi-agent 编排、Computer Use / Browser Use / Code Sandbox。走完这条路线,从 LLM 使用者进阶为 agent 系统构建者——能看懂框架在做什么、能写自己的 MCP server。
Stage 5 和 Stage 8 作为两个共用 hub,Track A/B 两条路径,5 个专业分支。资源覆盖 2024-2026 前沿。
Gist 本身不能 Pin 到 GitHub Profile,只能通过 Star 保存。
步骤:
- 打开 Gist 页面 → 右上角 ⭐ Star 按钮
- 访问你的 GitHub Profile 主页(github.com/你的用户名)
- "Pinned" 部分只支持 Repo,Gist 只能被 Star(不会出现在 Pinned,但可以在你的 Gist 列表中找到)
如果你需要 Pin 列表,考虑方案:
- 创建一个 Public Repo 来放列表(Repo 可以 Pin)
- 或保持 Gist 作为私有备份,列表统一放这个 skill
for repo in \
virgiliojr94/book-to-skill \
alchaincyf/huashu-md-html \
freestylefly/CodexGuide \
study8677/awesome-architecture \
alvinunreal/openpets \
raindrop-ai/workshop \
DenisSergeevitch/agents-best-practices \
microsoft/AI-Engineering-Coach \
zarazhangrui/beautiful-html-templates \
WenyuChiou/awesome-agentic-ai-zh; do
gh api -X PUT "user/starred/$repo" && echo "⭐ $repo"
donehermes-starred.md
AI Agent / 大模型应用开发相关优质 GitHub 仓库收藏
维护者:庞博 | Gist: https://gist.github.com/PangTianHua/55e91e3572e6f122184679bcf0d350e1
⭐ 1,958 | Fork 242 | Python | MIT
将技术书籍(PDF/EPUB/DOCX 等)自动转换成 Claude Code Skill 的工具。
功能:
- 输入技术书 → 输出完整 ~/.claude/skills// 目录
- 生成 SKILL.md(核心心智模型)、chapters/ch01-*.md(按需加载章节)、glossary.md(术语表)、patterns.md(设计模式)、cheatsheet.md(速查表)
- 支持 PDF/EPUB/DOCX/TXT/Markdown/reStructuredText/AsciiDoc/HTML/RTF/MOBI/AZW 等十多种格式
- PDF 提取:技术书用 Docling(保留表格和代码块),文字书用 pdftotext(秒级提取)
- 章节文件按需加载,不占用 Skill token 预算
与 Hermes 相关: 可以把技术书籍转换成 Hermes 可用的 Skill 格式
⭐ 712 | Fork 80 | CSS | MIT
md/html 双向流水线工具,封装 markitdown + Pandoc + html-to-markdown + trafilatura 四种引擎。万物→md、md→精美html、html→md,Claude Code Skill 内置格式检测和引擎选择。
与 Hermes 相关: 将网页/PDF/EPUB 转 Markdown 用于 Hermes,或生成精美 HTML 用于飞书/演示
⭐ 1,044 | Fork 116 | MIT | 🌐 codexguide.ai
面向全球初学者、创作者、开发者和团队的 Codex 实践指南,涵盖基本使用、工作流、Prompt 工程技巧。
与 Hermes 相关: Codex 与 Claude Code、OpenCode 同类,指南中的工程实践可迁移
⭐ 893 | Fork 90 | Vue | MIT
Think like a software architect — 21 张架构图(AI gateway、RAG、agents、inference serving、vector DB 等)+ 语言无关的系统设计教程,每套模板都链接到真实开源原型。中英文双语。
与 Hermes 相关: 构建复杂 AI 应用时的架构参考
⭐ 985 | Fork 34 | TypeScript | MIT | 🌐 openpets.dev
为 AI coding agent 设计的桌面宠物,通过 MCP 连接到 Claude Code,在桌面上显示实时代码状态。像素风格 UI。
与 Hermes 相关: MCP 协议与 Hermes 生态兼容
⭐ 829 | Fork 36 | TypeScript | MIT | 🌐 raindrop.ai/workshop
AI coding agent 的本地调试工具,实时观看每一次 token、工具调用和决策。
功能: 实时追踪、自愈 eval 循环(写 eval → 运行 agent → 发现失败 → 修代码 → 再运行)、本地回放、兼容所有主流框架和 coding agent。
与 Hermes 相关: Hermes 调试能力极弱,Workshop 提供了完整的 eval+trace+self-healing 闭环
⭐ 1,077 | Fork 96 | MIT
Provider-neutral Agent Skill,面向 Codex、Claude Code 和 agentic harness 设计。
核心哲学: "Keep the loop simple and make the runtime rigorous."
8 条运行时规则: Harness 执行而非模型、每个工具调用都有结果、风险决定循环、草稿和提交分离、Context 是构建的而非倾倒的、长时间运行需要预算、Skill 和连接器渐进暴露、重复失败变为 harness 特性。
与 Hermes 相关: Hermes 本质上是 agent harness,这份最佳实践是架构设计的核心参考
⭐ 1,734 | Fork 222 | TypeScript | MIT
Microsoft 出品的 Better agentic engineering 实践指南。AI Agent 工程最佳实践、常见陷阱和解决方案、评估和优化方法。
与 Hermes 相关: 可应用于 Hermes 的生产环境部署和优化
⭐ 2,227 | Fork 210 | HTML | MIT
为 AI coding agent 设计的 HTML 幻灯片模板库,AI agent 自动挑选合适模板并生成精美演示文稿。
与 Hermes 相关: Hermes 配合可生成高质量 HTML 演示,用于飞书/演示场景
⭐ 1,812 | Fork 209 | Python | MIT | 🌐 wenyuchiou.github.io/awesome-agentic-ai-zh
结构化三语(繁中/简中/English)Agentic AI 学习路线图,从 LLM 基础到多智能体系统。8 个阶段 · 145+ 精选项目 · 动手练习。
与 Hermes 相关: 可作为庞博学习 AI Agent 的系统性教材,中文资源对中文开发者更友好
Stars 数据更新时间:2026-05-30