2026 开源 AI 编程 Agent 对比:Hermes、OpenCode、Pi、omp、Kilo Code

2026 开源 AI 编程 Agent 对比:Hermes、OpenCode、Pi、omp、Kilo Code

  • Meta description:对比 2026 年五款热门开源 AI 编程 Agent:Hermes Agent、OpenCode、Pi、omp 和 Kilo Code,分析模型支持、终端与 IDE 能力、本地部署、自动化、Token 使用和适用人群。
  • 标签:AI 编程、AI Agent、开源项目、Hermes Agent、OpenCode、Pi、oh-my-pi、Kilo Code

一、导语

2025 年以来,AI 编程工具智能体逐渐从代码补全和问答,发展到能够读取代码库、修改多个文件、运行测试并根据失败结果继续迭代的 Agent。Claude Code、Codex 等闭源产品推动了这一工作方式,但由于模型、提示词、工具链和价格策略主要由厂商控制,用户对底层实现和服务变更的控制权有限。与此同时,开源社区出现了多种不同路线的实现,项目数量和社区关注度明显上升。

本文比较 Hermes Agent、OpenCode、Pi、omp(oh-my-pi,以下简称 omp)和 Kilo Code 五个项目。它们的定位并不完全相同:Hermes 更接近带记忆和自动化能力的通用 Agent;OpenCode 和 Pi 侧重终端编码;omp 将更多 IDE 能力带入终端;Kilo Code 则覆盖 IDE、CLI 和云端场景。

二、先说结论

以上均为方向性建议,实际选择仍建议用自己的项目做小规模测试。

三、评测方法与数据口径

本文采用的比较口径:

四、五款开源 AI 编程 Agent 对比速览

维度 Hermes Agent OpenCode Pi omp Kilo Code
主要定位 带记忆和自动化能力的通用 Agent 终端、桌面和 IDE 可用的编码 Agent 极简、可扩展的终端 Agent 将 LSP、DAP 和数据科学内核带入终端 覆盖 IDE、CLI 和云端的编码平台
GitHub Stars(2026-08-18) 232,339 198,694 92,894 25,587 26,910
核心代码许可 MIT MIT MIT MIT MIT
主要语言 Python TypeScript TypeScript TypeScript + Rust 核心组件 TypeScript
版本(快照期) 滚动更新(主分支持续提交) v1.18.x 滚动更新 v17.3.x 扩展 v7.4.22
主要形态 CLI + 桌面应用 + 消息网关(Telegram/Discord 等) 终端 TUI + 桌面端 + IDE 扩展 终端 TUI 终端 TUI VS Code / JetBrains 扩展 + CLI + 云端
模型接入 任意模型 75+ 供应商(官方口径),支持本地 Ollama/LM Studio 15+ 供应商、数百模型,支持本地 主流供应商,可分组配置模型角色 500+ 模型(官方口径),多供应商
特色能力 持久记忆、自建技能、40+ 内置工具(官方口径)、定时任务、消息网关 plan/build 双 Agent、MCP、LSP、子 Agent、AGENTS.md 极小默认上下文、树状会话、扩展/技能/主题体系 终端内 LSP、DAP 调试器、Python/Bun 执行内核、子 Agent、/collab 协作 Auto Model 路由、官方网关、浏览器自动化、CI/CD 无人模式

五、逐个拆解

1. Hermes Agent —— 带记忆和自动化能力的通用 Agent

2. OpenCode —— 终端优先、社区基础最广的编码 Agent

3. Pi(pi.dev)—— 极简骨架,一切皆可扩展

4. omp(oh-my-pi)—— 把 IDE 级能力焊进终端的增强版 Pi

5. Kilo Code —— 覆盖 IDE、CLI 和云端的综合编码平台

六、每个 Agent 的最佳模型搭配

先说两个前提:

DeepSeek V4 系列:性价比主力

DeepSeek 官方 API 文档(2026-08 快照)显示 V4 双模型都面向 Agent 场景开放,且国内直连、价格极低:

模型 输入价($ / 1M tokens) 输出价($ / 1M tokens) 上下文窗口 单次最大输出
deepseek-v4-flash $0.14 $0.28 1M 384K
deepseek-v4-pro $1.74 $3.48 1M 384K

OpenCode Go Codeing Plan 支持 deepseek-v4-flash、deepseek-v4-pro,支持支付宝微信支付。

社区普遍把 Flash 定位为"2026 年最佳预算编码模型"(海外测评称其性价比表现超过 Claude Code / Codex 的默认模型),V4 Pro 则被评价为"编码基准对标 GPT-5.5 / Opus 4.7、成本低约 3 倍"。主流用法是默认 V4 Pro 管重活、轻任务切 V4 Flash(deepakness.com 实测采用此组合,日常成本压力很小)。

各 Agent 推荐搭配

Agent 主力模型(推荐) 轻任务/备选 搭配说明
Hermes Agent DeepSeek V4 Pro / Claude Sonnet / GPT-5.x DeepSeek V4 Flash 通吃型 Agent:重模型管规划与创作,Flash 管日常执行与定时任务
OpenCode Claude Sonnet / GPT-5.x(官方 opencode Zen 精选列表) DeepSeek V4 Flash(BYOK 直连) Reddit 实测:V4 Flash 走 OpenCode Go 日均约 $0.3;HN 用户亦称 opencode 配 DeepSeek 配合良好
Pi DeepSeek V4 Pro / Qwen 系(本地) DeepSeek V4 Flash DeepSeek 官方提供专属 Pi 集成页;HN 多人反馈"Pi works very well with deepseek";Pi 省 Token,配 DeepSeek 总成本极低
omp 官方模板默认 Claude Sonnet-4.5(default 角色) smol / commit 用 Haiku omp 官方 modelRoles 按角色分层(default=sonnet-4-5、smol=haiku-4-5、slow=opus-4-6、plan=gpt-5.3-codex、commit=haiku);把 default 换成 V4 Pro、smol 换成 V4 Flash 即为低成本复刻
Kilo Code Claude Sonnet / Gemini(Auto Model 自动路由) DeepSeek V4 Flash(BYOK 或走 Gateway) Auto Model Router 按任务自动选模型;高频低风险任务切 DeepSeek 系可显著降本

本地模型用户:Pi 的 Token 效率对本地模型最友好(社区反馈接 Qwen Coder / Llama 系口碑最佳);其余四者也均支持 Ollama / LM Studio。

七、横向对比:事实与编辑判断分离

维度 Hermes OpenCode Pi omp Kilo
事实:GitHub Stars*(2026-08-18) 232,339 198,694 92,894 25,587 26,910
事实:OpenRouter 用量*(Coding Agents 页快照) ~1.3T tokens 未见于该榜单 ~139B tokens ~70.1B tokens ~266B tokens
事实:内置定时任务/消息网关 有(内置) 无(扩展) 无(子 Agent 编排) 部分(云端)
事实:终端内调试器(DAP) 无(扩展) 有(14 适配器) 无(IDE 内调试)
事实:官方 IDE 原生扩展 需核实 无(扩展生态) 无(终端为主) 有(VS Code/JetBrains 等)
编辑判断:开箱即用度 ★★★★★ ★★★★☆ ★★☆☆☆ ★★☆☆☆ ★★★★★
编辑判断:可定制深度 ★★★★☆ ★★★☆☆ ★★★★★ ★★★★★ ★★★☆☆
编辑判断:本地模型友好度 高(Token 效率最好)

* 两项数据均为动态快照:Stars 会持续变化;OpenRouter 数值与该页面统计窗口、App Attribution、用户直连比例相关,不能直接跨页面或跨时间比较。

八、成本、隐私与本地部署

维度 Hermes OpenCode Pi omp Kilo
BYOK(自带模型密钥) 支持 支持 支持 支持 支持
本地模型(Ollama 等) 支持 支持 支持 支持 支持
官方网关/服务 无统一网关 opencode Zen 等官方服务 无统一网关 默认中继仅用于协作功能 Kilo Gateway(宣称零加价)
云端代码处理 自托管为主,云端功能以官方说明为准 桌面/云端功能需按官方说明核查 主要本地 CLI,会话可导出分享 主要本地 CLI,/collab 通过中继转发(端到端加密) 云端 Agent 功能需单独核查计费与数据政策

五个项目的核心代码均采用 MIT 许可,但开源不等于所有服务免费:云端服务、官方网关、模型调用可能产生费用,实际成本取决于所用模型、供应商和部署方式。

九、选型建议

十、常见问题(FAQ)

开源 AI 编程 Agent 哪个最适合终端用户?

OpenCode、Pi 和 omp 有什么区别?

Hermes Agent 适合纯编码工作吗?

哪些工具支持本地模型?

DeepSeek V4 Flash / V4 Pro 适合搭配哪个 Agent?

Kilo Code 是免费的吗?

GitHub Stars 能代表 AI 编程 Agent 的实际能力吗?

十一、数据限制

本文中的 GitHub Stars 和 OpenRouter 用量均为动态数据快照,不能代表项目长期趋势。OpenRouter 数据受统计窗口、App Attribution、BYOK 直连和用户使用场景影响,不能直接等同于编码能力。

社区评价来自项目官网、GitHub、OpenRouter、Hacker News、Reddit、知乎等公开页面,具有主观性,不能替代统一环境下的基准测试。

此外,五个项目定位不同,Hermes、Pi、omp 与 Kilo Code 并非完全同类产品,请根据自身的终端、IDE、模型、隐私和自动化需求选择。

十二、数据来源(访问日期 2026-08-18)

本文为开源 Agent 资料对比与选型参考,所有星标与用量数据均为撰写当日快照,项目发展迅速,请以各仓库与官方页面实时数据为准。


梯子推荐: 点击进入毒奶推荐的梯子