写代码的 Agent 越来越臃肿,Claude Code 的系统提示词超过一万 Token,光是内置工具就有 20 多个。Pi 走了完全相反的路:只有读文件、写文件、精确编辑、执行命令四个工具,系统提示词不到一千 Token。结果呢?同一个任务同一个模型,它比 Claude Code 快五倍,GitHub 上 70K+ Star,还被 Flask 作者 Armin Ronacher 的公司 Earendil Inc. 收了。这东西到底好在哪,值得看看。
官网:https://pi.dev | 项目地址:https://github.com/earendil-works/pi

先搞懂它是什么
Pi 是一个在终端里跑的极简 AI 编程 Agent,由知名游戏引擎 libGDX 的作者 Mario Zechner 在 2025 年底创建。起因很简单:他觉得 Claude Code 越来越臃肿、越来越不透明,想要一个自己能完全理解的 Agent。于是他从零写了一个,原来的项目名叫 shittycodingagent,后来改名 Pi,2026 年 3 月被 Flask/Jinja2 作者 Armin Ronacher 的公司 Earendil Inc. 收购,MIT 协议保持不变。
它的设计哲学跟市面上所有同类产品反着来。Claude Code 和 Codex CLI 往死里堆功能:子 Agent、计划模式、MCP 协议、背景任务,内置工具动辄二三十个。Pi 的做法是:核心极简,你要什么自己装。只有七个工具(read/write/edit/bash/grep/find/ls),系统提示词不到 1000 Token。不是做不了更多功能,而是不做,你可以通过 TypeScript 扩展自己加。
打个比方:Claude Code 像精装修房,拎包入住但格局改不了;Pi 像毛坯房,脚手架给你搭好,墙怎么砌、门往哪开全听你的。这种思路在早期 Linux 和 Vim 社区里是常识,但在 2026 年的 AI Agent 赛道里反而是个异类。
核心功能实测
定位搞明白了,接下来看看这个毛坯房里面到底有什么硬货。
Pi 的核心能力可以分成六个维度来理解,每一个都跟竞品的选择不同。
不到 1000 Token 的系统提示词。这是 Pi 最大的卖点,也是最根本的设计决策。Claude Code 的提示词超过一万 Token,意味着你每次发消息,光是把 Claude Code 自己的规则灌进上下文就要消耗大概一万 Token。Pi 只用不到一千 Token 来描述自己的行为规则。省下来的上下文窗口,全留给你和代码。
15+ LLM 提供商,会话中随意切换。Anthropic、OpenAI、Google、Mistral、Groq、Ollama,连 Kimi For Coding 和 MiniMax 都在列表里。按 Ctrl+P 就能在收藏的模型之间轮换,按 Ctrl+L 直接输入模型名切换。你可以在复杂重构时上 Claude Opus,批量改文件时切到 GPT,敏感代码用本地 Ollama 跑。不绑死单一供应商。
树状会话分支。Pi 的会话不是线性的,是一个 JSONL 文件里的一棵树。你可以随时用 /tree 回到之前的任意节点,从那里 fork 一条新分支继续试。就像 Git 的分支,但给对话用的。失败了随时回到分叉点,不用担心搞乱上下文。还可以用 /share 导出到 GitHub Gist,生成一个可分享的网页链接。

TypeScript 扩展:你想要什么自己写。这是 Pi 跟竞品拉开差距的地方。别的 Agent 内置子 Agent,Pi 没有,但官方提供了 55+ 个扩展示例,包括子 Agent 生成、权限门禁、SSH 远程执行、沙箱隔离,甚至能在终端里跑 Doom。扩展可以注册自定义工具、键盘快捷键、UI 组件,甚至能在每次对话前注入上下文。本质上,你可以在 Pi 里复刻任何一个竞品的核心功能。
四种运行模式。交互式(TUI)、Print/JSON(脚本批处理)、RPC(stdin/stdout 协议,非 Node 集成)、SDK(嵌入你的应用)。OpenClaw 这个项目就是用 Pi 的 SDK 做的,https://github.com/OpenClaw/OpenClaw 可以看真实案例。
Pi Packages 生态。扩展、Skills、Prompt 模板、主题这四样可以打包成一个 Package,通过 npm 或 git 直接安装:pi install npm:@foo/pi-tools。别人沉淀好的工作流,拿来即用。
从下载到产出
功能看起来挺硬核,但工具这东西,上手体验不行一切都白搭。
安装就一行命令:npm install -g --ignore-scripts @earendil-works/pi-coding-agent,或者用官网的一键脚本 curl -fsSL https://pi.dev/install.sh | sh。装完在项目目录里敲 pi,就进终端界面了。第一次启动会提示你登录 Anthropic 或其他提供商,或者设置 API Key。我用的是 Anthropic API Key,设了环境变量 ANTHROPIC_API_KEY 直接就能跑。
第一次交互的感受是:快得离谱。输入给这个项目写一个 README,它几乎秒读项目结构,然后开始生成。跟 Claude Code 那种先规划、再确认、再执行的节奏完全不同,Pi 上来就干。工具调用的过程全部暴露在终端里,你能看到它读了哪个文件、写了什么内容、执行了什么命令,没有黑箱。
但这也意味着你需要看着。没有权限确认弹窗,它直接执行。官网原话是 YOLO 模式。如果你在根目录让它 rm -rf,它真会跑。建议在 Docker 容器或 VM 里跑 Pi,或者至少指定一个受限的工作目录。
中途想纠正它的方向?直接用 Enter 发送一条引导消息,会等当前工具执行完就反应过来。Alt+Enter 则是一条追加消息,等 Agent 完全停下来才处理。这个设计很贴心。

高手都在用的功能
装好能用只是第一步,Pi 真正拉开差距的是下面这些隐藏操作。
很多人不知道还有这些进阶用法:
-
Ctrl+P 模型轮换:把常用的几个模型设为收藏,遇到 Anthropic 限流时一键切到 GPT,不需要退出会话。我常用的组合是 Claude Opus 处理复杂重构、GPT 处理批量编辑、本地 Ollama 跑敏感代码。 -
AGENTS.md 项目级规则:在 ~/.pi/agent/或项目根目录放一个 AGENTS.md 文件,写清楚你的编码规范、测试要求、命名约定,Pi 每次启动自动加载。跟 Claude Code 的 CLAUDE.md 一个思路,但更轻量。 -
/fork 会话克隆:不确定某个方案行不行?用 /fork 从当前节点复制一份新会话,在新分支上试,失败了直接回原来的继续。对于大型重构,这个功能能省掉至少一半的试错时间。 -
Prompt 模板复用:把高频提示词存成 Markdown 文件,使用时直接 /模板名展开。比如建一个/review模板专门做代码审查,不用每次都手打相同的指令。 -
自定义 Compaction 策略:默认的上下文压缩是自动摘要,但你可以写一个扩展实现主题压缩或代码感知摘要,在长会话中保留更多有效信息。
看看对手什么水平
光说它好不行,终端 Agent 这条赛道现在挤得要命。Claude Code、Codex CLI、Aider、OpenCode 各有各的杀手锏,Pi 凭什么站稳脚跟?
| 维度 | Pi | Claude Code | Codex CLI | Aider |
|---|---|---|---|---|
| 开源协议 | MIT ✅ | 闭源 | Apache 2.0 ✅ | Apache 2.0 ✅ |
| 系统提示词 | <1000 Token | ~10000+ Token | 中等 | 中等 |
| 模型支持 | 15+ 任意切换 | 仅 Claude | 仅 OpenAI | 100+ via LiteLLM |
| 核心工具数 | 7 个 | 20+ 个 | 15+ 个 | 编辑+执行 |
| 子 Agent | ❌(扩展实现) | ✅ 内置 | ✅ 内置 | ❌ |
| 权限控制 | YOLO 模式 | 多级权限 | 可配置 | Git 提交兜底 |
| 扩展系统 | TypeScript 四层 | Hooks/Plugins | MCP | 配置文件 |
| GitHub Stars | ~70K | 121K(文档) | 101K | 45K |
| 价格 | 免费(BYOK) | $20-200/月 | 捆绑 ChatGPT | 免费(BYOK) |
| 最适合 | 定制工作流 | 全自动执行 | OpenAI 用户 | Git 原生开发 |

核心差异不在功能数量,在设计理念。Claude Code 追求你离开电脑,Agent 替你完成,所以内置了子 Agent、计划模式、权限系统这些完整的基础设施。Pi 追求你掌控一切,Agent 帮你执行,所以什么都不内置,但给了你一套完备的扩展机制。你要子 Agent?写个扩展或者装个包。要计划模式?现有示例直接拿过来改。
从终端性能看,Pi 基于 TypeScript/Bun,内存约 110MB。Codex CLI 用 Rust 写,内存更低(约 30MB),但模型锁死在 OpenAI。Aider 胜在 Git 原生和模型兼容性最广,但本质是 pair programming 工具。OpenCode 有 165K+ Star 和 75+ 提供商,但框架较重(500MB)。
用户口碑如何
去社区逛了一圈,用户评价确实挺两极的。
Reddit 和 Hacker News 上关于 Pi 的讨论很两极。喜欢 Pi 的人理由出奇一致:Token 消耗干净,上下文窗口终于不浪费在系统提示词上了同一个任务 Pi 经常比 Claude Code 快五倍我终于知道我的 Agent 在干什么了。有用户说从 Claude Code 切到 Pi 之后,编码效率显著提升,因为不需要等 Agent 在复杂的权限确认和反思循环里打转。
吐槽的点也很集中。最常被提到的是毛坯房:没有子 Agent,没有计划模式,所有高级功能都要自己搭。有人花了整整一个周末才把 Pi 配置成接近 Claude Code 的体验。另一个高频槽点是 YOLO 模式:权限控制太弱,不小心就出事故,必须配合 Docker 或 VM 沙箱使用。部分用户还觉得 TUI 界面不够好看,操作流畅度不如 Claude Code 的 Ink 渲染。
Terminal-Bench 2.0 上的跑分也很有意思:用 Claude Opus 4.6 的 Pi 排名第 7,击败了 OpenHands、SWE-Agent,排在重度优化的 Codex CLI 和商业产品 Warp 之后。考虑到不到 1000 Token 的系统提示词,这个成绩的含金量不低。
逐项打分
口碑有好有坏,拆成六个维度来打分,每一项都有真实依据。
| 维度 | 评分 | 一句话解读 |
|---|---|---|
| 功能完整性 | ⭐⭐⭐☆☆ | 核心够用但高级功能全靠扩展自己搭 |
| 易用性 | ⭐⭐⭐☆☆ | 终端老手如鱼得水,新手学习曲线陡峭 |
| 性价比 | ⭐⭐⭐⭐⭐ | 免费 MIT 协议,只付模型 API 费用 |
| 创新性 | ⭐⭐⭐⭐⭐ | 极简+可扩展的架构在赛道里独树一帜 |
| 稳定性 | ⭐⭐⭐⭐☆ | 社区活跃更新频繁,v0.80+ 已趋于稳定 |
| 推荐度 | ⭐⭐⭐⭐☆ | 资深终端用户强烈推荐,新手建议先试 Claude Code |
综合评分:7.8 / 10
长处与短板
优势
-
极低 Token 消耗:不到 1000 Token 的系统提示词,上下文窗口几乎全留给代码和对话,长会话中优势显著 -
完全透明可观测:每个工具调用、每次文件读写都实时展示,没有黑箱,没有隐藏的决策过程 -
MIT 开源免费:没有任何付费墙,只付模型 API 费用。对用量大的团队来说比按月订阅省得多 -
模型灵活切换:15+ 提供商,随时在中途切换,不会被单一供应商的价格调整或策略变更锁死 -
真正的可扩展性:55+ 个官方扩展示例,四层扩展体系(Extensions/Skills/Prompts/Themes),想加什么功能都能自己写
不足
-
YOLO 权限模式:没有权限确认,直接执行命令。不配合沙箱使用有安全风险,新手容易翻车 -
高级功能靠自己搭:子 Agent、计划模式、MCP 等竞品标配的功能,Pi 需要自己写扩展或装包实现 -
TUI 界面不够精致:自研渲染引擎,没有 Claude Code 的 Ink 渲染那么流畅,视觉体验偏朴素 -
学习曲线偏高:不像 Cursor 或 Windsurf 那样开箱即用,需要一定的终端和命令行基础
帮你判断值不值得
东西是好是坏掰扯清楚了,但工具挑人,看看你属不属于它的菜。
-
资深终端用户(Vim/Emacs 使用者):Pi 的操作逻辑和 Unix 哲学一脉相承,你会觉得终于有一个 Agent 不试图教你怎么工作了。Ctrl+P 切模型、/tree 分分支,跟 Vim 的快捷键思维无缝衔接 -
需要多模型灵活使用的开发者:Anthropic 限流时切到 OpenAI,敏感项目用本地 Ollama,复杂任务上 Claude Opus。一个工具搞定所有场景,不用装三四个 Agent 来回切换 -
想把 Agent 嵌入自己系统的团队:RPC 模式和 SDK 是 Pi 独有的能力。如果你在搭建 CI/CD Agent 流水线,或者想在现有工具里嵌入 Agent 能力,Pi 是目前最干净的选择 -
对 Agent 透明度和可控性有执念的人:受不了 Claude Code 隐藏思考过程?不想让 Agent 替你做决策?Pi 让你看到一切,控制一切 -
不太适合:追求开箱即用体验的新手:如果你习惯了 Cursor 的图形界面、inline 补全和可视化 diff,Pi 的终端优先体验会让你很难受。建议先从 Claude Code 或用 Cursor 入门,等你对 Agent 行为有更深理解后再转 Pi
算笔账
免费开源是不是意味着零成本?这里帮你把账算清楚。
| 费用项 | Pi | Claude Code | Codex CLI |
|---|---|---|---|
| 工具本身 | $0(MIT) | $0(闭源客户端) | $0(Apache 2.0) |
| 模型费用 | 自付 API(BYOK) | Pro $20/月 起 | 捆绑 ChatGPT 套餐 |
| 月均 API 成本(估算) | $10-50 | 含在订阅内 | 含在订阅内 |
| 隐藏成本 | 自行管理 Key | 无 | 无 |
| 自由度 | 任何模型 | 仅 Claude | 仅 OpenAI |
(截至 2026 年 7 月官网显示)
Pi 的成本模式很简单但门槛不低:工具不要钱,但你得自己搞定模型 API Key。如果你已经在用 Anthropic API 或 OpenAI API,等于零额外成本。如果你习惯了 Claude Code 的 $20/月一口价,Pi 需要你直接跟模型提供商结算,月度账单波动可能更大。
对用量不高的个人开发者,BYOK 模式通常比订阅便宜,月均 $10-30 的 API 费用就够了。重度用户可能跟订阅价差不多,但你获得了随时换模型的自由。本地模型用户直接零成本。
你可能还想问
看完上面这些,你可能还有几个纠结的点。
Q1:Pi 是完全免费的吗?
A1:是的,MIT 协议完全免费开源。 你不需要为 Pi 本身付任何费用。你只需要自己搞定 LLM 提供商的 API Key(如 Anthropic、OpenAI),费用直接付给模型提供商。如果你用本地模型(Ollama),零成本。
Q2:Pi 和 Claude Code 到底选哪个?
A2:取决于你更想要控制感还是便利性。 Claude Code 是帮你写代码的智能体,内置子 Agent、计划模式、多级权限,适合想离开电脑让它自己跑的场景。Pi 是帮你执行命令的终端,极简透明,适合想要完全掌控 Agent 行为的场景。
Q3:Pi 适合编程新手吗?
A3:不太适合。 Pi 面向有终端使用经验的开发者。需要命令行操作、API Key 配置、理解 Agent 行为逻辑。如果你是新手,建议从 Cursor 或 Windsurf 这类 GUI 工具入门,等熟悉了 Agent 编程再尝试 Pi。
Q4:Pi 支持中文吗?
A4:部分支持,取决于你用的模型。 工具本身的 TUI 界面是英文的,但通过支持中文的模型(如 Claude、GPT、DeepSeek、Qwen),你可以用中文与 Agent 对话,生成中文代码注释和文档。
Q5:Pi 能自己改自己的代码吗?
A5:能,这是 Pi 的核心卖点。 Pi 可以读写自己的 TypeScript 源码、修改扩展、然后 /reload 热加载。你甚至可以让 Pi 帮你写一个新的扩展来增强自身能力。
Q6:Pi 有安全保障吗?
A6:YOLO 模式意味着没有内置权限确认。 安全策略需要你自己搞定:在 Docker 容器或 VM 里跑 Pi、用扩展实现路径保护(官方有 protected-paths.ts 示例)、限制工作目录范围。建议生产环境中配合 Gondolin micro-VM 使用。
Q7:Pi 能在 Windows 上用吗?
A7:可以,官方支持 Windows。 安装命令 powershell -c "irm https://pi.dev/install.ps1 | iex" 或 npm 全局安装,Windows Terminal 和 WSL 都兼容。偶有路径编码问题,社区持续修复中。
Q8:跟 Cursor 比呢?
A8:不同品类。 Cursor 是 VS Code fork 的完整 IDE,有 GUI、inline 补全、可视化 diff。Pi 是纯终端 Agent,没有编辑器界面。你可以同时用:在 Cursor 里写代码时用 Pi 跑大型重构和批量任务,两者互补。
Q9:如何分享我的 Pi 配置?
A9:打包成 Pi Package 发布到 npm 或 git。 把你的扩展、Skills、提示词模板、主题打包,用 pi install npm:@yourname/pi-config 分享给其他人。别人一行命令就能复刻你的工作流。
Q10:Pi 未来会被收费吗?
A10:根据官方 RFC 0015,核心保持 MIT 协议。 Earendil Inc. 采用了开源核心模式:Pi 核心永久 MIT,但可能会推出付费的云服务层(Lefos 平台)。目前的 CLI 工具不受影响。
值不值得买
Pi 不是完美的。它没有计划模式、没有子 Agent、没有权限控制,在功能数量上比 Claude Code 和 Codex CLI 少一大截。但它有一样其他 Agent 都没有的东西:彻底的透明和完全的掌控权。
对于在终端里度过职业生涯大部分时间的开发者,这是久违的自由。一个不会替你做决定的 Agent,一个你能逐行看清它每一步操作的工具,一个可以随时拆开重组的工程框架。这才是一年揽下 70K Star 的根本原因。
从来没碰过命令行的新手,Pi 大概率让你摔得很惨。但如果你已经受够了 Agent 替你改不该改的文件、执行不该执行的命令,在 Docker 里跑起来试一次。记住 Esc 是刹车,然后放手让它干活。不行也不亏,免费的。
