Pi Agent 怎么用?同模型 Token 实测 51% 的极简 Harness 实操
换更简单的 Harness,能把 Token 砍掉一半。Pi Agent 是这条线上的典型代表。
- 同模型实测:Pi 平均 2.82M token,是 Claude Code 5.52M 的 51%。
- 耗时:Pi 8.75 分钟 vs Claude Code 11 分钟,差距有限。
- 极简默认:4 工具(read/write/edit/bash),系统提示词 < 1000 token。
- 双层扩展:Skill 是说明书;Extension 改写 Agent 自身运行方式。
- 自改造:Pi 自己读扩展文档、自己写代码改 Extension。
- Sub-agent:靠 Extension 实现,按角色配不同厂商模型和思考强度。
- SDK 嵌入:把 Pi 核心能力移出终端,作为应用里的 Agent 引擎。
开箱即用选 Claude Code / Codex;想改造 Agent 或嵌进自己的应用,选 Pi。
同模型 Token 实测:Pi 是 Claude Code 的 51%
把 Pi 和 Claude Code 摆在同一个 REMOTION 视频制作任务前,用相同模型、相同思考强度跑下来:
| 维度 | Pi | Claude Code | Pi / Claude Code |
|---|---|---|---|
| 平均 token 消耗(含缓存) | 2.82M | 5.52M | 51% |
| 平均耗时 | 8.75 min | 11 min | ~80% |
| 视频效果 | 极少元素堆叠 | 偶尔堆叠 | Pi 更稳 |
测试样本有限,不能外推到所有任务。但它指向一个被忽视的事实:每次模型调用都会把系统提示词、工具定义、项目规则、历史消息、过往工具结果一起打包送进去。这些内容越多,多轮执行里反复进入上下文的 token 就越多,无关上下文拉长也会拖累模型的注意力。换 Harness 不只是换 UI,是换上下文组装方式。
极简默认:4 工具 + 不到 1000 Token 的系统提示词
Pi 默认只暴露 4 个基础工具:
read:读文件write:写文件edit:编辑文件bash:执行终端命令
系统提示词不到 1000 token,同类工具普遍是它的十倍以上。它的核心理念可以概括成一句话:让 Pi 适应你的工作方式,而不是让你去适应它。
取舍很直白:极简意味着开箱即用的体验少了,需要用户自己加 Skill、加 Extension 来补全;但同时 token 开销、上下文干扰、模型 注意力损耗也降下来了。
双层扩展:Skill 是说明书,Extension 改写 Agent 自身
Pi 的扩展机制分两层,职责完全不同:
Skill —— 按需加载的专业说明书。比如一个 REMOTION 视频制作 Skill,会告诉 Agent 怎么分析脚本、怎么设计分镜、怎么生成视频、怎么在最后验证结果。Agent 遇到视频制作任务时才加载这一段方法模板,平时不占上下文。
Extension —— 改写 Agent 自身的运行方式。它通过代码接入 Pi 的运行过程,改变输入接收、工具调用、状态显示、结果输出这些环节。可以:
- 增删工具
- 接入外部服务
- 修改终端界面
- 给危险命令加权限确认
- 增加新的交互方式(语音、GUI、IM 通道等)
简单概括:Skill 告诉 Agent 怎么完成专业任务;Extension 改的是 Agent 自己。
自改造:Pi 自己读文档,自己改 Extension
Extension 最反常识的一点是:不用亲手写代码。
告诉 Pi 想增加什么功能(比如"加一个中文语音交互,我说完话 Pi 自动听、写、念出结果"),Pi 会自己读自己的扩展文档,自己创建或修改 Extension,改完重新加载,立刻可以测试。
这意味着 Agent 可以参与构建和改造 Agent 本身。这件事听起来玄,但实际跑下来的工作流很朴素:
- 用自然语言描述想要的能力
- Pi 阅读扩展文档,按规范生成或修改 Extension 代码
- 重载 Extension,立刻验证效果
- 不满意继续描述,Pi 继续改
整个循环不需要离开终端,也不要求你会写代码。
Sub-agent:靠 Extension 实现的跨厂商配置
Pi 默认没有 sub-agent 机制,但可以通过自己实现或安装第三方扩展包来补上。补完之后能做一件 Claude Code / Codex 默认不太方便做的事:给不同角色配不同厂商、不同思考强度的模型。
典型配置:
- 设计角色:用推理能力强的模型,思考强度调高
- 执行角色:用速度快、成本低的模型,思考强度调低
- 审核角色:用擅长代码审查的模型
简单任务走便宜模型、复杂任务走强模型,长期下来成本和效果的天花板都能往上抬一截。
SDK:把 Pi 移出终端,嵌进自己的应用
Pi 的核心能力不绑定终端形态,可以作为 SDK 嵌入到自己的应用里——小工具、桌面应用、自动化流程都行。一个极简的内核能继续组合出:
- 消息渠道(IM / 邮件 / Webhook)
- 定时任务
- 长期运行的 Worker
- 多 Agent 协作
因为 Pi 核心实现的系统提示词、工具定义、执行流程全部可查,集成时可以明确限制 Agent 能做什么、能访问哪些路径、能调哪些外部服务——这比黑盒 Agent 集成起来安全得多。
实操路径很简单:Vibe Coding 起一个工具或应用,把 Pi 作为 Agent 引擎挂进去即可。
安装与安全
Pi 默认不包含任何权限确认机制——删文件、执行高危命令、访问敏感路径都不会拦截。初次使用前必须先装一套权限保护扩展,把边界画清楚。
安装流程:
- 打开 Pi 官网,复制对应环境的安装命令到终端执行
- 启动后输入
/login,选订阅认证或 API Key 方式接入模型(API 方式支持 DeepSeek 等多种 Provider) /model选模型,Shift + Tab调思考强度- 装第三方扩展:官网 package 页找到想要的扩展,复制命令到终端执行
权限保护扩展可以从官网 package 页直接安装,找其他人开发好的就行,不需要自己写。
何时选 Pi,何时回 Claude Code / Codex
| 场景 | 推荐 |
|---|---|
| 完整、稳定、开箱即用 | Claude Code / Codex |
| 想理解 Agent 内部怎么跑 | Pi(开源 + 精简 + 可观察) |
| 需要个性化定制、改造 Agent 自身 | Pi |
| 嵌入到自己的应用 / 自动化流程 | Pi(SDK 可控 + 可审计) |
| 默认安全机制、权限边界 | Claude Code / Codex(内置更厚) |
Pi 把更多控制权交给用户,同时把更多配置、调试、安全管理工作也交给了用户。选型不是"哪个更好",是"哪个更匹配这个阶段的需求"。
References
- Pi Agent 官网 —— 截至 2026-07 GitHub Star 7 万+
- 有了 Claude Code 和 Codex,Pi Agent 为什么依然值得关注? —— YangAgent, Bilibili