OpenClaw 引爆代理浪潮、Kimi K2.5 子代理组队、Mistral 蒸馏小模型
本期要点:OpenClaw 代理 GitHub stars 史上最快、Kimi K2.5 用子代理提速 3-4.5 倍、Wikipedia 与 AI 公司签数据付费协议、Ministral 3 通过剪枝 + 蒸馏实现小而强。
编者按:AI 时代的就业现状
作者:Andrew Ng

Ng 分享当前招聘市场观察:
AI 替代工作的真实情况
- 很多科技公司过去一年裁员,CEO 们常把原因归于 AI——但 AI 还没那么好用,多数裁员其实是疫情期过度招聘的纠正
- 高暴露职业(呼叫中心、翻译、配音演员)人员找工作会更难,薪资可能下降
- 但整体就业损失被过度炒作
新规律:AI 不会取代工人,但会用 AI 的工人会取代不会用的
招聘模式转变
- 解雇不适应 AI 的员工,换成能用 AI 的人——这种趋势在软件开发已明显
- 早期迹象出现在传统非技术岗(营销、招聘、分析师) ——懂用 AI 编码的生产力更高
- 新组建的 AI 原生团队比替代的团队规模更小
Ng 观察:项目瓶颈从"能建什么"转向"决定建什么"——产品管理瓶颈。过去 8 工程师 + 1 PM 的项目,现在 2 工程师 + 1 PM,甚至 1 个混合工程师 + PM 技能的人。
好消息:多数企业有很多事做但人不够,有 AI 技能的人常被给机会承担更多、攻克积压已久的想法。
OpenClaw 引爆代理浪潮
开源 AI 代理 OpenClaw(前名 WhatsApp Relay、Clawdbot、Moltbot)突然爆红,激发对代理未来的兴奋、担忧、炒作。
爆红数据
- 11 月开发者 Peter Steinberger 发布 OpenClaw(个人 AI 代理,管理日历、邮件摘要、提醒)
- 1 月底 HackerNews 一帖带火,GitHub stars 史上最快增长,Google 搜索量超过 Claude Code
- 几天内200 万访客、数百万安装——Mac Mini 售罄(爱好者想要专机 24/7 跑代理)
- 用户指示代理整理日程、监控 vibe-coding 会话、发布到个人网站和 newsletter
- 一用户的代理自主注册电话 号码、连接语音 API、早晨打电话问"今天怎么样?"
- Matt Schlicht 推出 Moltbook(Reddit 式社交网络,OpenClaw 代理读写组织)——100 万代理注册,充斥宣言、生活故事、垃圾
- 代理活动导致成本超支、私密凭据暴露、安全漏洞
OpenClaw 架构
- 中心网关服务器 + 多个客户端(聊天、浏览器会话、云服务等)
- 启动时生成动态系统提示,用 Markdown 文件跨会话保持记忆
- 默认记忆文件:USER.md(用户信息)、IDENTITY.md(代理信息)、SOUL.md(行为规则)、TOOLS.md(可用工具)、HEARTBEAT.md(连接应用指令)
- 默认模型 Anthropic Claude Opus 或 Meta Llama 3.3 70B;支持 Google、OpenAI、Moonshot、Z.ai、MiniMax 等
- 通过 Telegram、WhatsApp、Slack、iMessage、Google Chat 等聊天
- 安装包含几十个技能,可通过 ClawHub 安装更多
OpenClaw 激发了远超其份额的炒作。媒体报道把 Moltbook(与 GPT-3 后大语言模型输出差别不大的消息)比作 AGI 和奇点的到来。代理还 没到那儿,也远没到。OpenClaw 展示了代理能极其有用,我们还在寻找好用例,且要密切关注安全。
Kimi K2.5:管理自己的子代理大军
Moonshot AI 发布 Kimi K2.5——Kimi K2 的升级版,加入视觉能力和生成"子代理"(并行工作流,控制自己的独立模型执行 AI 研究、事实核查、网页开发等任务)。
核心规格
- 架构:MoonViT 视觉编码器(400M 参数)+ MoE Transformer(1 万亿参数,每 token 32B 激活)
- 上下文:输入 256K token;输出 109.5 tokens/秒
- API 价格:$0.60/$0.10/$3.00 每百万输入/缓存/输出 token
- 许可证:修改版 MIT,商用 + 署名
关键创新
- 基于 Kimi K2-Base(文本模型,7 月发布)加视觉编码器,在 15 万亿图像/文本 token 上进一步预训练
- 用 RL 训练 Kimi K2.5 生成子代理、并行运行、分配任务、整合输出
- 例子:被要求找 YouTube 100 个领域的 top 3 频道,Kimi K2.5生成 100 个领域专属子代理搜索 YouTube,结果填入电子表格
性能表现
| 维度 | Kimi K2.5 | 备注 |
|---|---|---|
| Artificial Analysis Intelligence Index | 所有开源权重模型第 1 | thinking 模式下 |
| 图像/视频基准(17 项) | 9 项第 1 | 超越 GPT 5.2 / Opus 4.5 / Gemini 3 Pro |
| 子代理提速 | 3-4.5x | vs 不使用子代理 |
| BrowseComp | +18.4 个百分点 | 用子代理 |
| WideSearch | +6.3 个百分点 | 用子代理 |
未披露:子代理的处理和内存成本,速度/性能 vs 资源消耗的权衡不清晰。
Kimi K2.5 将任务执行从链式思维推理转向代理协作——不再顺序响应 prompt,而是作为独立工作流/模型的管理者,并行执行不同部分