将军赶路不追小兔:多 Agent 调度体系的架构与实践

将军赶路不追小兔 这篇的底稿是一段 80 分钟的语音分享。依然延续这个系列的传统——作为人类,你只需要读懂思路和架构逻辑;所有具体的执行细节,把文章丢给你的 Claude Code 或 Codex,让它去做就行。 开头:为什么要聊调度体系 在人生的塞尔达时期那篇文章里,我用了一张架构图和一段概述提过"多 Agent 调度"这个话题——主脑负责规划、执行层负责干活、门禁负责把关。但那篇的重心在 Token 经济学和模型军火库,调度体系本身只是一笔带过。 这篇就是展开讲。 先回到一句话原则:Agent 的注意力是非常宝贵的东西,你应该把它用在解决高质量的不确定性上面,而不是琐碎的事情。 怎么理解这句话?你可以把 Agent 的注意力想象成一个人的工作精力。如果它花一个小时去处理登录验证码,就少一个小时去干正事。我在 Context is All You Need 里用过一个比喻:注意力就像你的工作台面——台面就那么大,放了杂物就没地方干正事。在那篇文章里聊的是管好一个 Agent 的"工作台";这篇是——当你同时有 Claude Code、Codex、Kimi、Grok 这一堆 Agent 的时候,怎么把每个 Agent 的工作台面都利用好。 这完全可以类比 CEO 的精力分配。CEO 的精力是有限的,应该只用来决策、高价值的方向判断、找资源——而不应该浪费在一线执行层的细节上。将军赶路,不追小兔。 一、这套体系是怎么长出来的 很多人看到"多 Agent 调度"可能觉得这是个很重的架构设计,但它最开始其实是一个非常朴素的想法。 那时候 Fable 5(Claude 家目前最顶级的模型)还是限量内测,不知道以后还有没有机会再用。所以我用得抠抠搜搜:Fable 5 只负责规划设计,所有具体的执行任务全外包给 Sonnet 5(一个便宜且能力均衡的模型)。成本倒逼出了最初的分工逻辑。 后来的演化路径是这样的: 起点:多个 Coding Agent 各有各的配置文件,维护起来很麻烦,单独建了个代码仓库(可以理解为一个项目所有文件集中存放的地方)来统一管理。 第一步:既然配置文件都集中了,能不能试着把其他 Coding Agent 变成执行层? 第二步:执行层能自动跑了,需要知道各家套餐还剩多少额度——于是写了个监控面板。 第三步:监控面板有数据了,能不能根据剩余额度自动选执行器?于是有了配额感知调度。 每一步都不是预先设计的,而是在使用过程中"长出来的"。你会发现建好一个组件之后,它会产生意想不到的新用途: 监控面板一开始只是统计各套餐的用量,后来加了 Token 消耗统计(分模型、分项目、分设备),又加了开发机的内存和工作区清洁度监测,再加了 CI 测试机的健康状况——最终它变成了调度系统的"仪表盘",辅助决策"这个任务该分给谁"。 ...

August 9, 2026 · 5 min · 立行

人生的塞尔达时期:日均 40 亿 Token 的那一周

这篇的底稿是一段 80 分钟的语音分享,聊的东西比较杂:我最近的沉迷状态、Token 的使用逻辑、Skill 和软件的边界、人机协作方式的进阶,以及我在用的所有模型。依然延续这个系列的传统——作为人类,你只需要读懂思路和架构逻辑;所有具体的执行细节,把文章丢给你的 Claude Code 或 Codex,让它去做就行。 人生的塞尔达时期 开头:Token 用光了这个晚上 好久没有更新了。原因很简单:沉迷于薅 Token 羊毛中。 多个 Token 套餐已撞线 Claude Code 7 天撞线、Fable 5(Claude 当前最顶级的模型)撞线、Codex 7 天撞线,Kimi Code 也到了 94%。备用渠道里 GLM 还剩 63%,Grok 剩 32%,DeepSeek 和百炼倒是余量充足——但主力全歇了。 所以干脆趁着等额度恢复的间隙,写写文章吧。这个话题其实之前就想写,定的主题叫——人生的塞尔达时期。聊的东西可能会比较杂,很多都是关于 AI 的,各位读者朋友,且看吧。 一、人生的塞尔达时期 塞尔达是 Switch 上的一个游戏。 我本身其实不怎么玩游戏,之前玩过的也都是派对游戏或者双人游戏,和朋友一起打发时光用的。一个人玩的游戏,大概只能追溯到小学时候的跑跑卡丁车。但当我接触《塞尔达传说:旷野之息》的时候,一下子就沉迷住了。 那段时间,每天脑子里只有塞尔达里没有探索到的地方。晚上经常玩到两三点,周末基本上一整天都泡在里面。你不知道疲惫,吃饭、出行之类的事情都可以往后排——你的脑中只有海拉鲁大陆。 塞尔达玩家最常说的一句话是:很想要一个没有玩过塞尔达的脑子。因为整个游戏毕竟是有限的,当你把很多地方都探索过、支线任务也打完了,再玩的时候就很难找回首次接触时那种惊喜和沉迷感。后来《王国之泪》出来,我也玩了一下,但明显没有一代上头——客观讲,很多地方都是已经探索过的了。 但是最近,我觉得我又找回了这种感觉。 或者说,我可能进入了一段人生的塞尔达时期。 每天实际上是被好奇心塞满的,去探索很多不同的方向,解决很多切实的问题。经常一干起来,就跟 Agent 聊到一两点。我有一个朴素的信念:一个东西只要它的数据在线上,大语言模型之前有过相关的训练数据,那原则上都可以拿 Agent 去尝试——之前的软件篇、硬件篇,都是这么试出来的。 客观地说,我整个 7 月份的作息,都是围绕着 Claude Code 里 Fable 5 的额度有效期、还有 Codex 的额度重置时间来安排的。7 月 10 号之前,我的日均 Token 消耗大概只有七八亿;7 月 10 号新一轮额度周期开始,怕重置浪费,要集中消耗 Fable 5 和 Codex 的额度,消耗量迅速拉升——连续几天日均都是 40 亿往上(所有渠道合计)。 ...

July 21, 2026 · 4 min · 立行