Agent 不下班:手机遥控器的进化

本文是「Agent 不下班」系列的手机方案升级篇。基础架构怎么搭,见 Agent 不下班:随时随地随设备的开发体系;多 Agent 怎么调度,见 将军赶路不追小兔。这篇聊的是:整套体系切换到 Herdr 之后,手机端的开发体验怎么跟着升级。 还是那句话——作为人类,你只需要读懂架构思路和选型逻辑。具体的安装部署,丢给你的 Agent 去执行就行。 起因:断连之后的空虚 今天真是悲惨的一天。下午 Codex 用了四年的老账号突然被封了,莫名其妙,没有任何逆向也没有反代,正常使用。好不容易收拾好心情,晚上回到家发现远程开发机断连了。 平时回到家之后,都是打开手机继续和 Agent 协作——审一下主脑的方案、批几个任务卡、看看执行层的进度。和它们断连以后,一下子觉得特别空虚,健身完了也不知道该干嘛。 干脆就来写这篇文章吧。之前一直想写但没动笔——最近整个体系已经从 tmux 切换到了 Herdr,手机端的方案也跟着做了一次大升级。HerdWeb 其实已经开发完成并且用了一段时间了,正好趁这个空档把思路整理出来。 一、1.0 方案的两道裂缝 在 Agent 不下班 那篇文章里,我推荐的手机方案是 HAPI + tmux,网络走 Tailscale 或 Cloudflare Tunnel。用了一段时间之后,出现了两个越来越明显的问题。 裂缝一:tmux 的状态盲区 在 多 Agent 调度 那篇里我提过,我现在的调度思路是主脑派任务卡——主脑负责规划和拆任务,执行层在后台自主执行。 这个模式下,tmux 的标题(title)机制就不够用了。两种场景特别痛: 主脑已经干完了,但 tmux 标题没变。 你不知道它在等你,任务就一直卡着没往下推进。 tmux 标题变了,但后台执行层还在跑。 你点进去一看,其实什么都不需要做。白白浪费注意力。 同时开五六个主脑的时候,这两种情况反复出现。你的精力被大量消耗在"判断谁需要我关注"上——而不是关注本身。 裂缝二:HAPI 的两个硬伤 HAPI 本身做得不错,但有两个问题让我最终放弃了它: 第一,多了一层渲染。 HAPI 把 Agent 的终端界面重新渲染成网页。这个过程中,有些原生 Coding Agent 的命令和交互它没法完全支持。从电脑切到手机的时候,总能感觉到一个明显的"翻译层"在中间。 第二,跨会话消息接管。 HAPI 最近更新了一个功能——不同 Agent 会话之间可以互相沟通。这个功能可能有它的使用场景,但问题是没办法关闭。结果就是我在本地开发的时候,正和一个 Agent 聊着,对话突然被另一个 Agent 的消息"劫持"了。体验非常差。 ...

August 26, 2026 · 3 min · 立行