第三步(补齐一等 Agent 的另一半):驱动进程订阅 SSE,按邮件起一轮 headless
ZCode,取最终文本回信。
## --mode 是必传的(不传等于关掉授权系统)
ZCode 的权限判定里 `mode === "yolo"` 一律 allow
("Yolo mode bypasses permission prompts"),而 `--prompt` 的默认 mode **就是 yolo**。
所以驱动不传 --mode 时:授权钩子根本不会触发,整个授权系统**静默消失** ——
不报错,只是没有任何询问,看起来一切正常。
档位映射(依据是 CLI 产物里的规则表,不是猜):
plan → --mode plan (mode.plan.nonReadOnly:非只读一律拒)
workspace → --mode build(mode.build.highRisk / sideEffect:Bash/Write/Edit → ask)
full → --mode yolo (刻意绕过)
buildRunArgs 收不到 mode 直接抛错;测试里有一条反向对照钉住「只有 full 能得到 yolo」,
含大写 FULL(共用库 normalizeMode 严格匹配,落回 default 而不是 yolo —— 好性质,也钉住)。
## 一轮怎么跑
node <zcode.cjs> --prompt <提示词> --output-format stream-json \
--cwd <工作目录> --mode <m> [--resume sess_xxx] --max-turns N
用 stream-json 而不是 --json:`--json` 全程无输出,一个卡住的回合与一个正在
干活的回合在外部完全一样,而邮件驱动的会话没有界面,日志是唯一能看见它的地方。
输出契约(逐条事件 + 末尾 {type:"result",sessionId,response})同样逆自 CLI 产物。
会话延续靠 --resume + 存回的 sess_…:丢了它模型每封信都从零开始。
## 回信策略(与另三桥同源)
- 人来信 → 自动把本轮最终文本回过去(relay:'summary' + relay_key 走免配额通道)
- Agent 来信 → **不**自动回(Agent 间必须自己 send_mail,否则两边把对方的
「已收到」当待办,无限客套)
- 一轮跑不起来 → **必回**失败信,且给出 ZCode 自己的成因(没登录/缺模型配置/
CLI 路径不对)。没有本地界面时,什么都不发等于「信发出去了,然后再无音讯」。
刻意不复用共用库那份 renderFailureReport:它的建议是「调整可用模型范围」,
对 ZCode 什么也解决不了。
- 模型这一轮自己发过信 → 让位。工具跑在 ZCode 派生的 MCP 服务器**进程**里,
与驱动内存不通,所以经 lib/explicit-sends.mjs 落盘对齐(不记的后果线上实测过:
收件箱里两封说同一件事的邮件,311 与 342 字节)。
## 两处健壮性(都是实现时自己发现的真问题)
- 超时必须**必然** settle:既不退也不报错的孩子会让 Promise 永不 settle,
而队列是串行的 → 那封信永远挂住、后面的信全都不再被处理。
现在 SIGTERM → SIGKILL → 无论如何收尾;定时器刻意不 unref
(unref 过的定时器让「没有其它句柄」的进程直接退出,收尾根本没机会跑)。
- 关停时终止在途回合:否则 systemd 杀掉驱动后那个 ZCode 还在跑工具,
而既没有驱动看着它、也没有本地界面看着它。
## 自报强制力只声明得出来的事
驱动启动时读自己的 hooks/hooks.json,确认 PermissionRequest 已注册才报 native,
否则报 advisory 并在日志里写明原因 —— 不替一个不存在的能力背书。
## 验证
- 单元 320/320(新增 90 项:turn-mode 8、zcode-run 17、driver 19、prompt 14 +
继承的共用测试;含反向对照)
- 邮件驱动端到端 7/7 × 3 次连跑稳定:桩 CLI 替掉 ZCode,真网关真邮件 ——
SSE 订阅、去重、工作目录、档位映射、参数拼装(--mode 必须对)、
stream-json 解析、回信、Agent 来信不回、CLI 失败必回失败信
- 授权桥端到端 5/5 × 3 次连跑稳定
- 共用模块四方同源(新纳入 catchup/relay-dedup/relay-policy/workspace,
反向验证:让 workspace.js 分叉会被抓住)
## 我自己写错并被测试抓出来的三处(值得记)
1. 验证脚本把人类发信写成了 /api/v1/mail/send(**Agent** 路由)→ 401。
报错「Missing Authorization: Bearer …」其实已经指明走错了路由表。
2. findReply 按「驱动验证(人)」这种片段找,第二次跑时命中了**上一轮遗留的回信**
→ 正文比对失败、后续参数核对变成「无法判定」。收件箱是跨轮次共享的持久状态,
必须按唯一 marker 定位(与之前「待决权限列表」那次是同一类错误)。
3. 停旧驱动只发 SIGTERM 不等退出 → 新旧两个驱动同时订阅 SSE,
同一封信被回两次,判据取到哪封取决于时序 → 时灵时不灵。改成等 exit 事件。
另:桩脚本用 process.exit 截断管道写入,导致 stderr 时有时无 —— 改用 exitCode。
123 lines
5.4 KiB
Bash
Executable File
123 lines
5.4 KiB
Bash
Executable File
#!/usr/bin/env bash
|
||
# 共用模块必须逐字节相同 —— 见 docs/PLUGIN-CONTRACT.md 第六节。
|
||
#
|
||
# 一侧改了另一侧没改,几个平台的行为就会悄悄分叉:同一封邮件在 opencode 那边
|
||
# 标了已读、在 DSH 那边没标,而两处代码看起来都"对"。
|
||
#
|
||
# 比对一律以 opencode 为基准逐个对比,而不是两两对比:后者在三方都不同时
|
||
# 会打出三条互相矛盾的差异,读的人无从判断谁是对的。
|
||
#
|
||
# # 为什么每个 peer 的清单不同
|
||
#
|
||
# 四个插件共用的是**协议无关**的那几个模块(地址解析、收件箱渲染、附件 id 归一…),
|
||
# 但各自用到的子集不同:
|
||
#
|
||
# - pi / dsh / opencode 是邮件驱动的**桥**,需要会话快照、中继去重、SSE 客户端等;
|
||
# - zcode-mail-bridge 目前是 **MCP 工具服务器**(模型侧的工具面),
|
||
# 不订阅 SSE、不管会话生命周期,所以只需要那 5 个协议无关模块。
|
||
#
|
||
# 用「对等清单」会逼它拷一份用不到的 relay/session 模块进来 —— 那些文件
|
||
# 永远不会被执行,却要跟着一起同步,反而让「哪些是真的共用」变得看不清。
|
||
# 于是改成显式列举:**声明共用就必须逐字节相同**,声明之外的模块不检查
|
||
# (因为根本没拷过来,结构上就不可能分叉)。
|
||
set -euo pipefail
|
||
BASE=plugins/opencode-mail-bridge
|
||
PEERS=(plugins/dsh-mail-bridge plugins/pi-mail-bridge plugins/zcode-mail-bridge)
|
||
|
||
ALL_LIBS="relay-dedup relay-policy relay-key permission-mode bounded inbox-format session-snapshot workspace model-scope catchup addressing discovery rename-proposal permission-grants adopt sse-client user-question attachment-ids"
|
||
ALL_TESTS="relay-policy relay-key permission-mode bounded inbox-format session-snapshot workspace model-scope catchup addressing discovery rename-proposal permission-grants adopt sse-client user-question attachment-ids"
|
||
|
||
# MCP 工具服务器 + 授权钩子 + 邮件驱动用到的子集(实现与测试都同步)。
|
||
#
|
||
# 钩子与驱动这一层额外需要:
|
||
# permission-mode / relay-key / permission-grants / sse-client
|
||
# —— 档位语义、relay_key 截断、决策判定、SSE 帧解析
|
||
# catchup / relay-policy / workspace / relay-dedup
|
||
# (relay-dedup 在基准那边也没有独立测试,故只比对实现)
|
||
# —— 停机补投、主动发信去重、回信策略、工作目录解析
|
||
#
|
||
# 这些都不能各平台自己写一份:「同意」的含义、谁该收到回信、同一封邮件
|
||
# 会不会被转两次 —— 分叉的后果都是只在单平台复现的行为差异。
|
||
MCP_LIBS="addressing inbox-format bounded discovery attachment-ids permission-mode relay-key permission-grants sse-client catchup relay-dedup relay-policy workspace"
|
||
MCP_TESTS="addressing inbox-format bounded discovery attachment-ids permission-mode relay-key permission-grants sse-client catchup relay-policy workspace"
|
||
|
||
# ── 判据:用 cmp,不用 diff ─────────────────────────────────────────
|
||
#
|
||
# 本机 PATH 上的 `diff` **不是 GNU diff**,而是鸿蒙 SDK 工具链里的
|
||
# /opt/huawei/harmonyos/ohos-sdk/linux/toolchains/diff。它不认 `-q`,
|
||
# 却对**内容不同的文件照样返回 0** —— 于是 `if ! diff -q ... >/dev/null`
|
||
# 恒为假,整支脚本变成永真输出(本检查器曾长期如此,实测才发现)。
|
||
# cmp 的语义明确:相同 0、不同 1。
|
||
same() { cmp -s "$1" "$2"; }
|
||
|
||
# 判据本身必须先被验证。否则「比较永远说相同」与「真的都相同」
|
||
# 在结果上完全一样,而这正是上面那个坑的形状。
|
||
selfcheck() {
|
||
local a b
|
||
a=$(mktemp) && b=$(mktemp)
|
||
printf 'x\n' >"$a"
|
||
printf 'y\n' >"$b"
|
||
if same "$a" "$b"; then
|
||
echo "检查器自检失败:比较函数无法发现差异(别用 PATH 上的 diff)" >&2
|
||
exit 1
|
||
fi
|
||
printf 'y\n' >"$a"
|
||
if ! same "$a" "$b"; then
|
||
echo "检查器自检失败:相同内容的两个文件被判为不同" >&2
|
||
exit 1
|
||
fi
|
||
rm -f "$a" "$b"
|
||
}
|
||
selfcheck
|
||
|
||
libs_for() {
|
||
case "$1" in
|
||
*zcode-mail-bridge) echo "$MCP_LIBS" ;;
|
||
*) echo "$ALL_LIBS" ;;
|
||
esac
|
||
}
|
||
|
||
tests_for() {
|
||
case "$1" in
|
||
*zcode-mail-bridge) echo "$MCP_TESTS" ;;
|
||
*) echo "$ALL_TESTS" ;;
|
||
esac
|
||
}
|
||
|
||
# 差异明细也走 cmp,不借 diff。
|
||
show_diff() {
|
||
cmp "$1" "$2" 2>&1 | head -3
|
||
}
|
||
|
||
fail=0
|
||
|
||
for peer in "${PEERS[@]}"; do
|
||
for f in $(libs_for "$peer"); do
|
||
if [[ ! -f "$peer/lib/$f.js" ]]; then
|
||
echo "共用模块缺失:$peer/lib/$f.js" >&2
|
||
fail=1
|
||
continue
|
||
fi
|
||
if ! same "$BASE/lib/$f.js" "$peer/lib/$f.js"; then
|
||
echo "共用模块已分叉:lib/$f.js($BASE vs $peer)" >&2
|
||
show_diff "$BASE/lib/$f.js" "$peer/lib/$f.js" >&2
|
||
fail=1
|
||
fi
|
||
done
|
||
# 测试同样要同源:共用模块的行为约定写在测试里,
|
||
# 只同步实现不同步测试,等于允许一侧偷偷放宽约定。
|
||
for f in $(tests_for "$peer"); do
|
||
if [[ ! -f "$peer/test/$f.test.mjs" ]]; then
|
||
echo "共用测试缺失:$peer/test/$f.test.mjs" >&2
|
||
fail=1
|
||
continue
|
||
fi
|
||
if ! same "$BASE/test/$f.test.mjs" "$peer/test/$f.test.mjs"; then
|
||
echo "共用测试已分叉:test/$f.test.mjs($BASE vs $peer)" >&2
|
||
fail=1
|
||
fi
|
||
done
|
||
done
|
||
|
||
[[ $fail -eq 0 ]] && echo " 共用模块四方同源(opencode 基准 vs dsh / pi / zcode)(判据已自检)" || exit 1
|