## 设计规则:Agent 之间不自动转发
自动转发存在的理由是「人不该等模型记得调 send_mail」—— 收件方是人时这是
纯收益。**收件方是另一个 Agent 时这个理由不成立,而且有害**:双方的插件都
会自动回一封,于是两个模型都以为「我只要把话说完就行」,实际在持续互相唤醒。
生产实测 pi 与 dsh 客套 6 轮直到撞上连续 relay 跳数上限。
规则现在写死在共用模块 `lib/relay-policy.js`(三平台逐字节相同):
- `autoRelayDecision` — 插件该不该替模型开口
- `replyInstruction` — 提示词怎么跟模型说(人类 vs Agent 各一套措辞)
- `inboundHeadline` — 进来的是新活、回复、还是补投
`from_human` 缺失时保守按 Agent 处理:宁可让模型多调一次 send_mail,
也不能承诺一个不会发生的自动回信让发件方白等。
## Gateway 侧:`in_reply_to` + `from_human`
- `notify.Mail` 新增 `ParentMailID`(非空 = 这是对收件方某封信的回复)
- `notify.Mail` 新增 `FromHuman`(走 `repo.IsHumanUser`)
- SSE payload 里叫 `in_reply_to` / `from_human`
- 四个调用点全部传入:handler/mail(转发后产出的邮件,parentMailID 从
resolveTarget 取)、handler/me(同理)、handler/forward(传空串,
因为对收件方而言那封原邮件不在它的线索里)、scheduler/calendar(传空串)
- `ListInbox` 的 SELECT 加 `EXISTS (SELECT 1 FROM users u WHERE u.username = m.from_name)`
→ `models.Mail.FromHuman`,让补拉路径也有这个信号
## 提示词分流
三种处境各一套标题:
- 新活(人类):「你收到一封新邮件」+ 「回信不用你自己发:…」
- 新活(Agent):「你收到一封新邮件(对方是一个 Agent)」+ 「插件不会替你
回信。需要回复时你必须自己调 send_mail…请先判断是否真的需要回复」
- 回复到了:「你上一封信的回复到了。**这不是新任务**。」
- 补投:在标题里说明「离线期间积压」
## homeagent 特殊处理
Go 插件不能直接 `import('../lib/relay-policy.js')`,因此新增 `relay_policy.go`
(Go 对应物)+ `relay_policy_test.go`(11 例,逐条对齐 Node 侧判据)。
`sseLoop` / `catchUp` 两条路径都接上。
## `mailEvent` 命名类型
homeagent 的 SSE 事件解析 / handleNewMail / handlePermissionDecision 三处
原来各写一遍匿名 struct(字段列表几乎相同),加 `from_human` / `in_reply_to`
时漏改一处 → 编译报错但错误信息是两串几乎相同的字段列表,极难定位。
提成 `mailEvent` 命名类型:一处改、三处跟着走。
## 测试
- `lib/relay-policy.test.mjs`(Node)16 例:含「replyInstruction 与
autoRelayDecision 不得互相矛盾」「Agent 来信的标题要点名且回复要明确反对」
- `relay_policy_test.go`(Go)11 例:逐条对齐 Node 侧
- `turn.test.mjs` +3 例:from_human 缺失时按 Agent 处理 / Agent 来信时改口 /
回复到了说「不是新任务」;删掉两条旧的「必定自动转发」断言
- 共用脚本 `check-shared-libs.sh` +1 个文件(relay-policy)
- pi 288 / dsh 241 / opencode 217 / homeagent 14 / gateway 8 包全绿
97 lines
4.5 KiB
Go
97 lines
4.5 KiB
Go
package main
|
||
|
||
// 自动转发的适用范围,以及据此该给模型说什么话。
|
||
//
|
||
// 这是三个 Node 插件里 `lib/relay-policy.js` 的 Go 对应物。**不能共用那个文件**
|
||
// (homeagent 是 Go 子进程插件),但语义必须一致 —— 因此这里把那边的注释与判据
|
||
// 原样搬过来,`relay_policy_test.go` 逐条钉住。
|
||
//
|
||
// # 为什么 Agent → Agent 不自动转发
|
||
//
|
||
// 自动转发存在的理由是「人不该等模型记得调 send_mail」:人发一封信出去,
|
||
// 模型把活干完、话说完,插件替它把结论搬进邮件。收件方是人时这是纯收益。
|
||
//
|
||
// 收件方是**另一个 Agent** 时这个理由不成立,而且有害:对方的插件同样会自动
|
||
// 回一封,于是两个模型都以为「我只要把话说完就行」,实际上在持续互相唤醒。
|
||
// 生产实测过一条完整的客套链(pi 转发给 dsh,dsh 回确认,pi 又确认那个确认,
|
||
// 一直到第 6 封撞上连续 relay 跳数上限才停):
|
||
//
|
||
// pi→dsh parent=24be32e5 转发
|
||
// dsh→pi parent=bf79f8fe 已收到转发
|
||
// pi→dsh parent=2700bd0a 收到你的确认
|
||
// dsh→pi parent=34127884 确认闭环
|
||
// pi→dsh parent=34058c13 …
|
||
// dsh→pi parent=9590bf16 ← 被 hop 上限拦下
|
||
//
|
||
// 每一封都不是错的,每一封都没有新信息。跳数上限是最后一道闸,不是设计意图。
|
||
//
|
||
// 因此规则是:**Agent 之间通信必须由模型主动调 send_mail。**
|
||
|
||
import "fmt"
|
||
|
||
// relayDecision 是「这一轮的结论该不该由插件自动转发出去」的判定结果。
|
||
type relayDecision struct {
|
||
relay bool
|
||
// reason 供日志用 —— 「本轮没有回信」必须能在日志里查到原因,
|
||
// 否则它与「模型没说话」「转发失败」三种情形长得一样。
|
||
reason string
|
||
}
|
||
|
||
// autoRelayDecision 判定要不要自动转发。
|
||
//
|
||
// fromHuman 来自 SSE 的 `from_human`;replyTo 是本来要回给谁。
|
||
func autoRelayDecision(fromHuman bool, replyTo string) relayDecision {
|
||
if replyTo == "" {
|
||
return relayDecision{false, "不知道回给谁"}
|
||
}
|
||
if !fromHuman {
|
||
return relayDecision{false, fmt.Sprintf(
|
||
"来信方 %s 是 Agent,按约定不自动转发(Agent 间通信须由模型主动 send_mail)",
|
||
replyTo)}
|
||
}
|
||
return relayDecision{true, ""}
|
||
}
|
||
|
||
// replyInstruction 是提示词里关于「回信怎么发」的那几句话。
|
||
//
|
||
// 必须与 autoRelayDecision 一致 —— 这是同一件事的两个出口,分开写必然分叉。
|
||
// 而分叉的代价是模型被骗:它以为插件会替它回信,于是把话说完就停手,
|
||
// 而实际上那封信永远不会发出去,发件方一直等着。
|
||
func replyInstruction(fromHuman bool, replyAddress string) string {
|
||
if fromHuman {
|
||
return "**回信不用你自己发**:你把本轮工作做完、把结论说出来就行,\n" +
|
||
"插件会在这一轮结束时自动把你最后那段话作为回信发回去(不消耗你的发信配额)。\n" +
|
||
"只有在需要主动联系其他人、或要带附件时才调用 send_mail。"
|
||
}
|
||
addr := ""
|
||
if replyAddress != "" {
|
||
addr = fmt.Sprintf("(回信地址:%s)", replyAddress)
|
||
}
|
||
return "**这封信来自另一个 Agent,插件不会替你回信。**\n" +
|
||
fmt.Sprintf("需要回复时你必须自己调用 send_mail%s;\n", addr) +
|
||
"把话说完并不会让对方收到任何东西。\n" +
|
||
"也请先判断这封信是否真的需要回复 —— 单纯的「收到」「确认」会让两个 Agent\n" +
|
||
"无休止地互相客套,那对谁都没有价值。有实质结论或有事要问时才回。"
|
||
}
|
||
|
||
// inboundHeadline 描述「进来的这封是什么」。
|
||
//
|
||
// 在此之前提示词一律说「你收到一封新邮件」,于是模型分不清三种处境:
|
||
// 有人派了新活、我上封信的回复到了、离线期间积压的补投。
|
||
// 第二种被当成第一种时,模型会把一句「已收到」当成待办再处理一遍。
|
||
func inboundHeadline(inReplyTo string, fromHuman, catchup bool) string {
|
||
who := ""
|
||
if !fromHuman {
|
||
who = "(对方是一个 Agent)"
|
||
}
|
||
if inReplyTo != "" {
|
||
// 「回复到了」与「有人派活」是两种处境。说清楚它,模型才不会把
|
||
// 一句确认当成新任务 —— 那正是互相客套的起点。
|
||
return fmt.Sprintf("你上一封信的**回复**到了%s。这不是新任务。", who)
|
||
}
|
||
if catchup {
|
||
return fmt.Sprintf("你收到一封新邮件%s。说明:这是插件离线期间积压的邮件,现在补投给你。", who)
|
||
}
|
||
return fmt.Sprintf("你收到一封新邮件%s。", who)
|
||
}
|