feat: 每平台可用模型范围 + 降级尝试 + 失败回报
配置页为每个 Agent 平台划定「邮件场景下可用的模型」,插件按顺序逐个尝试,
全部失败把原因封装成邮件回复。目录由插件上报、管理员只做勾选 —— 手打模型名
会打错,而打错的后果要到真发邮件时才暴露成一次失败。
## 目录上报走心跳,不另设端点
模型清单会在运行中变(换 provider 配置、上游上下线、换 API key)。
只在注册时报一次的话目录会静静变陈,管理员在配置页选中一个平台其实调不到的
模型。心跳本来就是 30 秒一次的现成通道;另设一个 POST 等于给「目录是谁写的」
留两个答案,排查时要同时看两处。
心跳响应回传 `allowed_models`,因此管理员改了范围后最多一个周期生效,
不必重启插件。
与 platform_sessions 同一约定:拉不到目录时**省略字段**(保留现有目录),
传空数组会把配置页清成空白。
## 目录与选择分两张表
模型会从平台目录里消失(上游临时下线、换了 provider 配置)。合成一张带
allowed 标记的表时,整行被删就连带把管理员的选择也删了,模型回来还得重配一遍。
分开存之后「选了什么」是持久的,目录只决定「这一项现在是否可用」;
已选但不在目录里的标为 stale 显示出来 —— 不显示会让人以为自己没选过它。
## 最难的一点:模型失败不是同步抛出的
两个平台都踩了。`promptAsync()` 立即返回、`ctx.agents.create()` 不校验模型,
只包 try/catch 的话第二个模型永远不会被试到 —— 第一个无效模型会被判成成功。
必须等异步结论:
- opencode → `session.error` 事件(event 钩子在 deliverMail 之外,
因此用 turnWatchers 表把两者接起来)
- DSH → `turn/end` 的 `reason.kind === 'error'`
DSH 还有个陷阱:**`assistant/chunk` 不能当成功信号**,它的 `finish` 子类型
也带错误 —— `{chunk:{type:'finish',reason:{kind:'error',failure:{code:'NO_ADAPTER'}}}}`。
实测「无效 provider 却判成功」正是因为把任意 chunk 当成了走通。判据要落在
chunk 的类型上:finish 看 reason,其余才意味着模型真的在产出。
超时按成功处理(60 秒窗口):模型可能只是很慢,把慢当成失败会在换模型的同时
把已经在跑的那一轮丢掉。
DSH 换模型要换会话 id(`<原 id>-r1`)并 dispose 失败那个 agent:复用同一个 id
会让重试接在一条已经出错的会话后面,不 dispose 则 agent/status 还会为那个
死会话触发一次自动转发。
## 其他决策
- **范围优先于环境变量**:范围是运行时可改的策略,`AGENTMAIL_REPLY_*` 是部署时
的兜底。反过来的话管理员在配置页改了却不生效,得去改 service 文件重启
- **范围为空返回 `[undefined]` 而非 `[]`**:空数组会让调用方一次都不试,
而「管理员没配」的正确含义是不限定,不是「一个都不许用」
- **上限 10 个**:降级是串行的,选 50 个意味着最坏情况下一封邮件要等 50 次超时
- 前端 key 按**第一个** `/` 切分 provider/model:model id 可能含 `/`
(如 `org/model-name`),按最后一个切会把 provider 切错
- 保存后用服务端返回的结果刷新界面而非回显入参:repo 层会跳过重复与空字段
## 验证
- Go 10 个新测试(含「模型从目录消失后选择必须留存」的直接回归)
- 两插件各 18 个模型范围测试,共 180 个
- 端到端四轮:正常路由 → 全部无效(收到失败回报邮件,used_rounds 保持 0
确认走了免配额通道)→ DSH 降级(fake-a 失败 → llmsproxy/AUTO 成功)→
opencode 降级(nonexistent/bad 失败 → AUTO 成功,日志确认「前 1 个失败」)
- 生产已部署,前端「模型范围」页可用
This commit is contained in:
@ -7,6 +7,11 @@ import { join, dirname, basename } from "node:path";
|
||||
// 都当成插件工厂,入口文件多导出一个东西就会 "Plugin export is not a function"。
|
||||
import { snapshotOpencodeSessions } from "./lib/session-snapshot.js";
|
||||
import { resolveWorkspaceCwd } from "./lib/workspace.js";
|
||||
import {
|
||||
snapshotOpencodeModels,
|
||||
modelAttemptOrder,
|
||||
renderFailureReport,
|
||||
} from "./lib/model-scope.js";
|
||||
import {
|
||||
renderInbox,
|
||||
idsToMarkRead,
|
||||
@ -446,6 +451,10 @@ const relayedSummaries = new Map(); // opencode session id -> assistant message
|
||||
// 用户在 TUI 里自己开的会话不该被搬进邮件系统。
|
||||
const mailDrivenSessions = new Set(); // opencode session id
|
||||
|
||||
// 管理员在配置页划定的可用模型范围(按优先级)。随心跳响应更新。
|
||||
// 空数组 = 不限定,回退到环境变量或平台默认。
|
||||
let allowedModels = [];
|
||||
|
||||
async function resolveSessionForMail(client, directory, data, kind) {
|
||||
const mailSessionID = data.session_id;
|
||||
const bound = mailSessionID ? sessionMap.get(mailSessionID) : undefined;
|
||||
@ -650,16 +659,116 @@ async function deliverMail(client, directory, data, kind) {
|
||||
`只有在需要主动联系其他人、或要带附件时才调用 send_mail。`,
|
||||
].join("\n");
|
||||
|
||||
await client.session.promptAsync({
|
||||
path: { id: sessionID },
|
||||
query: directory ? { directory } : undefined,
|
||||
body: {
|
||||
model: { providerID: REPLY_PROVIDER, modelID: REPLY_MODEL },
|
||||
parts: [{ type: "text", text }],
|
||||
},
|
||||
// 按管理员划定的范围逐个尝试,全部失败才回一封说明失败原因的邮件。
|
||||
//
|
||||
// 必须发那封信:模型一次都没跑起来时会话里没有任何 assistant 消息,
|
||||
// 自动转发因此什么也不会发 —— 发件人只会看到邮件发出去后再无音讯。
|
||||
//
|
||||
// **promptAsync 返回不代表模型跑起来了**(名字里的 Async 就是这个意思):
|
||||
// 无效 provider 的失败通过 `session.error` 事件到达,而不是它的 reject。
|
||||
// 因此只包 try/catch 的话第二个模型永远不会被试到 —— 用 awaitFirstTurn 等结论。
|
||||
const attempts = modelAttemptOrder(allowedModels, {
|
||||
provider: REPLY_PROVIDER,
|
||||
model: REPLY_MODEL,
|
||||
});
|
||||
const failures = [];
|
||||
|
||||
return { sessionID, reused };
|
||||
for (const route of attempts) {
|
||||
const label = route ? `${route.provider}/${route.model}` : "(平台默认)";
|
||||
const watching = awaitFirstTurn(sessionID);
|
||||
try {
|
||||
await client.session.promptAsync({
|
||||
path: { id: sessionID },
|
||||
query: directory ? { directory } : undefined,
|
||||
body: {
|
||||
// route 为 undefined 表示不指定模型,交给平台自己选
|
||||
...(route ? { model: { providerID: route.provider, modelID: route.model } } : {}),
|
||||
parts: [{ type: "text", text }],
|
||||
},
|
||||
});
|
||||
} catch (e) {
|
||||
// 同步就被拒(参数非法、会话不存在等)
|
||||
watching.cancel();
|
||||
failures.push({ ...(route ?? {}), error: e?.message || String(e) });
|
||||
console.error(`[mail-bridge] 模型 ${label} 提交失败:`, e?.message || e);
|
||||
continue;
|
||||
}
|
||||
|
||||
const outcome = await watching.result;
|
||||
if (outcome.ok) {
|
||||
if (failures.length > 0) {
|
||||
console.error(`[mail-bridge] ${label} 成功(前 ${failures.length} 个失败)`);
|
||||
}
|
||||
return { sessionID, reused };
|
||||
}
|
||||
failures.push({ ...(route ?? {}), error: outcome.error });
|
||||
console.error(`[mail-bridge] 模型 ${label} 失败:`, outcome.error);
|
||||
}
|
||||
|
||||
// 全部失败:把原因作为邮件回给发件人。走免配额通道 ——
|
||||
// 这是插件的故障报告,不是模型的自主发信。
|
||||
if (kind === "mail" && data.from_name) {
|
||||
try {
|
||||
await apiPost("/mail/send", {
|
||||
to: data.from_name,
|
||||
subject: `处理失败: ${data.subject || "(无主题)"}`,
|
||||
body: renderFailureReport(failures, data.subject),
|
||||
reply_to: data.mail_id || "",
|
||||
relay: "summary",
|
||||
relay_key: `model-failure:${data.mail_id || sessionID}`,
|
||||
});
|
||||
console.error(`[mail-bridge] 已回报模型调用失败给 ${data.from_name}`);
|
||||
} catch (e) {
|
||||
console.error("[mail-bridge] 失败回报也发不出去:", e?.message || e);
|
||||
}
|
||||
}
|
||||
throw new Error(
|
||||
`划定范围内的 ${failures.length} 个模型全部失败:` +
|
||||
failures.map(f => f.error).join(" | "));
|
||||
}
|
||||
|
||||
// ─── 首轮结果观察 ───
|
||||
//
|
||||
// opencode 的事件是通过插件的 event 钩子进来的,而 deliverMail 在钩子之外,
|
||||
// 因此这里用一个「等待者」表:event 钩子看到 session.error / session.idle 时
|
||||
// 唤醒对应会话的等待者。
|
||||
const turnWatchers = new Map(); // sessionID -> { resolve, timer }
|
||||
|
||||
/**
|
||||
* 等这个会话的首轮跑起来或失败。
|
||||
*
|
||||
* 超时按「成功」处理:模型可能只是很慢(首 token 前要装载上下文),
|
||||
* 把慢当成失败会在换模型的同时把已经在跑的那一轮丢掉。
|
||||
*
|
||||
* @param {string} sessionID opencode 会话 id
|
||||
* @param {number} timeoutMs 判定窗口
|
||||
*/
|
||||
function awaitFirstTurn(sessionID, timeoutMs = 60000) {
|
||||
let settle;
|
||||
const result = new Promise(res => { settle = res; });
|
||||
const finish = (r) => {
|
||||
const w = turnWatchers.get(sessionID);
|
||||
if (!w) return;
|
||||
clearTimeout(w.timer);
|
||||
turnWatchers.delete(sessionID);
|
||||
w.resolve(r);
|
||||
};
|
||||
const timer = setTimeout(() => finish({ ok: true }), timeoutMs);
|
||||
turnWatchers.set(sessionID, { resolve: settle, timer });
|
||||
return {
|
||||
result,
|
||||
cancel: () => finish({ ok: true }),
|
||||
};
|
||||
}
|
||||
|
||||
/** event 钩子调用:这个会话的首轮有结论了。 */
|
||||
function settleFirstTurn(sessionID, outcome) {
|
||||
const w = turnWatchers.get(sessionID);
|
||||
if (!w) return false;
|
||||
clearTimeout(w.timer);
|
||||
turnWatchers.delete(sessionID);
|
||||
w.resolve(outcome);
|
||||
return true;
|
||||
}
|
||||
|
||||
export default async function mailBridge(input) {
|
||||
@ -719,10 +828,40 @@ export default async function mailBridge(input) {
|
||||
}
|
||||
}
|
||||
|
||||
// 模型目录:随心跳上报,让配置页看到的清单跟着平台的实际状态走。
|
||||
//
|
||||
// 只在注册时报一次的话目录会静静变陈(换 provider 配置、上游上下线、
|
||||
// 换 API key 都会让它失准),管理员会选中一个平台其实调不到的模型,
|
||||
// 而失败要到真发邮件时才暴露。
|
||||
async function reportModels() {
|
||||
try {
|
||||
const cfg = await client.config.providers();
|
||||
return snapshotOpencodeModels(cfg?.data ?? cfg);
|
||||
} catch (e) {
|
||||
// 拉不到就**省略**该字段,而不是传空数组:
|
||||
// 空数组的语义是「平台确实一个模型都拿不到」,会把配置页清成空白。
|
||||
console.error("[mail-bridge] 模型目录读取失败:", e?.message || e);
|
||||
return undefined;
|
||||
}
|
||||
}
|
||||
|
||||
const beat = async () => {
|
||||
const platform_sessions = await reportSessions();
|
||||
const body = platform_sessions ? { platform_sessions } : {};
|
||||
apiPost("/agent/heartbeat", body).catch(() => {});
|
||||
const [platform_sessions, models] = await Promise.all([
|
||||
reportSessions(),
|
||||
reportModels(),
|
||||
]);
|
||||
const body = {};
|
||||
if (platform_sessions) body.platform_sessions = platform_sessions;
|
||||
if (models) body.models = models;
|
||||
try {
|
||||
const res = await apiPost("/agent/heartbeat", body);
|
||||
// 生效的模型范围随心跳响应回传:管理员在配置页改了范围后,
|
||||
// 插件最多一个周期(30 秒)就能看到新值,不需要重启。
|
||||
if (Array.isArray(res?.allowed_models)) allowedModels = res.allowed_models;
|
||||
} catch {
|
||||
// 心跳失败不报错:网络抖动很常见,下一轮会补上。
|
||||
// 真的持续连不上时 Gateway 会把它判成离线,那才是可见的信号。
|
||||
}
|
||||
};
|
||||
beat();
|
||||
const heartbeat = setInterval(beat, 30000);
|
||||
@ -826,8 +965,25 @@ export default async function mailBridge(input) {
|
||||
// 2) 一轮跑完 → 把最后那段话作为回信转出去(不消耗配额)。
|
||||
// 用 session.idle 而不是 message.updated:后者在流式生成中反复触发,
|
||||
// 转出去的会是半截话。
|
||||
// 1.5) 模型调用出错 → 唤醒等待者,让 deliverMail 换下一个模型。
|
||||
// promptAsync 已经返回过了,失败只能从这里得知。
|
||||
if (event?.type === "session.error") {
|
||||
const sid = event.properties?.sessionID;
|
||||
const err = event.properties?.error;
|
||||
const msg = err?.data?.message || err?.name || JSON.stringify(err ?? {});
|
||||
if (sid && settleFirstTurn(sid, { ok: false, error: msg })) {
|
||||
return; // 正在降级尝试中,不当作一次普通故障
|
||||
}
|
||||
if (sid && mailDrivenSessions.has(sid)) {
|
||||
console.error(`[mail-bridge] 会话 ${sid} 出错:`, msg);
|
||||
}
|
||||
return;
|
||||
}
|
||||
|
||||
if (event?.type === "session.idle") {
|
||||
const sid = event.properties?.sessionID;
|
||||
// 首轮跑到 idle = 这一路走通了(哪怕没产出文本)
|
||||
if (sid) settleFirstTurn(sid, { ok: true });
|
||||
if (!sid || !mailDrivenSessions.has(sid)) return;
|
||||
try {
|
||||
const res = await relaySummaryRef(sid);
|
||||
|
||||
138
plugins/opencode-mail-bridge/lib/model-scope.js
Normal file
138
plugins/opencode-mail-bridge/lib/model-scope.js
Normal file
@ -0,0 +1,138 @@
|
||||
/**
|
||||
* 平台模型目录的整理与降级选择 —— 所有平台插件共用。
|
||||
*
|
||||
* 两个职责:
|
||||
* 1. 把各平台的 provider/model 结构整理成统一的上报格式(随心跳发给 Gateway)
|
||||
* 2. 按管理员划定的范围决定「先试哪个、再试哪个」
|
||||
*
|
||||
* 为什么随心跳上报而不是只在注册时报一次:模型清单会在运行中变(换 provider
|
||||
* 配置、上游上下线、换 API key)。只在注册时报的话目录会静静变陈,而管理员
|
||||
* 在配置页上看到的是上次重启时的快照 —— 选中一个平台已经调不到的模型,
|
||||
* 失败要到真发邮件时才暴露。
|
||||
*/
|
||||
|
||||
/** 单次上报的模型数上限。与服务端的 maxCatalogModels 一致。 */
|
||||
export const MAX_CATALOG = 300;
|
||||
|
||||
/**
|
||||
* 把 opencode 的 `/config/providers` 响应整理成上报格式。
|
||||
*
|
||||
* @param {any} config `client.config.providers()` 的结果
|
||||
* @returns {object[]} `[{ provider, model, display_name }]`
|
||||
*/
|
||||
export function snapshotOpencodeModels(config) {
|
||||
const providers = Array.isArray(config?.providers) ? config.providers : [];
|
||||
const out = [];
|
||||
for (const p of providers) {
|
||||
const provider = typeof p?.id === 'string' ? p.id : '';
|
||||
if (!provider) continue;
|
||||
// models 是对象而非数组:键是 model id,值是元数据
|
||||
const models = p?.models && typeof p.models === 'object' ? p.models : {};
|
||||
for (const [id, meta] of Object.entries(models)) {
|
||||
if (!id) continue;
|
||||
out.push({
|
||||
provider,
|
||||
model: id,
|
||||
display_name: typeof meta?.name === 'string' ? meta.name : '',
|
||||
});
|
||||
}
|
||||
}
|
||||
return dedupeAndCap(out);
|
||||
}
|
||||
|
||||
/**
|
||||
* 把 DSH 的 provider/model 列表整理成上报格式。
|
||||
*
|
||||
* DSH 侧要先 `ctx.llm.listProviders()` 再对每个 provider `listModels()`,
|
||||
* 因此这里收的是已经拍平的结果。
|
||||
*
|
||||
* @param {any[]} entries `[{ provider, id, name }]`
|
||||
* @returns {object[]}
|
||||
*/
|
||||
export function snapshotDshModels(entries) {
|
||||
const list = Array.isArray(entries) ? entries : [];
|
||||
const out = [];
|
||||
for (const m of list) {
|
||||
const provider = typeof m?.provider === 'string' ? m.provider : '';
|
||||
const model = typeof m?.id === 'string' ? m.id : '';
|
||||
if (!provider || !model) continue;
|
||||
out.push({
|
||||
provider,
|
||||
model,
|
||||
display_name: typeof m?.name === 'string' ? m.name : '',
|
||||
});
|
||||
}
|
||||
return dedupeAndCap(out);
|
||||
}
|
||||
|
||||
/**
|
||||
* 决定这一轮按什么顺序尝试模型。
|
||||
*
|
||||
* 三种情形:
|
||||
*
|
||||
* 1. **管理员划定了范围** → 按 rank 顺序(服务端已排好),逐个降级
|
||||
* 2. **没划定范围**(`allowed` 为空)→ 返回 `[undefined]`,
|
||||
* 表示「用平台自己的默认模型试一次」。**不是**空数组:
|
||||
* 空数组会让调用方一次都不试,等于让 Agent 彻底哑掉,
|
||||
* 而「管理员没配」的正确含义是不限定。
|
||||
* 3. **插件配了 `AGENTMAIL_REPLY_PROVIDER`/`MODEL`** → 那是部署方的显式指定,
|
||||
* 优先于「平台默认」,但**不优先于管理员划定的范围**:
|
||||
* 范围是运行时可改的策略,环境变量是部署时的兜底。
|
||||
*
|
||||
* @param {readonly {provider: string, model: string}[]} allowed 管理员划定的范围(按 rank)
|
||||
* @param {{provider?: string, model?: string}|undefined} envDefault 环境变量指定的模型
|
||||
* @returns {(({provider: string, model: string})|undefined)[]} 依次尝试的候选;
|
||||
* `undefined` 表示这一次不指定模型、交给平台
|
||||
*/
|
||||
export function modelAttemptOrder(allowed, envDefault) {
|
||||
const list = Array.isArray(allowed) ? allowed.filter(m => m?.provider && m?.model) : [];
|
||||
if (list.length > 0) return list.map(m => ({ provider: m.provider, model: m.model }));
|
||||
if (envDefault?.provider && envDefault?.model) {
|
||||
return [{ provider: envDefault.provider, model: envDefault.model }];
|
||||
}
|
||||
return [undefined];
|
||||
}
|
||||
|
||||
/**
|
||||
* 把多次尝试的失败原因整理成一封邮件正文。
|
||||
*
|
||||
* 全部失败时必须发这封信:模型一次都没跑起来,会话里没有任何 assistant 消息,
|
||||
* 自动转发因此什么也不会发 —— 发件人只会看到邮件发出去后再无音讯。
|
||||
*
|
||||
* @param {{provider?: string, model?: string, error: string}[]} failures 每次尝试的失败
|
||||
* @param {string} subject 原邮件主题
|
||||
* @returns {string} Markdown 正文
|
||||
*/
|
||||
export function renderFailureReport(failures, subject) {
|
||||
const list = Array.isArray(failures) ? failures : [];
|
||||
const lines = [
|
||||
`本次未能处理「${subject || '(无主题)'}」:划定范围内的模型全部调用失败。`,
|
||||
'',
|
||||
`已尝试 ${list.length} 个:`,
|
||||
'',
|
||||
];
|
||||
list.forEach((f, i) => {
|
||||
const route = f?.provider && f?.model ? `${f.provider}/${f.model}` : '(平台默认模型)';
|
||||
lines.push(`${i + 1}. **${route}**`);
|
||||
// 缩进四格让报错原文成为代码块,避免其中的 Markdown 字符影响排版
|
||||
lines.push(` ${String(f?.error ?? '未知错误').replace(/\n/g, '\n ')}`);
|
||||
});
|
||||
lines.push('');
|
||||
lines.push('可能的原因:模型已下线、API key 失效、上游限流,或该 provider 未在平台侧配置。');
|
||||
lines.push('调整可用模型范围:配置页 → Agent 模型范围。');
|
||||
return lines.join('\n');
|
||||
}
|
||||
|
||||
/** 去重(provider/model 组合)并截断。 */
|
||||
function dedupeAndCap(list) {
|
||||
const seen = new Set();
|
||||
const out = [];
|
||||
for (const m of list) {
|
||||
const key = `${m.provider}/${m.model}`;
|
||||
if (seen.has(key)) continue;
|
||||
seen.add(key);
|
||||
out.push(m);
|
||||
if (out.length >= MAX_CATALOG) break;
|
||||
}
|
||||
return out;
|
||||
}
|
||||
207
plugins/opencode-mail-bridge/test/model-scope.test.mjs
Normal file
207
plugins/opencode-mail-bridge/test/model-scope.test.mjs
Normal file
@ -0,0 +1,207 @@
|
||||
/**
|
||||
* 模型范围与降级尝试的测试。
|
||||
*
|
||||
* 最要紧的一条:范围为空时必须返回 `[undefined]`(试一次平台默认)而不是 `[]`。
|
||||
* 返回空数组会让调用方一次都不试,等于「管理员没配」就把 Agent 彻底哑掉。
|
||||
*
|
||||
* node --test 'test/*.test.mjs'
|
||||
*/
|
||||
|
||||
import { test } from 'node:test';
|
||||
import assert from 'node:assert/strict';
|
||||
import {
|
||||
snapshotOpencodeModels,
|
||||
snapshotDshModels,
|
||||
modelAttemptOrder,
|
||||
renderFailureReport,
|
||||
MAX_CATALOG,
|
||||
} from '../lib/model-scope.js';
|
||||
|
||||
// ─── opencode 目录 ───
|
||||
|
||||
const ocConfig = {
|
||||
providers: [
|
||||
{
|
||||
id: 'llmsproxy',
|
||||
models: {
|
||||
AUTO: { name: 'AUTO (smart routing)' },
|
||||
'claude-sonnet-4-6': { name: 'claude-sonnet-4-6' },
|
||||
},
|
||||
},
|
||||
{ id: 'huawei', models: { 'deepseek-v4-flash': { name: 'dpkv4' } } },
|
||||
],
|
||||
};
|
||||
|
||||
test('opencode 目录拍平 provider × model', () => {
|
||||
const got = snapshotOpencodeModels(ocConfig);
|
||||
assert.equal(got.length, 3);
|
||||
assert.deepEqual(got[0], {
|
||||
provider: 'llmsproxy',
|
||||
model: 'AUTO',
|
||||
display_name: 'AUTO (smart routing)',
|
||||
});
|
||||
});
|
||||
|
||||
test('models 是对象而非数组(键是 model id)', () => {
|
||||
// 实测 opencode 的 /config/providers 返回 { models: { "AUTO": {...} } }。
|
||||
// 当成数组处理会得到零条目而不是报错。
|
||||
const got = snapshotOpencodeModels(ocConfig);
|
||||
assert.ok(got.some(m => m.model === 'claude-sonnet-4-6'));
|
||||
});
|
||||
|
||||
test('无 id 的 provider 被跳过', () => {
|
||||
const got = snapshotOpencodeModels({
|
||||
providers: [{ models: { a: {} } }, { id: 'ok', models: { b: {} } }],
|
||||
});
|
||||
assert.equal(got.length, 1);
|
||||
assert.equal(got[0].provider, 'ok');
|
||||
});
|
||||
|
||||
test('缺 name 时 display_name 为空串而不是 undefined', () => {
|
||||
const got = snapshotOpencodeModels({ providers: [{ id: 'p', models: { m: {} } }] });
|
||||
assert.equal(got[0].display_name, '');
|
||||
});
|
||||
|
||||
test('opencode 目录容错:结构缺失不崩', () => {
|
||||
assert.deepEqual(snapshotOpencodeModels(undefined), []);
|
||||
assert.deepEqual(snapshotOpencodeModels({}), []);
|
||||
assert.deepEqual(snapshotOpencodeModels({ providers: 'oops' }), []);
|
||||
assert.deepEqual(snapshotOpencodeModels({ providers: [{ id: 'p', models: null }] }), []);
|
||||
});
|
||||
|
||||
// ─── DSH 目录 ───
|
||||
|
||||
test('DSH 目录用 provider + id', () => {
|
||||
const got = snapshotDshModels([
|
||||
{ provider: 'llmsproxy', id: 'AUTO', name: 'AUTO' },
|
||||
{ provider: 'deepseek', id: 'chat', name: 'DeepSeek Chat' },
|
||||
]);
|
||||
assert.equal(got.length, 2);
|
||||
assert.deepEqual(got[1], { provider: 'deepseek', model: 'chat', display_name: 'DeepSeek Chat' });
|
||||
});
|
||||
|
||||
test('DSH 目录跳过缺 provider 或 id 的条目', () => {
|
||||
const got = snapshotDshModels([
|
||||
{ provider: '', id: 'x' },
|
||||
{ provider: 'p', id: '' },
|
||||
{ provider: 'p', id: 'ok' },
|
||||
]);
|
||||
assert.equal(got.length, 1);
|
||||
assert.equal(got[0].model, 'ok');
|
||||
});
|
||||
|
||||
test('重复的 provider/model 组合去重', () => {
|
||||
const got = snapshotDshModels([
|
||||
{ provider: 'p', id: 'm', name: '第一次' },
|
||||
{ provider: 'p', id: 'm', name: '第二次' },
|
||||
]);
|
||||
assert.equal(got.length, 1);
|
||||
assert.equal(got[0].display_name, '第一次');
|
||||
});
|
||||
|
||||
test('目录截断到 MAX_CATALOG', () => {
|
||||
const many = Array.from({ length: MAX_CATALOG + 20 }, (_, i) => ({
|
||||
provider: 'p', id: `m${i}`, name: `M${i}`,
|
||||
}));
|
||||
assert.equal(snapshotDshModels(many).length, MAX_CATALOG);
|
||||
});
|
||||
|
||||
// ─── modelAttemptOrder ───
|
||||
|
||||
test('管理员划定范围时按 rank 顺序尝试', () => {
|
||||
const got = modelAttemptOrder(
|
||||
[{ provider: 'a', model: '1' }, { provider: 'b', model: '2' }],
|
||||
{ provider: 'env', model: 'x' }
|
||||
);
|
||||
assert.deepEqual(got, [
|
||||
{ provider: 'a', model: '1' },
|
||||
{ provider: 'b', model: '2' },
|
||||
]);
|
||||
});
|
||||
|
||||
test('不变量:范围为空时返回 [undefined] 而不是 []', () => {
|
||||
// 返回空数组会让调用方一次都不试 —— 「管理员没配」的正确含义是不限定,
|
||||
// 不是「一个都不许用」。后者等于让 Agent 彻底哑掉。
|
||||
const got = modelAttemptOrder([], undefined);
|
||||
assert.equal(got.length, 1, `应有一次尝试,实际 ${got.length}`);
|
||||
assert.equal(got[0], undefined, 'undefined 表示交给平台自己选');
|
||||
});
|
||||
|
||||
test('范围为空但有环境变量时用环境变量', () => {
|
||||
const got = modelAttemptOrder([], { provider: 'llmsproxy', model: 'AUTO' });
|
||||
assert.deepEqual(got, [{ provider: 'llmsproxy', model: 'AUTO' }]);
|
||||
});
|
||||
|
||||
test('不变量:范围优先于环境变量', () => {
|
||||
// 范围是运行时可改的策略,环境变量是部署时的兜底。
|
||||
// 反过来的话管理员在配置页改了范围却不生效,得去改 service 文件重启。
|
||||
const got = modelAttemptOrder(
|
||||
[{ provider: 'chosen', model: 'm' }],
|
||||
{ provider: 'env', model: 'x' }
|
||||
);
|
||||
assert.equal(got.length, 1);
|
||||
assert.equal(got[0].provider, 'chosen');
|
||||
});
|
||||
|
||||
test('过滤掉范围里字段不全的项', () => {
|
||||
const got = modelAttemptOrder(
|
||||
[{ provider: 'a', model: '' }, { provider: '', model: '1' }, { provider: 'ok', model: 'm' }],
|
||||
undefined
|
||||
);
|
||||
assert.deepEqual(got, [{ provider: 'ok', model: 'm' }]);
|
||||
});
|
||||
|
||||
test('环境变量只给一半时不采用', () => {
|
||||
assert.deepEqual(modelAttemptOrder([], { provider: 'p' }), [undefined]);
|
||||
assert.deepEqual(modelAttemptOrder([], { model: 'm' }), [undefined]);
|
||||
});
|
||||
|
||||
test('modelAttemptOrder 容错非数组', () => {
|
||||
assert.deepEqual(modelAttemptOrder(undefined, undefined), [undefined]);
|
||||
assert.deepEqual(modelAttemptOrder('oops', undefined), [undefined]);
|
||||
});
|
||||
|
||||
// ─── renderFailureReport ───
|
||||
|
||||
test('失败报告列出每次尝试的路由与原因', () => {
|
||||
const got = renderFailureReport(
|
||||
[
|
||||
{ provider: 'llmsproxy', model: 'AUTO', error: '429 Too Many Requests' },
|
||||
{ provider: 'huawei', model: 'dpk', error: 'connect ECONNREFUSED' },
|
||||
],
|
||||
'缓存选型'
|
||||
);
|
||||
assert.match(got, /缓存选型/);
|
||||
assert.match(got, /已尝试 2 个/);
|
||||
assert.match(got, /llmsproxy\/AUTO/);
|
||||
assert.match(got, /429 Too Many Requests/);
|
||||
assert.match(got, /huawei\/dpk/);
|
||||
assert.match(got, /ECONNREFUSED/);
|
||||
});
|
||||
|
||||
test('没有路由信息时标为平台默认模型', () => {
|
||||
const got = renderFailureReport([{ error: 'boom' }], '主题');
|
||||
assert.match(got, /平台默认模型/);
|
||||
});
|
||||
|
||||
test('失败报告给出可操作的下一步', () => {
|
||||
// 只报错误不说怎么办,收信的人只能来问。
|
||||
const got = renderFailureReport([{ error: 'x' }], '主题');
|
||||
assert.match(got, /配置页/);
|
||||
});
|
||||
|
||||
test('多行报错缩进后不破坏 Markdown 排版', () => {
|
||||
const got = renderFailureReport([{ error: 'line1\nline2' }], '主题');
|
||||
// 第二行也要带缩进,否则会脱离代码块、其中的字符被当作 Markdown 解析
|
||||
assert.match(got, / line1\n line2/);
|
||||
});
|
||||
|
||||
test('空主题有兜底', () => {
|
||||
assert.match(renderFailureReport([{ error: 'x' }], ''), /\(无主题\)/);
|
||||
assert.match(renderFailureReport([{ error: 'x' }], undefined), /\(无主题\)/);
|
||||
});
|
||||
|
||||
test('renderFailureReport 容错非数组', () => {
|
||||
const got = renderFailureReport(undefined, '主题');
|
||||
assert.match(got, /已尝试 0 个/);
|
||||
});
|
||||
Reference in New Issue
Block a user