Files
HomeAgent/internal/agent/core/tokenbudget.go
root 1cb3e87dde feat: 完整实现 NLP 三元组提取系统 + token budget 上下文分配
- 重写 extractor.go: 分句、17条 POS 模板、依存模板 + COO 链、ATT合并
- parser.go: 分句循环 + TransE 向量验证(h+r≈t)
- fallback.go: jieba POS 降级解析器
- bridge.go: nlp.Triple ↔ memory.Triple 转换
- pipeline.go: extractKeyTriples 改用 NLP 提取器, 删除5条旧前缀规则
- distill.go: docToTriples 改用 NLP 提取器
- reorgGraph: 语义相似度增强检测, 保持纯 LLM 决断
- Provider 接口加 MaxContextTokens() + 模型窗口映射表
- tokenbudget.go: 中文 token 估算器 + budget 分配(80%利用率)
- process.go/buildSystemPrompt: 按 token 预算截断 memory+timeline
2026-07-27 15:26:23 +08:00

87 lines
2.2 KiB
Go
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

package core
import (
"unicode/utf8"
"gitcode.com/JianFeeeee/HomeAgent/internal/agent/api"
)
// TokenBudget 上下文 token 预算分配结果
type TokenBudget struct {
MaxContext int // 模型窗口上限
TargetUsage int // 目标使用量max * utilizationRate
FixedTokens int // 固定部分system prompt base + tools + rules
MemoryTokens int // memory context 可用预算
ContextTokens int // 上下文事件可用预算
Reserved int // 预留response 空间)
}
// EstimateTokens 粗略估算 token 数
// 中文 ~1.5 token/字,英文 ~0.3 token/字符
// 保守估计取 max(1, runeCount * 2),对混合文本足够安全
func EstimateTokens(text string) int {
if text == "" {
return 0
}
runeCount := utf8.RuneCountInString(text)
if runeCount == 0 {
return 0
}
t := runeCount * 2
if t < 1 {
return 1
}
return t
}
// ComputeTokenBudget 计算各部分的 token 预算
// utilizationRate 为目标窗口利用率0.0-1.0),预留 1-utilizationRate 给 response
// 固定部分优先保障,剩余预算 1:2 分配给 memory context 和 context events
func ComputeTokenBudget(provider api.Provider, systemPromptBase string) TokenBudget {
maxCtx := provider.MaxContextTokens()
if maxCtx <= 0 {
maxCtx = 32768
}
utilizationRate := 0.8
targetUsage := int(float64(maxCtx) * utilizationRate)
reserved := maxCtx - targetUsage
fixedTokens := EstimateTokens(systemPromptBase)
available := targetUsage - fixedTokens
if available < 0 {
available = 0
}
// memory context 占 1/3context events 占 2/3
memTokens := available / 3
ctxTokens := available - memTokens
return TokenBudget{
MaxContext: maxCtx,
TargetUsage: targetUsage,
FixedTokens: fixedTokens,
MemoryTokens: memTokens,
ContextTokens: ctxTokens,
Reserved: reserved,
}
}
// TruncateByTokens 截断字符串至不超过 maxTokens 估计值
func TruncateByTokens(s string, maxTokens int) string {
if maxTokens <= 0 || s == "" {
return ""
}
runes := []rune(s)
if len(runes)*2 <= maxTokens {
return s
}
// 从开头保留 maxTokens/2 个字符(每个字符约 2 token
keep := maxTokens / 2
if keep >= len(runes) {
return s
}
return string(runes[:keep])
}