Files
2026-05-09 17:49:53 +08:00

38 lines
1.9 KiB
Markdown

# 边界说明
这里维护跨标签、跨领域的易混淆边界。边界知识的优先级高于自动迁移出来的标签卡片片段,但低于用户在当前任务中明确给出的新规则。
## 目录结构
- `边界索引.md`:边界层的入口,告诉 Agent 遇到哪类 query 应该读哪个边界文件。
- `高频混淆/`:人工维护的高频混淆边界,是运行时优先读取的边界知识。
- `领域概览/`:从旧标签资料自动迁移出来的领域边界概览,信息有价值,但粒度较粗,主要用于补充背景。
## 读取顺序
1. 先读 `../索引/候选召回索引.md``边界索引.md`,判断是否命中高频混淆。
2. 如果命中,优先读 `高频混淆/` 下的具体边界文件。
3. 如果没有命中,再读候选标签卡片。
4. 如果候选仍然不清楚,再读 `领域概览/` 对应领域文件。
不要直接全量读取 `边界/`。自动领域概览不能替代高频混淆卡片。
## 高频混淆卡片格式
每个高频混淆文件建议包含:
- 适用场景:哪些 query 或任务会触发这个边界。
- 候选集合:列出容易混淆的标签、intent 或 function。
- 决策顺序:Agent 应该按什么问题逐步排除。
- 关键区分点:动作诉求、资源类型、设备端、上下文、是否需要执行。
- 输出建议:在 Agent 包装、intent、function program 之间如何处理。
- 正例/反例:尽量贴近真实 query。
- 仍需确认:哪些信息缺失时必须问用户。
## 维护原则
- 高频边界要写成“判断流程”,不要只写结论。
- 边界卡片可以引用标签卡片,但不要复制整段标签定义。
- 当线上 badcase 或数据生成反复撞到同一类混淆时,应新增或更新 `高频混淆/` 文件。
- 自动生成的 `领域概览/` 可以保留,但不要在其中人工维护精细规则。