边界说明
这里维护跨标签、跨领域的易混淆边界。边界知识的优先级高于自动迁移出来的标签卡片片段,但低于用户在当前任务中明确给出的新规则。
目录结构
边界索引.md:边界层的入口,告诉 Agent 遇到哪类 query 应该读哪个边界文件。高频混淆/:人工维护的高频混淆边界,是运行时优先读取的边界知识。领域概览/:从旧标签资料自动迁移出来的领域边界概览,信息有价值,但粒度较粗,主要用于补充背景。
读取顺序
- 先读
../索引/候选召回索引.md或边界索引.md,判断是否命中高频混淆。 - 如果命中,优先读
高频混淆/下的具体边界文件。 - 如果没有命中,再读候选标签卡片。
- 如果候选仍然不清楚,再读
领域概览/对应领域文件。
不要直接全量读取 边界/。自动领域概览不能替代高频混淆卡片。
高频混淆卡片格式
每个高频混淆文件建议包含:
- 适用场景:哪些 query 或任务会触发这个边界。
- 候选集合:列出容易混淆的标签、intent 或 function。
- 决策顺序:Agent 应该按什么问题逐步排除。
- 关键区分点:动作诉求、资源类型、设备端、上下文、是否需要执行。
- 输出建议:在 Agent 包装、intent、function program 之间如何处理。
- 正例/反例:尽量贴近真实 query。
- 仍需确认:哪些信息缺失时必须问用户。
维护原则
- 高频边界要写成“判断流程”,不要只写结论。
- 边界卡片可以引用标签卡片,但不要复制整段标签定义。
- 当线上 badcase 或数据生成反复撞到同一类混淆时,应新增或更新
高频混淆/文件。 - 自动生成的
领域概览/可以保留,但不要在其中人工维护精细规则。