Files
zk-data-agent/skills/label-master/knowledge/边界
2026-06-08 14:43:44 +08:00
..
2026-06-08 14:43:44 +08:00
2026-05-09 17:49:53 +08:00
2026-05-09 17:49:53 +08:00
2026-05-09 17:49:53 +08:00

边界说明

这里维护跨标签、跨领域的易混淆边界。边界知识的优先级高于自动迁移出来的标签卡片片段,但低于用户在当前任务中明确给出的新规则。

目录结构

  • 边界索引.md:边界层的入口,告诉 Agent 遇到哪类 query 应该读哪个边界文件。
  • 高频混淆/:人工维护的高频混淆边界,是运行时优先读取的边界知识。
  • 领域概览/:从旧标签资料自动迁移出来的领域边界概览,信息有价值,但粒度较粗,主要用于补充背景。

读取顺序

  1. 先读 ../索引/候选召回索引.md边界索引.md,判断是否命中高频混淆。
  2. 如果命中,优先读 高频混淆/ 下的具体边界文件。
  3. 如果没有命中,再读候选标签卡片。
  4. 如果候选仍然不清楚,再读 领域概览/ 对应领域文件。

不要直接全量读取 边界/。自动领域概览不能替代高频混淆卡片。

高频混淆卡片格式

每个高频混淆文件建议包含:

  • 适用场景:哪些 query 或任务会触发这个边界。
  • 候选集合:列出容易混淆的标签、intent 或 function。
  • 决策顺序:Agent 应该按什么问题逐步排除。
  • 关键区分点:动作诉求、资源类型、设备端、上下文、是否需要执行。
  • 输出建议:在 Agent 包装、intent、function program 之间如何处理。
  • 正例/反例:尽量贴近真实 query。
  • 仍需确认:哪些信息缺失时必须问用户。

维护原则

  • 高频边界要写成“判断流程”,不要只写结论。
  • 边界卡片可以引用标签卡片,但不要复制整段标签定义。
  • 当线上 badcase 或数据生成反复撞到同一类混淆时,应新增或更新 高频混淆/ 文件。
  • 自动生成的 领域概览/ 可以保留,但不要在其中人工维护精细规则。