Add model iteration skill

This commit is contained in:
武阳
2026-05-09 12:18:06 +08:00
parent 95c265d2a1
commit 6a58eb55fe
9 changed files with 2064 additions and 0 deletions
@@ -0,0 +1,21 @@
# 多指令 vs ComplexTask 分流规则
## 核心判定
| 场景 | 输出 | 示例 |
|------|------|------|
| 多个独立命令拼在一句话里 | 多个 `Agent(...)` | "导航到大姚县打开微信播放音乐" → 3个Agent |
| 单个任务涉及多步骤/多目的地 | `ComplexTask(tag="...")` | "先去加油站再去机场" → 1个ComplexTask |
## 判定要点
- **多指令(Multi-command)≠ ComplexTask**:用户在一句话中说了多个独立的命令(导航+播放+打电话+控制),每个命令应该独立解析为各自的 Agent,不是一个 ComplexTask
- **ComplexTask 是单任务多步**:只有当一个任务本身需要多步规划时才是 ComplexTask(如多目的地导航、带筛选条件的旅游规划)
- **"然后"不一定是 ComplexTask 信号**:如果"然后"连接的是不同领域的独立命令(导航+控制+播放),那是多指令;只有"然后"连接同一任务的多个步骤(先去A再去B)才是 ComplexTask
## 识别方法
- output 中有多个 `Agent(...)` 调用 → 多指令,保持不变
- output 中只有一个调用但 query 含多目的地 → 可能应该是 ComplexTask
- query 中"然后/再/接着"连接不同 tag 的任务 → 多指令
- query 中"然后/再/接着"连接同 tag 的多个地点 → ComplexTask
@@ -0,0 +1,21 @@
# 地图导航 Agent / ComplexTask 分流规则
## 核心判定逻辑
| 场景 | 输出 | 示例 |
|------|------|------|
| 单POI + 任意数量形容词 | `Agent(tag="地图导航")` | 导航去最近的加油站、去附近最便宜的停车场 |
| 多POI(多个目的地) | `ComplexTask(tag="地图导航")` | 先去加油站再去机场接人 |
| 单POI + 一句话描述当前状态 | `ComplexTask(tag="地图导航")` | 加完油再去机场("加完油"描述当前状态) |
## 判定要点
- **形容词不影响分流**:不管加多少形容词修饰(最近的、便宜的、大的),只要是单POI就是 Agent
- **多目的地 = Complex**:只要 query 中出现多个地点/动作序列,就是 ComplexTask
- **状态描述 = Complex**:单POI 但前面带了一句描述当前状态的话(如"加完油"、"吃完饭"),说明用户在做多步规划,属于 ComplexTask
## 应用场景
- 数据增强时:按此规则标注 ground_truth
- Badcase 分析时:以此为标准区分"分流错误"和"语义错误"
- Reward 函数:分流违反此规则的应被惩罚
@@ -0,0 +1,26 @@
# 旅游 Agent / ComplexTask 分流规则
## 核心判定逻辑
| 场景 | 输出 | 示例 |
|------|------|------|
| 规划路线,无筛选条件 | `Agent(tag="旅游出行")` | 规划一个从北京到上海的路线 |
| 规划路线,有筛选条件 | `ComplexTask(tag="旅游出行")` | 规划一个从北京到上海的路线,人少风景好、三天两夜、3000预算 |
## 判定要点
- **无条件纯路线规划 = Agent**:只要求从A到B的路线,没有额外约束
- **带筛选/约束条件 = Complex**:路线规划附带了时间、预算、偏好、天数等任何筛选条件,说明需要多维度规划,属于 ComplexTask
## 筛选条件举例
- 时间约束:三天两夜、五一假期、周末
- 预算约束:3000预算、经济型
- 偏好约束:人少、风景好、适合亲子、有美食
- 交通约束:自驾、高铁优先
## 应用场景
- 数据增强时:按此规则标注 ground_truth
- Badcase 分析时:以此为标准区分"分流错误"和"语义错误"
- Reward 函数:分流违反此规则的应被惩罚