Refresh papers and define Agent evaluation
This commit is contained in:
@@ -13,7 +13,11 @@
|
||||
- [Exploration History](docs/07-exploration-history.md): 已尝试、已失败和保留的判断
|
||||
- [Next Work](docs/08-next-work.md): 下一阶段优先级和明确非目标
|
||||
|
||||
当前最重要的边界:这里已经有大规模资料库和可运行的 Atlas,但还没有完成“从论文到个人知识内化”的状态化学习系统。旧的 12 篇 Agent Memory 学习模块已判定失败;当前研究基线是 [Memory findings](research/memory/findings.md) 和 [evidence ledger](research/memory/evidence-ledger.md)。
|
||||
当前最重要的边界:这里已经有 1125 篇论文和可运行的 Atlas,但绝大多数论文仍是
|
||||
`queued`,还没有完成“原始论文 -> 可比较知识单元 -> 领域结构 -> 个人判断”的知识漏斗。
|
||||
旧的 12 篇 Agent Memory 学习模块已判定失败;当前证据基线是
|
||||
[Memory findings](research/memory/findings.md) 和
|
||||
[evidence ledger](research/memory/evidence-ledger.md)。
|
||||
|
||||
## Navigation
|
||||
|
||||
@@ -30,6 +34,8 @@
|
||||
- [Jobs](jobs/README.md): 北京大厂 Agent / LLM 相关岗位要求
|
||||
- [Papers](papers/README.md): Agent 相关论文、阅读队列和研究洞察
|
||||
- [Research](research/README.md): 跨论文时间对照、受控证据和领域判断
|
||||
- [Agent Evaluation v1](research/evaluation/k1412-agent-evaluation-v1.md): 面向
|
||||
`zk-data-agent` 的任务契约、独立判分、版本对照和发布门禁
|
||||
- [Learning](learning/README.md): 从论文编译出的认知地图、讲义、证据和主动回忆模块
|
||||
- [Industry](industry/README.md): 大公司 Agent 工作、技术报告和工程博客
|
||||
- [Projects](projects/README.md): 项目目录、项目记录和复盘
|
||||
|
||||
Reference in New Issue
Block a user