2.9 KiB
本地来源缓存
这里用于研究期间缓存论文 PDF、网页快照与文本抽取。二进制和全文缓存默认被 .gitignore 排除;公开仓库只提交 canonical URL、校验信息、研究笔记和允许再分发的原创内容。
当前锚点:
- Kimi K3 Technical Report https://github.com/MoonshotAI/Kimi-K3/blob/main/k3_tech_report.pdf
- Kimi K3 official repository https://github.com/MoonshotAI/Kimi-K3
- arXiv:2607.24653 https://arxiv.org/abs/2607.24653
语言模型前史首轮缓存位于 language-model-history/(不提交 PDF/TXT):
- Shannon 1948 / 1951;
- Bengio et al. 2003;
- Morin & Bengio 2005;
- Mikolov et al. 2010;
- Luong et al. 2015。
其余已核节点通过 DOI、ACL Anthology、PMLR、ISCA、JMLR、NeurIPS 或官方 arXiv 页面定位,
完整证据边界见 ../LANGUAGE_MODEL_HISTORY_RESEARCH.md。
Alignment 首轮缓存位于 alignment/(不提交 PDF/TXT):
- Christiano 2017、Ziegler 2019、Stiennon 2020 与 InstructGPT;
- Natural Instructions、FLAN、T0、HH-RLHF、Constitutional AI 与 Self-Instruct;
- DPO、RRHF、SLiC-HF、LIMA、RLAIF、UltraFeedback、IPO、KTO、ORPO、RewardBench 与 SimPO。
DeepSeek LLM/V2/V3/R1/V3.2/V4、Kimi K2/K2.5/K3 与 MOPD 复用既有本地缓存。
正式机制、公式、版本边界与 44 节点论文链见 ../ALIGNMENT_RESEARCH.md;Grok 候选线索单独保存在
../ALIGNMENT_GROK_LEADS.md,不能直接作为正文证据。
Agent 首轮缓存位于 agents/(不提交 PDF/TXT):
- TextWorld、Jericho、ALFWorld、ScienceWorld、WebShop 等可执行环境前史;
- WebGPT、SayCan、ReAct、Toolformer、Reflexion、ToolLLM、WebArena、SWE-agent 与 OSWorld;
- τ-bench / τ²-bench、AgentDojo、ToolSandbox、BFCL、RAGEN、Agent Lightning 与 AgentENV;
- DeepSeek-V3.2/V4、Kimi K2/K2.5/K3 等模型族报告中的 Agent 数据、harness、验证器与长轨迹系统。
首轮共核验 35 份新增 PDF,其中 BFCL 使用 ICML/PMLR 正式版本;DeepSeek、Kimi 与部分既有节点
复用其他专题缓存。十四张问题账、52 节点论文链、四个交互实验合同与证据边界见
../AGENTS_RESEARCH.md;Grok Headless 只负责扩展召回,未核验候选永久隔离在
../AGENTS_GROK_LEADS.md。
原生多模态首轮缓存位于 multimodal/(不提交 PDF/TXT):
- ResNet、ViT、ALIGN、CLIP、LiT、BLIP、SigLIP 与 NaViT;
- DeepSeek-VL2、Janus-Pro、DeepSeek-OCR、DeepSeek-OCR2 与 Kimi-VL;
- Kimi K2.5 与 K3 复用
reasoning/、kimi-k3/中的官方技术报告缓存。
本轮本地完整校验 13 份 PDF,并通过官方 arXiv HTML、作者仓库和既有 K2.5/K3 报告核验其余核心节点。
DeepSeek-VL/VL2、Janus、OCR 三分支,Kimi 三代 MoonViT、十六张问题账、55 节点正文链与四实验合同见
../MULTIMODAL_RESEARCH.md;Grok Headless 候选召回只保存在
../MULTIMODAL_GROK_LEADS.md,不得作为正式事实来源。