SkillLens:从原始经验到可消费的 Agent Skill

来源:复旦大学、Microsoft Research、上海交通大学研究者联合完成(2026 年论文)
论文:arXiv:2605.23899
开源框架:microsoft/SkillLens
项目主页:microsoft.github.io/SkillLens


为什么一份看起来正确的 Skill,会让 Agent 表现更差?

这是 SkillLens 研究的核心出发点。

传统思路下,我们倾向于认为:只要 Skill 文本写得足够完整、逻辑足够清晰、像专家一样严谨,Agent 就能从中获益。但 SkillLens 的研究结论直接打破了这一直觉——文本质量 ≠ 真实任务效用。

SkillLens 把 Skill 开发从「写提示词」转成「经验工程与配对评测」:不是审阅文本像不像专家,而是追踪经验如何生成、被谁提炼、再被哪个模型消费。

阅读更多

控制循环的艺术 —— 从 ReAct 到 Graph Engineering

2026 上半年到 7 月,社区又给「控制循环」造了好几个新词。把时间线拉出来看就会发现,换的只是名字,讨论的始终是同一件事——怎么控制一个循环:

时间 概念 关键词
2022-10 ReAct Thought / Action / Observation
2025-2026 ReAct Engineering Prompt / Context / Harness Eng
2026-H1 Loop Engineering verification / trigger / rollout loops
2026-07 Graph Engineering explicit nodes / edges / state
阅读更多