#AI
Agent harness 正被模型吸收进权重
AI 工程师在 2025 年圣诞节前后注意到 agent 突然「变好用了」,但没人说得清原因。这篇长文给出的答案是:不是模型单独越过了能力门槛,而是模型与 harness 两条能力曲线在那个时间点**交叉**——模型终于可靠到足以承接此前 harness 过早赋予它的自主性。
作者用可量化的证据支撑「agent 一半靠 harness」:同一模型、同一 106 个任务在不同 harness 下分数从 52.4 到 76.2,跨度 23.8 分。而接下来发生的是 harness 被**吸收进模型权重**——比如 OpenAI 称 GPT-5.1-Codex-Max 是首个原生训练成能跨上下文窗口压缩的模型;Anthropic 团队则删掉了 Claude Code 系统提示的约 80%。
💡 为什么值得看agent 突然好用的演化链解析,预判 harness 将转向争夺注意力。
查证
来源档案
Latent Space
AI 工程圈知名技术博客,本文是其主编的长篇观点文章
可信度较高,观点有内部访谈与 benchmark 数据支撑,但属单一作者的分析性推演,预测部分未经时间检验
延伸阅读
train→absorb→shed→repeat 是全文最内核的机制解释,理解这个循环才能看懂「删系统提示 80%」这类动作的意义