II 版 ◆ Harness 工程 ◆ Harness Engineering
第 II 版 8 章 约 258 分钟 建议顺序 第 2 位
II · Harness 工程
Harness Engineering — 模型之外的一切
本版导读 · Why this section
如果 Agent = Model + Harness,那么 Harness 就是"除模型本身以外的所有工作"。这是整个网站的主战场:循环、工具、上下文、记忆、编排、沙箱、长任务可靠性。每一章都按"原理 → 图解 → 代码 → 面试问答"展开。
目录 · In this section
01 入门
Harness 是什么
Model + Harness = Agent
"除模型本身以外的所有工作,都属于 Harness 的范畴"——这句话划出的地到底有多大?这一章给出一张完整的 Harness 能力地图,后面七章都挂在这张图上。
未读 24 分钟
02 入门
Agent Loop 与终止条件
The Loop and When to Stop
写一个循环谁都会,难的是知道什么时候让它停下来。任务完成、轮数用尽、预算耗尽、无进展、需要人工——五类终止条件缺一不可。
未读 32 分钟
03 进阶
Tool Use 与工具契约
Tools as Contracts
工具不是给人看的 API 文档,而是给模型看的能力契约。描述怎么写、错误怎么回喂、参数怎么校验、MCP 什么时候该用——这一章把工具层讲透。
未读 34 分钟
04 进阶
Context Engineering
What the Model Gets to See
Prompt Engineering 是"怎么说",Context Engineering 是"给它看什么"。上下文预算怎么分、什么常驻什么按需、顺序为什么会影响成本——这一章是效果上限的真正决定因素。
未读 36 分钟
05 进阶
Memory 记忆系统
Remember and Forget
记住什么是能力,忘掉什么才是设计。记忆的写入时机、冲突处理、可解释性与可删除性,决定了它到底是资产还是污染源。
未读 30 分钟
06 深入
Subagent 与多智能体编排
Orchestration
什么时候该多开一个 Agent,什么时候那是自找麻烦?答案是三个词:上下文隔离、并行提速、权限隔离。这一章给出选型标准与常见踩坑。
未读 34 分钟
07 深入
沙箱、权限与提示注入
Sandbox and Trust Boundary
把能力交出去之后,怎么守住边界?外部内容一律视为不可信数据、能力最小化、副作用操作强制确认、全量审计——四层防御缺一层都不够。
未读 32 分钟
08 进阶
长任务与失败恢复
Long-Horizon Reliability
跑着跑着模型不吐字了、上下文满了、进程被关了——这些才是 Harness 工程师每天面对的东西,也是"工程问题"与"研究问题"的分水岭。
未读 36 分钟
其他版块 · Other sections