Agent 工程学习站 做棵大树 出品 · beatree.cn 免费 · 无需登录 · 进度存本机
II 版 Harness 工程 Harness Engineering
第 II 版 8 章 约 258 分钟 建议顺序 第 2 位

II · Harness 工程

Harness Engineering — 模型之外的一切
本版进度 0 / 8
难度跨度 入门 → 深入
全站总章数 22 章
本版导读 · Why this section

如果 Agent = Model + Harness,那么 Harness 就是"除模型本身以外的所有工作"。这是整个网站的主战场:循环、工具、上下文、记忆、编排、沙箱、长任务可靠性。每一章都按"原理 → 图解 → 代码 → 面试问答"展开。

目录 · In this section
01 入门

Harness 是什么

Model + Harness = Agent
"除模型本身以外的所有工作,都属于 Harness 的范畴"——这句话划出的地到底有多大?这一章给出一张完整的 Harness 能力地图,后面七章都挂在这张图上。
未读 24 分钟
02 入门

Agent Loop 与终止条件

The Loop and When to Stop
写一个循环谁都会,难的是知道什么时候让它停下来。任务完成、轮数用尽、预算耗尽、无进展、需要人工——五类终止条件缺一不可。
未读 32 分钟
03 进阶

Tool Use 与工具契约

Tools as Contracts
工具不是给人看的 API 文档,而是给模型看的能力契约。描述怎么写、错误怎么回喂、参数怎么校验、MCP 什么时候该用——这一章把工具层讲透。
未读 34 分钟
04 进阶

Context Engineering

What the Model Gets to See
Prompt Engineering 是"怎么说",Context Engineering 是"给它看什么"。上下文预算怎么分、什么常驻什么按需、顺序为什么会影响成本——这一章是效果上限的真正决定因素。
未读 36 分钟
05 进阶

Memory 记忆系统

Remember and Forget
记住什么是能力,忘掉什么才是设计。记忆的写入时机、冲突处理、可解释性与可删除性,决定了它到底是资产还是污染源。
未读 30 分钟
06 深入

Subagent 与多智能体编排

Orchestration
什么时候该多开一个 Agent,什么时候那是自找麻烦?答案是三个词:上下文隔离、并行提速、权限隔离。这一章给出选型标准与常见踩坑。
未读 34 分钟
07 深入

沙箱、权限与提示注入

Sandbox and Trust Boundary
把能力交出去之后,怎么守住边界?外部内容一律视为不可信数据、能力最小化、副作用操作强制确认、全量审计——四层防御缺一层都不够。
未读 32 分钟
08 进阶

长任务与失败恢复

Long-Horizon Reliability
跑着跑着模型不吐字了、上下文满了、进程被关了——这些才是 Harness 工程师每天面对的东西,也是"工程问题"与"研究问题"的分水岭。
未读 36 分钟
其他版块 · Other sections
  • I 版 · Model Foundations 大模型原理 —— 先看懂发动机(5 章)
  • III 版 · Evaluation Engineering 评测工程 —— 从许愿到工程(5 章)
  • IV 版 · Knowledge Engine 知识引擎 —— 让回答有据可查(4 章)