Skip to content
查看 GitHub 源文件

源文件:https://github.com/lennonli/licheng-AI-tutorials/blob/main/docs/ai-basics-15-harness-ABL-20260831-V1.md

AI入门15|Harness是什么?为什么同一个模型放在不同Agent里,效果会差很多?

上一篇说到:

同一个模型,放进不同Agent里,表现可能完全不同。

这中间有一个越来越常见的词:

Harness。

这个词目前并不是所有厂商都使用完全相同的严格定义,但在Agent语境里,可以先理解成:

把模型、工具、上下文和执行逻辑组织起来,让Agent能够持续工作的那套运行框架。

一、Harness原本是什么意思?

Harness原意有马具、束具、控制装置等含义。

放到AI里很形象:

模型本身很强,但需要一套机制把这种能力“套起来”,让它按照任务目标稳定工作。

二、Harness的核心之一是Agent Loop

传统聊天可能是:

问题 → 模型 → 回答。

Agent则更像:

接到任务 ↓ 判断下一步 ↓ 调用工具 ↓ 得到结果 ↓ 继续判断 ↓ 继续执行 ↓ 直到完成。

这个循环通常被称为:

Agent Loop,智能体循环。

Harness负责组织这个循环以及其中的执行逻辑。

三、为什么只有模型还不够?

比如任务是:

“检查20份合同并生成风险表。”

模型可能很懂合同,但系统还要解决:

文件在哪里?先读什么?太多内容怎么办?文件打不开怎么办?结果保存哪里?

这些都属于:

怎么组织模型完成工作。

四、Harness里通常会有什么?

不同产品会不同,常见包括:

Agent Loop;

工具调用;

上下文管理;

权限和安全规则;

任务状态;

错误重试和恢复;

有时还包括记忆、Skill、Subagent等。

五、这解释了为什么同一模型表现差很多

Agent A的Harness可能只会简单调用工具。

Agent B可能会规划、压缩上下文、重试失败操作、调用Subagent、检查结果。

即使模型一样,完成复杂任务的稳定性也可能完全不同。

所以可以用一个很粗略的理解:

Agent表现 = 模型能力 + Harness能力 + 工具与环境。

六、用代码Agent最容易理解

你说:

“检查这个项目的Bug并修复。”

真正完成任务的过程可能包括:

读代码、搜索项目、运行测试、查看报错、修改文件、再次测试。

这不是模型一次回答完成的,而是Harness持续调度模型与工具完成的。

七、律师工作也一样

一个懂法律的模型如果放进成熟Harness,可以被组织成:

读取项目文件 → 提取问题 → 查询资料 → 修改文档 → 自检 → 输出成果。

价值不只是“模型更聪明”,而是工作被组织起来了。

八、Harness和Agent是不是同一个东西?

不同产品术语边界并不完全一致。

入门阶段可以先这样区分:

模型:提供智能。

Harness:组织模型如何持续工作。

工具:提供外部动作。

Agent:最终呈现出来的任务执行系统。

九、这一篇只需要记住一句话

模型决定AI有多聪明,Harness很大程度上决定这份聪明能不能被稳定地组织起来完成任务。

内容同步自 GitHub 仓库,仅作为工具教程与工作流说明。

CONTACT

联系李成律师

扫描二维码添加微信,沟通法律 AI、非诉业务及相关合作事项。

手机端可点击二维码查看原图并长按识别。

李成律师微信二维码扫码添加微信