AI · MODEL / AGENT / HARNESS
INDEX
AI 应用 · 初学者导览

从模型到 Agent,
再到 Harness

用一个“生成月度经营简报”的例子,看懂 AI 怎样从回答问题,走到可靠完成任务。

MODEL → AGENT → HARNESS
先从一个真实任务开始

例:用 4 个表格生成 8 月经营简报

brief-2026-08.md待人工确认
销售小计224 万成本161 万毛利小计63 万
⚠ 华东销售表缺失来源已标注
01sales-north.xlsx华北销售:128 万
02sales-south.xlsx华南销售:96 万
03costs.xlsx本月成本:161 万
04sales-east.xlsx文件缺失:不能当作 0
明确目标:读取这些文件,计算已有区域小计,缺失项必须标记,最后只保存草稿。
先分清两个概念

AI 应用,不等于一个模型

🧠模型判断异常、写说明
上下文4 个文件名+任务目标
工具read_sheet / calculate / write_file
运行规则缺文件就标记;只能写 drafts/
四项组合后的真实产物/output/drafts/brief-2026-08.md
第一部分 · 认识模型

不同模型,擅长不同任务

MODEL理解 · 生成
文 字把“销售 224 万”写成摘要
推 理核对 128+96=224
代 码生成一段表格对账脚本
多模态读取报表截图中的图表

先拿自己的 3 个小任务分别试一次:总结、计算、看图。结果比排行榜更能说明是否合适。

国内优先 · 从常见模型家族开始

先认识家族,再按任务试用

智谱

GLM

例:企业知识问答

腾讯

混元

例:腾讯云业务接入

百度

文心

例:搜索与知识问答

稀宇科技

MiniMax

例:语音或视频生成

以官方最新能力为准:Qwen ↗DeepSeek ↗Kimi ↗豆包 ↗
模型能回答,但默认不能行动

把真实要求直接发给模型,会发生什么?

你的问题

请读取 /shared/2026-08/*.xlsx,计算销售额,并保存为 brief-2026-08.md。

模型回答

我无法访问你的共享盘。你可以上传文件,我再帮你分析。

×没有 list_files,无法发现文件
×没有 read_sheet,无法读取 128 万
×没有 write_file,无法真的保存草稿
缺的不是更长的提示词,而是“观察、行动、检查”的能力。
先不要急着做 Agent

任务越不确定,系统越需要自主判断

01一次回答

“把这段会议记录总结成 3 点”

用模型
02步骤固定

“读固定 CSV → 画图 → 保存 PDF”

用工作流
03步骤会变化

“缺文件时,判断等待、跳过还是标记”

用 Agent

Agent 的价值不是“更像人”,而是能根据环境变化,决定下一步行动。

第二部分 · 什么是 Agent

Agent = 围绕目标不断做决定

目标brief-2026-08.md
01观察list_files → 缺华东表
02计划不猜数,生成不完整草稿
03行动read_sheet → calculate
04检查224=128+96
观察计划行动检查
一次真实执行 · 工具调用记录

Agent 到底调用了什么?

1list_files(path)→ north, south, costs
→ east: NOT_FOUND
2read_sheet(file, B2)→ north: 1,280,000
→ south: 960,000
3calculate(expr)→ 1,280,000+960,000
→ 2,240,000
4write_file(path)→ /output/drafts/
brief-2026-08.md
sales-east.xlsx 未找到没有补 0草稿中写入“华东数据待补”
一个可以真正实现的完整 Agent 写法

把目标、工具、步骤和边界一次写清

name: monthly-brief-agent
goal: 生成 2026-08 经营简报草稿

input:
  path: /shared/2026-08
  required: [north, south, east, costs]

tools:
  - list_files
  - read_sheet
  - calculate
  - write_file

steps:
  1. 检查必需文件
  2. 读取销售额和成本
  3. 计算合计并核对分项
  4. 生成 Markdown 草稿
rules:
  - 缺文件时不得填 0 或猜测
  - 每个数字必须标注文件和单元格
  - 只能写 /output/drafts
  - 禁止发送邮件

output:
  file: brief-2026-08.md
  contains:
    - sales_and_costs
    - missing_items
    - source_cells

done_when:
  totals_checked: true
  draft_exists: true

human_approval: 发布前确认
01
Goal最终要交付什么
02
Input允许读取哪些输入
03
Tools + Steps能调用什么、按什么顺序开始
04
Rules遇到缺失和高风险动作怎么办
05
Done + Approval怎样才算完成,何时必须找人
Agent 裸奔时,问题很快出现

会行动,不等于行动可靠

01读错文件read_sheet("2026-07.xlsx")
02把缺失当作零east: NOT_FOUND → 0
03假装成功"saved": true,但文件不存在
04重复调用tool_call #21 → #22 → …
05越权发布send_email() 未经批准
06无法追溯销售 224 万(无文件/单元格)
Agent 能力越强,边界、记录、检查和停止条件就越重要。
第三部分 · Harness 为什么出现

从一次真实失败,看 Harness 为什么出现

V1只有模型只给出简报模板,没读文件
V2加上工具真的读了文件,但误读 7 月表
V3加长提示词规则太多,换模型后漏掉停止条件
解法把可靠性移到系统权限、检查、状态、日志、审批
Harness把不能遗漏的规则放在模型外面,每次运行都强制执行。
Harness 把 Agent 放进可控环境

让“能做”变成“可放心使用”

AGENT观察 ↺ 计划 ↺ 行动 ↺ 检查
01上下文/shared/2026-08/*.xlsx
02工具接口list_files / read_sheet / write_file
03权限边界共享盘只读,drafts 可写
04状态记录state.json 记录当前步骤
05检查与日志合计对账,每个数字有来源
06停止与人工20 次上限,发布前批准
模型可以更换·工具可以增加·运行规则保持稳定
一份真正可执行的 Harness 配置

配置生效后,运行记录会长这样

workspace:
  read: /shared/2026-08/**
  write: /output/drafts/**
deny: [delete_file, send_email]
max_tool_calls: 20
checks:
  - total == sum(regions)
  - every_number.has_source
on_missing_file: stop_and_report
publish: human_approval
RUN LOGmonthly-brief-agent

list_files3 / 4 required files found

BLOCKsales-east.xlsx missing

CHECK2,240,000 = 1,280,000 + 960,000

WRITE/output/drafts/brief-2026-08.md

WAITING_APPROVAL未发送邮件
配置阻止了:把缺失当 0、越权发邮件、无限循环留下了:草稿、来源、检查日志、待审批状态
最后,用任务选择合适的层次

从会回答,到可靠行动

1总结一段文字模型
2每天固定生成图表工作流
3缺资料时判断下一步Agent
4必须可审计、可停止Harness
模型能回答 Agent能行动 Harness让行动可靠

先从一个小任务开始,让 AI 只做草稿;确认边界、证据和人工审批之后,再逐步增加自主性。

01 / 15
按空格或方向键开始