跳转至

vivo Agent 系统分析:大模型是大脑不是马,Harness 是 ICU 不是马鞍

Ch01.892 vivo Agent 系统分析:大模型是大脑不是马,Harness 是 ICU 不是马鞍

📊 Level ⭐⭐ | 7.2KB | entities/vivo-agent-brain-body-icu-harness-evolutionary-framework-2026.md

vivo Agent 系统分析:大模型是大脑不是马,Harness 是 ICU 不是马鞍

vivo 互联网项目团队 Jiang Zuohan 提出以 "大模型是大脑,Agent 是身体" 替代流行的"大模型是马,Harness 是马鞍"比喻。核心论点:当前 AI 系统的问题不在模型能力,而在于 Agent 作为"身体"的不成熟——这是一个大脑超前成熟、但身体处于早产儿阶段的阶段。

核心隐喻对比

流行比喻 问题 vivo 替代方案
大模型 = 马 隐含对抗/驯服关系 大模型 = 大脑
Agent = 骑手 忽略系统基础设施 Agent = 身体
Harness = 马鞍 控制已成熟的对象 Harness = ICU(监护)
Prompt = 缰绳 暗示"拉一下就走" Prompt = 神经信号

四大身体系统问题

当前 Agent 系统的四个核心工程缺陷:

身体系统 Agent 对应 问题表现
感官系统 多模态输入/解析/识别 PDF 解析错位、网页噪声、图像遗漏——有输入但不稳定
运动系统 工具调用/API/UI操作 参数错误、点击偏移、环境不一致——不是"不会动"而是"动作不协调"
资源调度 上下文/Token/成本管理 信息给少推理断裂,给多提示过载——供血系统不成熟
自主神经系统 错误恢复/重试/降级/监控 缺后台自动维持能力,依赖硬编码 if-else

Harness-as-ICU 框架

Harness 不是马鞍(服务于已成熟的系统),而是 ICU——维持身体基本生命体征的系统:

ICU 功能 Harness 对应
生命体征监测 Token 消耗、延迟、错误率、上下文压力
资源维持 上下文补充/清理/压缩
信号调控 噪声过滤、动作风控
故障抢救 模块失效时快速切换备用路径

vivoPPT 开发收敛路径

从开放到收敛的三次迭代:

阶段 1:直接生成大纲 + 提供很多模板

→ 问题:大纲不稳定 + 模板变量叠加不确定性,用户无法判断问题源头

阶段 2:固定模板 + 内容优先

→ 收敛:用户提供完整原始材料(会议纪要/项目总结/方案全文),系统先理解再组织

阶段 3:DSL 中间层 + 富文本上下文解析

→ 收敛:先成 DSL 结构化中间表示,再渲染。富文本增加图片上下文解析(语义摘要+主题标签+素材描述)

沉淀的四条流程纪律: 1. 先研究,再写作 2. 先大纲,再页面 3. 先任务化,再并行化 4. 先可编辑,再可交付

当前阶段的本质判断

"我们正在经历一个还不会用工具的时代。"

  • 技术爆炸后最佳实践真空是常态(类比:城市发展→交通规则;互联网→导航/搜索/推荐)
  • Prompt Engineering = 口头问路(临时沟通技巧,非稳定系统方法)
  • RAG = 静态地图(非实时路况)
  • Agent 框架 = 拼装义肢(接口标准未统一)

核心判断:真正的最佳实践不是设计出来的,而是在大量真实场景中逐渐显现的——先有系统稳定活着,再有持续成长和自我优化。

关键独到判断

"大模型不是马,而是大脑,而且是一颗刚刚觉醒的大脑。"

"Harness 不是马鞍,而是 ICU。它真正提供的能力包括:生命周期监测、资源维持、信号调控、故障抢救。"

"当前很多 Agent 系统最真实的状态,就是大脑发育过快,但身体还处于早产儿阶段。"

"未来不会再讨论要不要用 AI。真正的变化会发生在我们开始真正理解:什么时候让它思考,什么时候让它行动,什么时候借助工具,什么时候交给流程,什么时候让人介入。"

"我们正在经历一个还不会用工具的时代。人们不仅是在使用工具,也在参与定义工具未来的正确使用方式。"

与其他实体的关系

  • Harness-as-ICUHarness Engineering 的"多层重试+可续传机制"互补——Harness Engineering 从"工程落地"侧设计,vivo 从"隐喻/哲学"侧给出定位
  • 四大身体系统问题高德扫街榜 HermesAgent 的"模型感知+代码计算"工程原则一致——都强调感官/运动/调度/自治四大层面的工程化
  • 最佳实践收敛论Loop Engineering 的"先写刹车再写循环"工程哲学呼应——最佳实践在真实使用中显现,而非一次性设计完成
  • vivoPPT DSL 中间层Flow2Spec 结构化知识路由 的结构化中间表示思想一致

实践启示

  • 诊断 Agent 系统时,先查身体再查大脑:四个身体系统(感官/运动/调度/自主神经)比模型选择更容易成为瓶颈
  • Harness 的核心价值是"让系统先活着":在追求自我进化之前,先确保基础生命体征稳定
  • 收敛比开放更难但更重要:vivoPPT 的三次收敛(固定模板→内容优先→DSL 中间层)说明最佳实践不是"设计更多选择",而是"在真实试错中缩小选择范围"
  • DSL 中间层是 Agent 生产系统的骨架:结构化中间表示让模板、内容、布局、导出之间有了稳定接口

原文存档