用于自我改进的 Harness 工程
相较于早期智能体框架(定义为‘智能体 = 大语言模型 + 记忆 + 工具 + 规划 + 动作’),运行框架工程还涵盖工作流设计(如循环工程)、评估机制、权限控制及持久化状态管理。它已不再仅限于提示词模板,而更接近运行时与软件系统设计层面:即模型如何观察、行动、记忆、自我检验与持续改进。
原始摘录
Compared with early agent frameworks , “agent = LLM + memory + tools + planning + action”, harnesses engineering additionally include workflow design (e.g. loop engineering), evaluation, permission controls, and persistent state management . It is no longer only prompt templates, but closer to runtime and software system design: how the model observes, acts, memorizes, checks itself, and improves.