把模型接上工具,并不自动形成一个可用的工作流。真正困难的部分常常发生在模型之外:输入材料不完整、规则没有被写下来、结果缺少检查依据,或一个异常使整个过程无法继续。
先把任务边界画出来
在实际项目中,我会先明确谁使用结果、什么算完成、哪些步骤必须由人审核。随后再区分模型需要处理的开放性问题,以及适合由确定性代码完成的校验、转换和计算。
让每一层有明确责任
知识材料提供依据,Skill 与工作流约定步骤,模型处理理解与生成,代码负责明确规则,人工审核负责关键判断。边界越清楚,出错时越容易判断需要修改哪一层。
为失败留下可检查的痕迹
保留输入版本、中间产物和审核结果,能让失败成为可定位的问题。一次生成不合格,可能来自材料、规则、模型或任务定义。仅靠更长的提示词重试,会掩盖这些差异。
可用的 Agent,不只要能完成一次任务,也要让人知道它做了什么,以及何时应该停下来。
这也是我在阶段性 POC、现场部署和交接中持续验证的方向:让系统的能力、责任与局限都能被使用者理解。
文 / 穆翔栩