
用 WorkBuddy 搭个人工作台,先别急着配提示词,先把失败路径写清楚
AI 工作台最容易翻车的地方,是它出错的时候你根本不知道错在哪一步。模型聪明不聪明倒是其次。
今天刷到一篇讲 AI 个人工作台落地的文章,里面提到 DAG 定义、节点执行、失败重试策略,还专门讲了 trace_id 追踪,说任何一层出问题都能定位到具体环节。参数那段我印象挺深。内网跑一个 14B 的模型,输入输出上限 4096,温度 0.2,作者说这配置适合文档总结、信息抽取这类确定性任务。听着像给工程师写的,但思路放到 WorkBuddy 上一样成立。
我的环境是这样。WorkBuddy 用了大约两个月,工作区用了一阵子,三周多。下面说的不一定适用所有人,尤其是团队协作那部分。
我见过太多人,包括上个月的我,把 AI 工作台当成许愿池。一句「帮我把这三份合同审一遍」丢进去,等着出结果。结果就是串位。上周三我处理三份供应商框架协议,附件、类案、审查意见三样东西一合并,输出的表格里 A 公司的条款挂到了 B 公司名下。我查了半天,问题出在我没定义哪一步该产出什么。
那篇文章里有一句我认同。长时间运行的工作流要分成多个事务段,每完成一个节点更新一次进度,用户能清楚看到卡在哪一步,而不是面对一个永远转圈的按钮。这个体验细节,直接决定工具在真实业务里能不能被接受。
失败路径有没有被写清楚,直接决定成败。
失败后按策略重试,网络抖动导致的失败重试 2 次,业务校验失败不重试直接抛错。
这句话放到法律文书流程里,翻译过来就是,格式错了可以重跑,事实错了必须停下来让人看。我的判断是,WorkBuddy 这种工具在多阶段流程里表现不稳,卡在流程拆解和边界定义上,跟模型能力关系不大。机器生成的清单只能当草稿,素材对应关系必须人工核对。这一点我之前的想法没变,变化在于我现在会主动把校验点写进提示词里,不再等出错再回头找。
具体我是这么配的。打开 WorkBuddy,左侧点 工作区,新建一个,命名成「供应商合同审查-2026Q4」这种带日期和用途的名字,别叫「新建工作区 1」,过两周你自己都想不起来它是干嘛的。
进去之后点 添加素材,把 PDF 拖进去。注意,一次只放一类材料。三份合同就是三份合同,类案检索的结果另开一个工作区。这是第一个坑,混着放必串位。
然后是关键一步,配置输出。我不用它默认的总结,而是在提示词里把字段锁死,一共六项,合同名称、条款编号、原文摘录、摘要(不超过 80 字)、风险等级(高/中/低)、依据来源。字段锁死的好处是,输出直接能进我的证据链台账,不用二次整理。温度这类参数我看不到,能控制的就是提示词里的约束,所以约束要写得比你以为的更死。这方面我吃过亏,写松了它就自己发挥。
权限这块,工作区右上角有 共享。我的习惯是,助理设 可编辑,只让他补素材和标注;客户设 仅查看,导出链接给他。谁改了什么,工作区里有记录,比我以前用邮件传来传去强太多。权限边界不锁,模型和协作者都会自作主张,这是老问题了。
日常运维就两条。每周清一次工作区里的中间产物,尤其是上一轮的输出,留着会污染下一轮。每次改完提示词,先拿一份样本跑一遍,确认字段没跑偏再上批量。
我这两天在试 MCP,想把它接进 WorkBuddy,让类案检索的结果自动落到工作区。刚上手,还不好下结论,等跑顺了再写。
下次用 WorkBuddy 之前,先花十分钟把这一步该产出什么、错了怎么办写下来,再动手。省下的返工时间,够你喝两杯咖啡。
物界前沿