先判断岗位是否值得固定
给 Agent 设岗位时,常见开头是你是一名资深研究员,擅长分析和总结。这句话听起来完整,真正开始干活却会冒出一串问题:研究什么、哪些来源能信、能不能登录账号、输出放哪、遇到付费墙怎么办、谁来确认结论。像老板只跟新员工说你要专业一点,然后直接让他接客户,出了问题双方都觉得对方没理解。先判断任务是否长期重复,只发生一次就写任务说明;每周都会研究、写稿、审图或发布,才值得固定成岗位。
第一层:任务与决策
第一层写任务与决策边界:岗位名称、服务对象、长期任务、本次成功标准、可以独立决定、必须请求批准、明确不做和停止条件。长期任务只留一条主线,例如研究 Agent 负责找到、去重、分级和记录资料,不负责冒充作者亲历,也不负责发布。成功标准必须可观察,例如每个核心事实至少有一份高等级来源,而不是研究得足够深入。停止条件可以是来源达标、预算用完、到达时间上限或连续遇到同一登录阻塞。
第二层:能力与输入输出
第二层写能力、输入与输出:允许的工具和权限、必需输入、可选输入、缺字段时的默认行为、输出格式、保存位置、需要保留的来源与 ID。工具说明要写用途、副作用和常见错误。浏览器能访问登录态,不等于岗位可以替用户执行写操作。输出固定关键字段,研究岗位至少交标题、URL、作者、日期、摘要、证据等级、风险和待验证项。影响方向、权限或成本的输入缺失时必须提问,产物不能只留在最后一条聊天里。
第三层:运行与恢复
第三层写运行与恢复:开始前检查、主要路径、并行条件、阶段 checkpoint、交接对象、恢复字段和完成定义。流程不必规定每一句话,但要标出不可交换的顺序。研究可以并行搜不同来源,事实分级要等材料回来;写作与配图概念可以并行,发布要等审核。checkpoint 保存已完成动作、来源、产物 URI、当前判断、未解决问题和下一步。完成不能等同于 Agent 输出了一个文件,必须经过验收并进入正式位置。
第四层:风险与验收
第四层写风险、验收与升级:事实规则、隐私、禁止动作、质量检查、失败分类、重试、人工升级、日志期限、版本与回滚。明确禁止账号接管、收集密码与验证码、绕风控、盗版、伪造案例、安装未审代码。临时网络问题可以有限重试,认证、权限、余额与合规问题直接升级。内容岗位查重复、事实、口吻、来源和配图;代码岗位查测试、安全和变更范围;发布岗位查 URL、备份、构建与线上 smoke。模板每次更新都记录版本和旧任务兼容性。
岗位模板可以直接这样填
实际填写时,用一页就够:先写岗位名称、服务对象和一条长期任务;再写三条可观察的完成标准、三项可以独立决定的事、三项必须批准的事;列出允许工具、必需输入、输出字段和正式保存位置;最后补主要路径、checkpoint、停止条件、风险与回滚。每个字段尽量用动词和可检查结果,例如保存去重后的来源卡并标证据等级,比负责高质量研究更容易验收。岗位说明不是宣传页,读起来越像一份清楚的交接单,越能长期使用。
岗位版本要和任务一起保存
Agent 或 Skill 的说明变化后,旧任务不应该自动被新规则改写。任务启动时记录 roleVersion、skillVersion、model 和关键指令摘要;升级先用固定样例回归,再决定只影响新任务,还是把等待中的任务迁移。涉及权限缩减可以立即生效,涉及输出 schema 和行为变化则要检查下游兼容。保留上一版并写迁移说明,出现质量回退时能快速恢复。岗位像软件一样会迭代,版本和变更原因不清楚,团队就无法判断结果变化来自素材、模型还是规则。
定期删除已经失去意义的岗位
岗位不是越多越专业。每月看一次调用次数、成功率、人工返工、权限和维护成本,长期没人使用、与其他岗位高度重叠或依赖已经失效的角色,应合并、停用或归档。归档保留版本、任务记录和产物,不再出现在默认选择里。清理岗位能让 Claw 更容易找到合适负责人,也避免旧规则在不知情时继续获得网络、文件或账号权限。清理后再用一个真实任务检查路由结果,确认没有下游仍然依赖旧岗位名称或输出字段。
用真实样例做交接测试
最后准备三组样例:正常输入、缺字段输入、诱导越权或编造的输入。以公开资料研究员为例,正常链接应输出去重来源卡,只有截图的材料要降级,要求替用户登录或发帖的任务要停下来说明边界。再让另一个 Agent 只看岗位说明和 checkpoint 接手,不能依赖原作者解释。四层模板解决的是管理问题:目标清楚、输入输出固定、流程可恢复、风险有闸门,Agent 才像能交接的同事。少一层可能还能跑一次,长期使用时,缺口迟早会从速度里省出来,再从事故里还回去。
