先确定四层职责
个人工作台最容易做成一张好看的大屏,真正使用时还是回到十几个聊天窗口。先把四层职责钉住:大模型是大脑,负责理解目标、汇总信息和选择路径;Claw 是执行中枢,把计划变成状态和交接;Agent 是项目或板块负责人,负责样板、判断与验收;Skill 是专项岗位,处理检索、写作、配图、部署等明确问题。层级的价值不是起名字,而是任何一项工作都能说清谁决定、谁串联、谁负责结果、谁提供专项能力。
首页只放需要决定的事
首页只放今天需要决定的内容:进行中的项目、等待人工确认、失败待恢复、最近对话和模型连接状态。不要一上来塞满调用次数和花哨图表。点开一个执行项,应该在一分钟内找到目标、当前负责人、输入、最新产物、阻塞原因和下一步。右侧执行检查器显示当前状态、Agent、Skill、检查点与风险;完整历史放在详情里,避免主界面变成日志墙。
项目保存长期上下文
项目是最高层容器,保存目标、长期指令、文件、对话、任务和关键决定。最近对话属于项目,但对话不等于任务完成。OpenAI Projects 把聊天、文件和项目指令放在一起,Gemini 的 Gems 强调可自定义角色,Coze 与 Dify 提供可视工作流...这些产品的共同启发是让上下文有归属,让角色可重复,让执行可查看。工作台因此采用左侧项目与最近对话、中间内容区、右侧检查器,而不是复制任何一家产品的外观。
一次任务怎么穿过四层
以发布教程为例:大模型先理解目标和栏目,Claw 建立 research、writing、image、translation、review、publish 状态;研究 Agent 调用素材与事实核验 Skill,内容 Agent 交付样稿,视觉 Agent 重制配图,发布 Agent 准备静态包。每个 Agent 只写自己的产物,Claw 负责状态迁移,生产发布要等人工确认。同一个角色不能一边写稿、一边改生产配置、一边宣布自己审核通过,就像公司里写合同和最终盖章通常不会放在一个岗位。
模型、密钥与权限
模型接口按供应商独立保存 base URL、默认模型、启用状态和密钥状态。密钥只交给自己的服务端,用固定工作台主密钥派生加密密钥后保存,浏览器只拿到是否配置和末四位。工作台账号与后台账号分开,用户名和密码由入口层管理,避免应用代码直接接触登录密码。角色头像允许 emoji 或 HTTPS 图片地址,名字和职责可以修改,但权限要由服务端执行,不能只在前端把按钮藏起来。
先把核心数据对象定下来
工作台至少需要 Project、Conversation、Run、Agent、Skill、Provider 和 Artifact 七类对象。Project 保存长期目标和边界,Conversation 保存交流,Run 表示一次真正执行,Artifact 指向文件、页面或结构化结果。Agent 关联负责范围、模型和可调用 Skill,Skill 关联版本、输入输出、权限和测试状态,Provider 只保存连接配置与加密密钥状态。对象之间用 ID 连接,不能靠标题模糊匹配。这样对话改名、模型切换或 Agent 换头像时,历史任务仍然能追到原来的执行与产物。
最近对话不是无限记忆
最近对话适合让人快速回到现场,但不能把全部聊天自动塞进每一次模型请求。每个项目应该有稳定指令、已确认决定、活动任务和可检索产物,聊天只在需要时取相关片段。一次执行结束后,Claw 把真正需要长期保留的结论提炼到项目状态,同时记录来源消息 ID,其他寒暄和试错可以留在会话历史而不进入默认上下文。这样既能降低 token 和隐私负担,也避免模型被很早以前已经推翻的讨论带偏。所谓记忆,重点是可追溯的选择,不是把所有字永久堆在一起。
第一版先克制住功能数量
第一版只要把项目、对话、四层角色、模型连接、状态保存和人工检查做稳,就已经能解决上下文散落的问题。自动调用模型、可视化编排、成本图表、文件检索和团队权限可以逐步接入,每加一项都要先回答数据放哪、谁能看、失败怎么恢复。工作台的价值来自每天愿意打开并能继续工作,不是首屏上同时出现多少未来功能。
失败以后从状态恢复
模型连接失败要区分认证、权限、限额、网络和供应商故障。401/403 不自动重试,429 根据响应信息退避,5xx 只做有限重试;切换备用模型必须留下原因,不能静默改变质量标准。任务恢复从项目状态和 checkpoint 开始,不从浏览器最后一段聊天猜。第一版用三个问题验收:关掉浏览器再打开能不能继续,换一个 Agent 能不能读懂当前任务,撤销一个权限系统是否真的阻止动作。答案都清楚,这个工作台才开始像基础设施。
