把一项反复出现的工作整体交给AI,仅靠措辞得当的提问远远不够。AI智能体是一种能够使用工具、评估中间结果并朝着目标自主选择下一步行动的模型,它需要一份界定清晰的任务。4S方法为分派工作的人梳理出四项决定:Select、Scope、Supervise和Sign off。

空白的资料堆、划定边界的工作区、人工审核检查点和成品文档托盘依次排列

▲ 来源、边界、审核与交付

这一方法适用于每天、每周或每月按相似步骤进行、产出固定成果的工作。以每周简报为例,其中可能包括收集更新、筛选信息、撰写摘要和保存文档。目标是在不放弃对信息来源、工作边界和最终质量的掌控的前提下,把这一整套流程交出去。

把重复性工作变成4S任务

这四个步骤把智能体能做的事与必须由人决定的事区分开来。它们还提供了一种在把工作流纳入定时执行之前先行测试的方法。

  1. Select: 选择有用的重复性工作,而不是为了新鲜感去自动化。所选工作应是自己足够了解、能够判断好坏的工作。如果无法判断结果是否准确、完整,就无法可靠地评估智能体的表现。寻找候选工作时,可以让智能体就你每天、每周、每月重复做的琐事对你进行访谈。
  2. Scope: 写明期望的成果、可用的信息来源、操作限制、交付位置以及完成标准。如果是一份关于ChatGPT和Claude的周一早间简报,可以规定只涵盖过去7天的变化、以官方发布公告为来源,并且只纳入与自身工作相关的更新。还要指定成品文档是存入某个文件夹,还是向Slack或WhatsApp发送通知。
  3. Supervise: 决定由人在哪些环节检查工作。在简报的最初几次运行中,让智能体在撰写报告之前先列出所选的信息来源。这一检查点能够暴露遗漏的更新,或是内容偏向了你很少使用的工具。给出具体反馈并调整指令;只有在多次运行都达到标准之后,才减少日常检查。对于面向客户的消息和涉及资金的操作等敏感工作,要保留人工检查点。
  4. Sign off: 对最终交付物作出接受、要求修改或拒绝的决定。对于简报,要检查是否覆盖了所要求的时间段,核实引用的链接真实存在且可以打开,并确认没有把仅仅发布了公告的内容当作已全面上线的功能来介绍。在批准结果之前,准确说明需要修改之处。

抽象的AI工作空间中放着一个空白指令文件夹,线缆连向文档和消息存储处

▲ 指令与接入的工作工具

了解智能体完成工作所需的条件

智能体能够在所获得的工具和权限范围内,朝着分派的目标采取行动。ChatGPT Work和Claude Cowork都是可用于此类工作的智能体选项。对于这类工作流,桌面应用比移动应用或浏览器标签页更合适,因为桌面应用提供了执行所需的更多系统访问和工具控制能力。正因为具备这种能力,权限的选择才显得尤为重要:接入文档存档,与授予密码库或支付信息的访问权限,是完全不同的两回事。

技能(skill)与智能体不同。它是一套可重复使用的任务指令,类似于操作手册。技能中可以包含调研流程、报告格式规则或写作风格指南。在实际中,技能文件可以就是一个存放纯文本指令的文件夹,人可以打开查看并编辑。一旦某个受监督的工作流能够稳定运行,就可以把其中的指令打包成技能反复使用,包括在ChatGPT和Claude的环境之间通用。

连接器和插件让智能体能够访问其他应用。连接器可以让智能体读取Google Drive中的参考文件,或把成果写入其中;插件则可能把某项服务所需的工具、提示词和身份验证打包在一起。API即应用程序编程接口,让软件之间能够交换数据并请求执行操作。**Model Context Protocol(MCP)**是一种建立在这些底层软件连接之上、用于向AI助手提供工具和数据上下文的标准。它们是通往服务的桥梁,而不是告诉智能体哪些工作可以接受的指令。

先测试,再决定哪些工作定时执行

一个重复性工作流应当先证明自己,再被纳入定时执行。智能体可以把录音转写稿整理成新闻通讯草稿,在每月的记账核查中收集发票,或每周检查网站的搜索引擎优化(SEO)问题。每个例子的产出不同,所需的审核也不同。新闻通讯草稿可以等待编辑批准;而涉及资金的工作流,即使常规步骤已经稳定可靠,也应继续保留人工检查。

对于定时执行的工作,运行智能体的计算机很关键。合上盖子就会休眠的个人笔记本电脑,无法可靠地运行后台任务。Apple Mac mini这类始终开机的专用设备,或者虚拟专用服务器,也就是为定时工作而保持可用的远程计算机,能够支撑重复性工作流。先确定智能体真正需要哪些服务,再据此限制其权限。不要仅仅为了让工作流更方便就接入敏感的凭据。

从一项边界清晰的工作开始

选择一项自己知道如何评估结果的重复性任务。写下它的成果、信息来源、限制、交付位置和检查点,并在设为定时执行之前检查几次运行结果。如果流程被证明可靠,就把指令整理成可重复使用的技能。智能体可以执行步骤,接入的工具可以传递信息,但授予哪些访问权限、何时认定工作可以投入使用,仍然由人来决定。