如果Codex或Claude Code总是触及用量上限,解决办法往往不是换更贵的套餐。大部分token浪费源于使用习惯:不看用量就购买额度,让智能体像人一样在网站上逐页点击,所有任务都用最贵的设置运行,把超大文件直接拖进对话。token是AI模型处理文本的单位,订阅上限也以它来计算。下面分四个方面介绍十项调整,帮助同一份订阅完成更多工作。

改动任何设置之前,先看用量

第一步是弄清用量实际花在了哪里。小企业常常同时运行多个智能体却从不查看用量,随后换成了并不需要的高价套餐。有时真正的解决办法只是停止重复运行的智能体,或者用掉账户里已有的免费重置。

查看内容 Codex(ChatGPT Work) Claude Code
快速查看 在消息框输入/status 在消息框输入/usage
详细界面 左下角个人资料菜单:本周剩余用量、套餐级别、额度余额 会话上限、每周上限、Fable模型单独上限、重置时间
重点关注 恢复5小时上限或每周上限的免费重置及其到期日 本周用量按产品的分布

在Codex中,免费重置可以在不消耗额度的情况下恢复5小时上限或每周上限,但每次重置都有到期日,不及时使用就会作废。名为“Allow Codex to use resets”的设置可以让智能体在达到上限时自动使用可用的重置。对付费额度的自动充值则要谨慎得多:陷入循环的智能体可能在几分钟内花掉一笔可观的费用。点击购买更多之前,先同时查看用量条和重置列表。

Claude Code发放免费重置的频率似乎远低于Codex,因此在这里高效分配任务更为重要。按产品划分的每周用量很能说明问题。在一位重度用户的一周里,Claude Code占用量的96%,普通对话占4%。对于在Claude桌面应用中工作的人,建议把智能体工作集中在Claude Code,而不是分散到对话或Cowork中。

别让智能体在网站上逐页点击

当智能体登录软件、像人一样浏览网页时,token用量会上升,速度会下降。同样的工作通过插件、MCP服务器或API密钥来完成,会更快、更轻量。MCP即Model Context Protocol,是让AI工具连接外部软件和数据的标准方式。API是程序无需浏览器即可直接调用的接口。

实际案例清楚地显示了差距:

  • 一家经营十多年的企业在没有API密钥和MCP的情况下,让智能体审查其HubSpot账户。智能体一天就用光了一整周的订阅上限。
  • 另一家企业听从代理机构的建议采用了GoHighLevel。其MCP服务器和API无法创建或编辑营销漏斗和工作流,智能体只能在界面上逐一点击,消耗大量token,速度也很慢。
  • 一家公司在Basecamp第1版中存放了6万多个文件,完全无法接入智能体。在厂商支持团队的协助下把数据迁移到Basecamp V5后,Codex和Claude的智能体可以直接审查业务、实现工作流自动化。员工继续使用熟悉的工具,智能体则获得了完整的读写权限。
  • 有人尝试让智能体把视频上传到YouTube,但API密钥只有读取权限,智能体转而改用浏览器操作。通过浏览器需要30分钟的操作,API调用30秒就能完成,因此停下智能体、花20分钟配置上传权限更为划算。

一次简单的审查就很有帮助。让智能体逐一调查企业所用的核心工具,回答以下四个问题:

  1. 是否有插件或连接器?
  2. 是否有MCP服务器?
  3. 是否有可读写的API?
  4. 是否有访问能力更好的新版本软件?

同时让它列出哪些任务可以通过这些途径完成,哪些仍需在浏览器中点击。再加上一条规则:如果某个工具有API或MCP途径,智能体却开始使用浏览器,就必须停下来询问你。如果某个工具既不支持智能体访问,也没有相关计划,就要在持续支付token成本和更换工具之间作出选择。对于需要与智能体深度兼容的成熟企业,推荐的客户关系管理系统(CRM)是HubSpot;对于小企业,Notion被视为适合智能体的选择。

每天运行的重度工作流,从插件转向API

插件适合起步,但每天运行或数据量大的工作流应当改用直接API。API带来速度、更低的成本和字段级控制,而且不需要完整的工程团队。把HubSpot的ChatGPT插件和HubSpot私有应用API令牌放在一起比较,差距一目了然:

功能 ChatGPT插件 私有应用API令牌
读取联系人、记录备注 支持 支持
删除或归档记录 不支持 有写入权限即可
每次请求处理的记录 最多10条 最多100条
处理500个联系人所需调用 50次 5次
大规模导出与全量同步 受限 支持

API还可以只获取需要的字段。如果每日销售报告只需要客户名称、阶段和交易金额,API只取这些字段,而插件会加载每条记录的全部CRM属性。直接令牌还能处理自定义属性、无人值守的定时任务,以及与BigTime等会计系统的对接。

把API密钥存放在事先设定好权限范围的专用凭据管理工具中,并保留日志,以便出现问题时追查是哪个智能体执行了哪项操作。关闭不用的连接器。它们的工具说明会被加入每一条提示词,占用上下文窗口,也就是模型一次能考虑的文本量。直接API还能让你自由切换模型和工具,在ChatGPT Work、Codex和Claude Code之间来回切换,或使用可替换底层模型的编排工具。依赖浏览器登录和特定平台的插件,往往会把你锁定在一个环境里。

一边是在浏览器窗口迷宫中摸索的机器人,另一边是同一机器人直接连接数据库

▲ 浏览器点击与直接API连接

让推理强度、模型和速度匹配任务

推理强度决定模型在回答前思考多少。日常工作保持Medium即可。Claude Opus 5.5设为Medium大约能处理90%到95%的常规任务,而用最高推理强度写一封跟进邮件,很快就会耗尽当天的预算。在没有明确边界规则的情况下调高推理强度,可能只会让智能体更快地作出错误决定。

基础模型的选择与推理强度设置同样重要:

工作类型 推荐模型
快速、重复的任务:解析电子表格、给记录打标签、重命名文件 GPT-6 Luna、Claude Haiku 4.5
日常业务、CRM更新、沟通 Medium档的GPT-6 Sol、Claude Sonnet 5或5.5
多步骤构建、跨系统自动化、疑难调试 High档的GPT-6 Sol、Claude Opus 5.5
系统架构、业务战略、深度研究 Claude Fable 5.1、GPT-6 Astra

速度设置也值得再看一眼。在Codex中,GPT-6 Astra旁边的闪电图标开关可将速度提高到1.5倍,但额度消耗也会更快。后台智能体通常在人们处理其他事情时运行,为速度多付费几乎没有帮助。无人值守的任务应关闭此开关。

AGENTS.md和CLAUDE.md要写得简短

AGENTS.md(用于Codex和ChatGPT Work)和CLAUDE.md(用于Claude Code)是智能体开始工作时阅读的入职手册。按2024年风格写的文件要花数百个token来解释如何写邮件,或列出每一个文件夹路径。如今的模型已经掌握标准格式,也能自行浏览目录,因此手册只需保留组织特有的知识:

  • 各项工作由谁负责
  • 允许智能体做什么
  • 数据冲突时以哪个系统为准,例如付款状态以QuickBooks而非HubSpot为准
  • 智能体何时必须停下来询问人
  • 记录过往错误及修复方法的变更日志

你也可以让智能体调查已连接的系统和文件,为你起草这份文件。每三到六个月复查一次,因为过时的指令可能让新模型困惑,拖累其表现。

文件集中存放,命名有规可循

许多小企业的文件分散在五到七个地方:Dropbox、Google Drive、iCloud、SharePoint、本地桌面以及离职员工的账户。不知道权威版本在哪里的智能体只能逐一搜索,既耗费token,又有用到过时文件的风险。曾有智能体在查找去年的价格表时找到三个名为“pricing final”的文件,结果把旧版本通过邮件发给了潜在客户。

整理分六步进行:

  1. 选定一个存储系统。如果已经在用Google Workspace,集中到Google Drive效果很好。
  2. 按企业的实际运作方式搭建文件夹,例如品牌、营销、财务、流程和模板等公司通用文件夹,以及提案、合同、交付物、会议和归档等客户文件夹。
  3. 制定命名规则。客户文件按日期、客户、文件类型、版本的顺序命名,日期放在最前面,便于按时间排序。标志和核心流程等长期使用的资料不加日期。
  4. 删除重复文件,用版本号取代“FINAL”“USE THIS”之类的标签,让智能体不必猜测哪个文件是最新的。
  5. 把不再使用的资料归档。
  6. 确认新加入的成员也能看懂这一结构。

先从只读审查开始:让智能体列出存储位置、文件类型和重复文件,并提出整理方案,在你批准之前不移动、不删除任何文件。迁移完成后,把权威位置、命名规则和文件夹结构写进AGENTS.md。统一的命名相当于一个小索引,让智能体无需打开文件就能选中正确的文档。

左边文件散落在多个箱子里,右边是一个层次分明、整洁的文件柜

▲ 集中整理后的文件结构

把出色的成果变成标准

当智能体交出出色的成果时,立即把当时的提示词、结构和标准保存为模板、技能或检查清单。这里的技能是指智能体可以重复使用的一套已保存指令。省掉这一步,企业主可能每个月都要花一个小时,从头再教一遍字体、版式和内容规则。如果每周把一项好成果固化为标准,一年下来每位团队成员约可积累250项可复用资产。

合适的对象涵盖六个领域:销售(推介材料、价格表、跟进邮件)、客户交付(入门资料包、季度报告)、营销(落地页、简报、引流资料)、社交媒体(LinkedIn帖子、轮播图)、运营(标准流程、付款提醒)和人事(招聘启事、入职检查清单)。以人事合规检查清单为例,把批准的版本保存为锁定的主模板,再创建一项技能,写明必需的输入、智能体不得做的事、交付前要检查的项目和六个月后的复查日期,并登记到AGENTS.md中。

每项新技能在投入使用前都要先测试。如果是幻灯片设计标准,就让智能体只依据风格指南新做一份三页的样稿,修正不符之处后再保存为标准。经过验证的销售材料或已签署的协议都是很好的素材,不必从空白页开始。

告诉智能体文件位置,而不是上传文件

把150页的合同、一小时的会议转录稿或大型电子表格拖进对话后,这些内容会一直留在对话中,每一轮都会被重新处理。为了核对一条解约条款而上传整份合同,之后的每个问题都会带着这150页。

应告诉智能体文件在哪里、需要哪一部分:

  • 不要上传200页的合同,而是让它查看Google Drive中该客户合同文件夹里的补充协议,并标出价格条款。
  • 不要上传整份转录稿,而是让它从会议文件夹中周二销售电话的转录稿里提取客户的异议。
  • 不要粘贴5000行的数据,而是让它在财务文件夹的第三季度电子表格中找出收入排名前十的客户。

存放在文件夹里的文件在智能体打开之前不产生任何成本,而上传到对话中的文件会在整个对话期间持续累积成本。也可以在AGENTS.md中加一条规则,要求智能体不要索要大型文件的完整上传。

本周要做的事

用量上限的流失,似乎更多来自工作习惯而非套餐大小。可以按以下顺序着手:

  1. 在Codex中运行/status,在Claude Code中运行/usage,记下剩余上限和重置到期日,并检查付费额度的自动充值设置。
  2. 审查核心工具是否有插件、MCP服务器、API和新版本,把依赖浏览器的任务转到这些途径上。
  3. 关闭不用的连接器,默认使用Medium推理强度,把简单任务交给更轻量的模型,并为后台工作关闭速度提升。
  4. 把AGENTS.md或CLAUDE.md精简为组织特有的规则,并用统一的命名规则整理文件。
  5. 把出色的成果保存为经过测试的技能,并告诉智能体文件位置,而不是上传大文件。