
OpenAI 在 9 月 1 日发的这篇企业信号读起来不像产品发布,更像把三张工位照片贴在墙上。Basis 把会计事务所的入职从大约两小时压到三十分钟;Clay 让每个客户账户有一个隔夜更新文件夹的子代理;Exa 则把“发现集成机会 → 拉上下文 → 开 PR → 跑测试”收成 Codex 可复用流程。官方数字更硬:头部 10% 用量企业,人均输出 token 已是普通企业的 8.3 倍,而今年 1 月还只是 2.6 倍。差距拉大的不是“谁更爱聊天”,而是谁把 Agent 接到了公司上下文和工具链上。
[1]按官方叙述,三条路径对应三种难度。Basis 先演示一遍入职,再写成带触发条件、步骤、工具权限和“完成定义”的 skill;新人第一天直接拿到 Codex 和公司专属入职技能,后台完成集成,例外回流给 HR 改 skill。Clay 面对散落在 CRM、邮件、Slack、通话里的成交上下文,给每个账户一个持久工作区与子代理:夜里读一手材料更新 deal folder,早上由协调代理汇总成可核对的优先动作清单,号称每晚省大约一小时收件箱分拣。Exa 追求 “Exa everywhere”:Codex 监控高优先集成信号,整理上下文、创建 PR、跑测试,并准备周报;人仍决定押哪条关系、对外怎么承诺。
[1]这三家不是在比“模型谁更聪明”,而是在比工作流是否可教、可测、可移交。Basis 解决的是一次性流程的标准化;Clay 解决的是持续演化上下文的 overnight freshness;Exa 解决的是跨研究—工程—传播的交接成本。OpenAI 顺手给出六步实验法:选端到端高利害流程、定义 KPI 与护栏、写清触发/上下文/停手点、让一线参与设计、把试验做成可复用 skill/Plugin、再把成功边界搬到下一张价值面。作者判断:企业真正缺的不是又一个聊天入口,而是把“试成功一次”沉淀成第二天还能跑的操作系统。
[1]对企业买家,这篇文的争议点很实际。第一,token 用量差距会被当成 KPI,却也可能掩盖审查负担与错误成本——官方也提醒要同时盯周期、质量、收入或风险,而不是只看输出量。第二,Clay 式账户子代理一旦铺开,权限边界和客户数据可见范围会立刻变成法务问题。第三,Exa 把 PR 和测试交给 Agent,意味着代码评审标准必须写进工作流,否则“看得见的测试”会变成橡皮图章。第三方是否照抄成功,取决于组织有没有人愿意当流程 owner,而不是取决于模型版本号。
[1]我更愿意把这篇当成一张对照表:如果你的 Agent 演示还停在“帮我写邮件”,而对手已经在改 skill、刷新 deal folder、带着测试开 PR,那 8.3× 的鸿沟就不是宣传口径,是运营现实。官方事实止于三家创业公司的案例与 Enterprise Signals 统计;至于大型受监管行业能否复制隔夜账户代理,仍是开放问题。收束一句:Agent 时代的竞争力,开始用“流程能不能隔夜自己变好一点”来量。
[1]