
九月二日,Anthropic 在 Claude 博客发布 Building Commerce Agents with Claude:不是又一篇「Agent 能购物」的概念稿,而是把可运行的购物 Agent 与商户 Agent 蓝图、垂直演示、Claude Code 插件,以及与 Visa、Mastercard、Accenture、Shopify 等伙伴的协作叙事,一起推到了假日季备货窗口。
官方在文首给出一组可核对的客户侧结果:在 Claude 上运行购物 Agent 的零售商,购物车可大到约 35%,完成购买的概率高出约 60%。这些数字来自 Anthropic 的客户表述,文中未附独立第三方审计;下文分析会把它们标成官方转述,而不是已复现实验。
官方发布了什么
这篇产品文的核心动作是开源式交付一份工程蓝图。仓库地址写明为 github.com/anthropics/commerce-agents,内含购物 Agent 与商户 Agent 的完整参考实现,可走 Messages API、Agent SDK,或仍处 beta 的 Claude Managed Agents。部署面覆盖 Claude API、Amazon Bedrock、Microsoft Foundry 与 Google Cloud Vertex AI。文中还写到 Accenture、Mastercard、Visa 等解决方案与生态伙伴,帮助客户与商户社区落地蓝图;并配有各垂直的现场演示与工程深挖,指向八月二十八日那篇 A guide to the anatomy of effective commerce agents。
购物 Agent 被放在应用或网站内:蓝图给出目录、购物车、结账、偏好与订单历史的集成点,支付仍留给商户现有结账或代理式支付提供商。官方举例——用户说「我需要帐篷、睡袋和炉具,带两个孩子过周末」——Agent 应能在会话里搜目录、组多件清单、记住偏好、展示对比与购物车,并顺带回答物流、退换与退款政策,而不是把人踢去帮助中心。护栏被写成「价格与商品约束在真实目录数据上」,并避免操纵性加购;仓库里对应的是目录搜索、多件规划、深度研究、个性化、客服与会话内 UI 等技能与工具。
商户 Agent 面向店内运营:可基于自有数据回答「该打折清哪批过季库存」,追踪库存并在促销前预警将售罄的 SKU,按销售历史建议定价与促销,起草营销活动。官方强调:Agent 主动建议变更时,须经人工批准才能上线——人保留最终决定权,Agent 负责盯店。对应技能包括销售分析、目录与库存、营销促销,以及门户内图表仪表盘。
客户证言名单很长:Visa、Mastercard、Accenture、Priceline、Intuit、Shopify、Klaviyo、Wix、Zomato、Square 等。其中可核对的工程体验包括:Wix 称工程师约十五分钟内让商业 Agent 开始吃提示;另有团队称两套 Agent 本地跑通「远不到一小时」,且 Claude Code 工作流两次跑出不同架构。Accenture 转述其调研:85% 的人愿意与 AI Agent 协作,近四分之三更信任个人 AI Agent 而非挚友代为下单——这是伙伴调研,不是 Anthropic 自测。
技术与产品价值
把「会聊天的导购」做成可 fork 的仓库,价值在于压缩试错周期。蓝图把目录约束、会话内 UI、工具迭代上限、提示缓存等工程实践写进默认脚手架,等于承认 Agent 商业化的瓶颈早已不是模型会不会说话,而是结账链路、库存真相源、品牌语气与合规边界能否在同一运行时里被编码。购物侧强调多件规划与客服同会话,商户侧强调「建议—人批—再上线」,这两条合在一起,其实是在卖一种可采购的人机分工:Agent 负责吞吐与巡检,人负责定价权与品牌风险。
对开发者,Messages API / Agent SDK / Managed Agents 三入口并存,降低了「必须换栈才能试点」的摩擦;对零售与旅游平台,假日季前放出垂直演示,是把销售周期压进采购窗口。官方把八月的解剖文当作工程深挖入口,说明九月二日这篇更偏「交付与伙伴网络」,解剖文更偏「设计原则」——两条内容分工清楚,不宜混成同一篇新闻的复读。
行业竞争与战略影响
代理式商务正在成为支付网络、电商 SaaS 与基础模型公司的交叉战场。OpenAI 与多家支付、零售伙伴也在推「对话里完成购买」;Google 与亚马逊各自握有分发与目录优势。Anthropic 的差异化不在再讲一遍多模态,而在把可运行蓝图 + 支付网络背书 + 咨询实施绑成一条企业销售漏斗:模型层卖智能,蓝图层卖一周内可演示,伙伴层卖合规与落地。
与 OpenAI 路线相比,Anthropic 更愿意把「商户自建 Agent、保留与顾客关系」写成主叙事——Visa 证言里「商户要更多控制 AI 如何接触顾客」几乎是点题。这和它近年在企业市场强调的可控部署、护栏可配置是同一条产品哲学:不是替代结账服务商,而是成为结账之前的推理与编排层。对 Shopify、Wix、Square 这类平台,蓝图降低了「自研 Agent 脚手架」的成本,也可能把模型选择锁定进 Claude 生态——这是合作,也是渠道争夺。
风险、局限和争议
先把事实边界划清。35% 更大购物车、60% 更高成交概率,是官方转述的客户结果,缺少样本量、对照实验与第三方复现;Accenture 的 85% / 近 3/4 信任数字同理。把营销证言写成产业规律,是评论里最常见的滑坡。
产品层面,支付被有意留在蓝图之外:Agent 可以组好车,但钱怎么走、拒付谁负责、欺诈模型挂在哪一侧,仍取决于商户与 Visa/Mastercard 等网络。护栏写明「约束在真实目录」和「避免操纵性加购」,可执行强度取决于商户是否真的关掉了灰色促销话术——开源蓝图拦不住部署后的提示词改写。商户 Agent「必须人批再上线」是正确默认,却会在大促峰值变成审批瓶颈;若团队为了速度关掉人工闸门,风险画像会瞬间翻转。
商业动机同样直白:假日季、销售线索、伙伴联名。争议点在于,当近四分之三受访者声称更信任 Agent 代购时,品牌忠诚、价格透明度与「暗模式」监管会不会同步升温——代理式商务放大的不只是转化率,还有错误推荐与歧视性定价的传播速度。
评论员观点
我会把九月二日这篇读成 Anthropic 的「行业操作系统」投标书:模型能力已经够用,真正稀缺的是能在目录、库存、支付信任与人工审批之间跑通的默认架构。蓝图开源降低了演示门槛,伙伴网络抬高了企业采购时的安心感;两者合在一起,竞争点从「谁的模型更会聊天」挪到「谁能让法务、风控和工程在同一周点头」。
若只看见「购物车变大了」会低估它。更值得盯的是商户 Agent 把定价与促销建议默认设成人工批准——这说明 Anthropic 清楚,代理式商务的信任危机不在导购话术,而在自动改价与自动投放。未来真正的产品分水岭,是谁能把「建议」和「生效」之间的审计轨迹做成可导出的合规资产,而不是又一段聊天记录。
结论与趋势判断
未来六到十二个月,代理式商务会从试点页面变成零售与旅游 App 的默认入口之一;基础模型公司会更频繁地用「可 fork 蓝图 + 支付网络联名」抢渠道,而不是只发基准分数。Anthropic 用九月二日的交付把八月的设计论文落成仓库,节奏合理。接下来要看三件事:客户侧 35%/60% 一类结果能否在更透明的方法学下站稳;人批闸门在大促中会否被关掉;以及当 Agent 开始代为比价与下单时,平台与监管会把责任写在模型提供方、商户,还是支付网络头上。
事实陈述以 Claude 官方博客为准;伙伴证言与调研数字已在文中标注来源属性。