Agentforce 按用量计费,仅这一点就应该改变你的预算方式。多数 Salesforce 买家带着席位许可的思维进场,问一个智能体每用户每月多少钱,然后拿到一个并不描述其账单的数字。账单取决于智能体执行了多少次动作,而这又取决于智能体设计得有多好,以及你的知识库有多好。
这让它在企业软件采购里显得不同寻常。智能体内部的设计决定就是账单上的条目。一步答完一个问题的智能体,成本只有磨过五步那种的五分之一,而许可条款不会告诉你自己造出来的是哪一种。你会从发票上知道答案,通常是在第三个月。
Agentforce 到底要花多少钱? Salesforce 有两种计费方式。Flex Credits 是每 100,000 点 USD 500 或 GBP 400,一次标准动作消耗 20 点。会话计费则是每次一律 USD 2 或 GBP 1.60。因此一次标准动作是 GBP 0.08,两种模式在每次会话恰好 20 次动作时打平。低于这个数,点数更便宜,而设计良好的智能体落在 3 到 5 之间。
Agentforce 是什么,不是什么
Agentforce 智能体不是脚本更长的聊天机器人,也不是前面套了自然语言的工作流规则。它的决定性特征是会自行选择要做什么,而不是沿着你事先画好的路径走。
Salesforce 自己对这套机制的说明相当具体。关于智能体如何工作的文档把推理引擎描述为一连串发往大语言模型的编排提示,其中每一步分类与推理都是一次或多次模型调用。智能体先把用户消息与可用子智能体的名称和描述做匹配分类,并把最近大约六轮对话当作上下文。
接着它进入推理循环。它可以执行一个动作、向用户索要缺失信息、提出澄清问题,或者直接作答。每执行一次动作后,它检查结果,把输出并入已知内容,再决定要不要多转一圈。Salesforce 在文档里写明这最多会持续 7 轮推理循环。
整份设计要点就在这一段里。脚本式机器人每次会话成本固定,因为路径固定。智能体没有这个性质,因为路径是在运行时选出来的。
精确说清计费模型
按用量计费有两种模式,而且不能在同一个组织里共存。
Flex Credits 是 Salesforce 主推的模式。一包 100,000 点售价 USD 500,Salesforce 在自家的 Agentforce 定价页上把同一包标为 GBP 400,所以报英镑数字并不涉及汇率换算。一点等于 GBP 0.004。
会话计费是更早的模式,它先出现。Salesforce 在 2025 年 5 月 15 日把 Flex Credits 并列加了进来,其关于这项变更的公告把每次会话 USD 2 的既有计费描述成被扩展而不是被取代的东西。会话计费不管里面跑了多少工作,一律 USD 2 或 GBP 1.60,而且这个模式并未退役。它今天仍作为有效选项挂在定价页上,Salesforce 自家的常见问题还说明了现有组织如何从会话 SKU 切换到 Flex Credits。
| 你买的东西 | 单位 | USD | GBP |
|---|---|---|---|
| Flex Credits | 100,000 点 | 500 | 400 |
| 一次标准动作 | 20 点 | 0.10 | 0.08 |
| 一次语音动作 | 30 点 | 0.15 | 0.12 |
| 会话计费 | 一次会话 | 2.00 | 1.60 |
| Agentforce User License | 每用户每月 | 5 | 4 |
| Agentforce 附加组件 | 每用户每月 | 125 | 100 |
许可与版本另算
用量之外还有许可。Agentforce User License 是每用户每月 USD 5 或 GBP 4,而且背后仍然需要 Flex Credits。面向 Sales、Service 和 Field Service 的 Agentforce 附加组件是每用户每月 USD 125 或 GBP 100,覆盖不计量的员工侧智能体用量。Agentforce 1 Editions 起价为每用户每月 USD 550,每个组织每年含 250万 Flex Credits。
一点点数究竟花在什么上
公开的 Flex Credits Rate Card 于 2026 年 4 月 21 日更新,是签字之前该读的文件。它把标准动作和自定义动作都定为生产环境 20 点、沙箱 16 点。语音动作是 30 与 24。提示用量类型单独计费,基础、标准与高级提示分别为 2、4 与 16 点,而该表的脚注写明这些是在动作用量类型之外另行计收的。
这份表也给 Data 360 定了价,预算出错通常就出在这里。Data 360 Unification 在基础层倍率下,每处理百万行消耗 75,000 点。400万行就会耗尽 300,000 点的基础层,按公布费率折合 GBP 1,200,而此时智能体还没回答过任何一个问题。层级倍率在每个自然月的第一天重置。
语音又是单独计量的。语音转文字是每小时转写 150 点,文字转语音是每百万字符 6,000 点,翻译是每百万字符 4,000 点。跟 Data 360 相比这些都是小数目,但它们是叠加在 30 点的语音动作之上的,所以一套带语音的部署至少有三个计量表同时在转,必须按这个前提建模。
一份 Agentforce 成本算例
下面全部是给出明确假设的算例,不是报价。改变假设,答案就会变,这正是重点。
设想一家英国零售商,运行一个面向客户、处理订单状态与退货的服务智能体。假设每月有 1,200 次会话到达该智能体,每次会话三个标准动作(识别客户、取回订单、依知识库作答),生产环境,不含语音。
三个动作是 60 点,所以一次会话是 GBP 0.24。1,200 次会话每月就是 72,000 点,也就是 GBP 288,或 USD 360。换成会话计费,同样 1,200 次会话要 GBP 1,920。这不是四舍五入的差距,而是同样的工作贵了 6.7 倍。
现在把规模放大。每月 12,000 次会话时,同一个智能体消耗 720,000 点,每月 GBP 2,880,每年 GBP 34,560。相对它所抵消的人力成本,这仍然算温和。
接着把设计弄差。假设接地质量不好,智能体因为重试、追问澄清和反复查知识库,每次会话平均要用六个动作而不是三个。点数消耗翻倍到每年 GBP 69,120。许可没有变,业务量也没有变。智能体只是因为拿到的素材更差,所以想得更多。
没人算的那个盈亏平衡点
一次标准动作是 GBP 0.08,一次会话是 GBP 1.60。相除得到 20。只有当每次会话超过 20 个动作,会话计费才会更便宜,而这个数字与币种无关,因为 USD 的数字给出同样的比值。
在一次会话里用掉二十个动作,那不是有野心的智能体,而是坏掉的智能体。所以对几乎所有真实部署来说,Flex Credits 才是正确模式;会话计费只在你想要一个固定、可预测的单位成本,并且愿意为此付出很高溢价时才值得保留。
用量计费为什么会改变设计
在席位许可下,接地质量是个质量问题。在用量计费下它同时是个成本问题,而这个视角转换是本文最有用的一点。
每多一个动作就是又 20 点。在知识库里找不到答案的智能体不会安静地失败。它会再检索一次,再问一个澄清问题,并为此再烧掉 20 点。Salesforce 记载这个循环最多会跑 7 次,所以单个用户回合的最坏情况大约是最好情况的七倍。
动作设计也有同样的性质。三个各取一个字段的窄动作是 60 点;一个形状良好、返回整条记录的动作是 20 点。用户体验没有任何差别,账单差了三倍。
这就是我们把智能体设计与检索增强生成当成同一件事来谈的原因。检索层不是让回答更好的锦上添花。在这套计费模型下,它是决定你单位经济性的机制。
那项不算 AI 成本的数据前提
这里是厂商会跳过的部分。智能体的上限就是它所依据的知识,而在多数英国中型企业里,那些知识陈旧、彼此矛盾,散落在一个维基、一个共享盘、三个邮箱和某一个人的脑子里。
你没法在这种东西上给智能体做接地。真正会发生的是一个内容工程:找出每一个存放答案的地方,判定哪一版是权威的,删掉不是的,再把留下来的改写成检索系统找得到的样子。按我们的经验,项目成本的大部分落在这里,而这是文档成本,不是 AI 成本。
这一点值得说明白,因为它改变了商业论证。如果你从未审计过自己的知识库,那么一个 Agentforce 项目的诚实估算,大部分是清理你自家内容的钱。造智能体是便宜的那一半。
英国信息专员办公室的指引在这里是个有用的约束。其关于 AI 的数据最小化指引要求你识别达成目的所需的最少个人数据,并且不处理超出的部分。要把这件事做对,就得知道知识源里到底有什么,而那正是同一场审计。
护栏、测试与可观测性
判断一个智能体可以拿给客户用,是一项工程判断,而它需要证据。
主题,也就是当前构建器里的子智能体,是第一层边界。一个子智能体有自己的范围、一套指令,以及一份可调用动作的固定清单。没有匹配子智能体的请求会落到题外处理,而不是让智能体临场发挥。第二层是动作边界:一个无法发起退款的动作,不管提示怎么写都不会被说服去退款。
对面向客户的服务智能体,Salesforce 记载了一道最终响应校验步骤,用来检查拟发出的答案是否依据数据源、是否遵守子智能体的范围与指令、是否含有幻觉、未经证实的说法或提示注入痕迹。校验不通过的响应会被删除并重新生成,即使已经输出到一半。
测试也吃点数,所以要列进预算
Agentforce Testing Center 会针对生成或上传的场景批量跑测试,并对响应准确度、子智能体与动作校验、完整性、连贯性、简洁度、延迟和指令遵循度打分。Salesforce 明确警告说运行测试会消耗请求和点数,而且测试可能修改 CRM 数据,所以应当在沙箱里跑。
沙箱倍率是每个动作 16 点而不是 20 点。1,000 个平均四个动作的测试场景就是 64,000 点,每跑一次完整回归是 GBP 256。在构建期每周跑一次,测试就是预算里一条真实存在的开支。
升级到人工的路径应该长什么样
升级到人工是一件设计产物,不是兜底。它需要三个性质。它必须由证据而不是情绪触发,实务上就是针对连续检索失败、子智能体没有对应动作的请求,或用户明确要求找人的规则。它必须把完整对话记录和智能体碰过的记录一并带过去,好让人不必从头再问一遍。它还必须可度量,因为升级率是对偏转率这个数字唯一诚实的制衡。
上线时把阈值故意定低,再拿证据把它抬上去。第一周升级 40% 的会话、到第三个月降到 15% 的智能体,是一个进展顺利的项目。从第一天就只有 2% 的,通常不是答得准,而是被交代了不许升级。
Agentforce 部署会在哪里失败
偏转率量错了。 结束的会话不等于被解决的会话。如果客户放弃了对话、第二天早上打电话到客服中心,那么智能体记了一次偏转,而企业付了两遍钱。请用在设定的时间窗内是否随后出现人工工单来度量解决,而不是用会话终止。
替企业作出承诺的智能体。 真正花钱的失败,是智能体提出一笔它无权提供的退款、报出一个价格,或者答应一个交付日期。这是动作设计问题,不是模型问题。一个能写入承诺的动作要么需要审批环节,要么就不该存在。
在稀薄知识上产生幻觉。 一个只依据六篇过期文章的智能体会自信地答错,因为作答就是它的工作。响应校验有帮助,但消除不了这件事。
第三个月的成本惊吓。 试点跑在 Salesforce Foundations 给 Enterprise Edition 及以上版本的 100,000 点免费 Flex Credits 里。那是 5,000 次标准动作,按每次会话三个动作算大约 1,660 次会话,所以低量试点根本见不到账单。等真实业务量到来,发票就成了惊吓,而 Digital Wallet 的用量提醒正是为防这一幕而存在。另外要注意,未用完的点数不会结转到下一个订阅周期。
Agentforce 与自建智能体的比较
一家英国企业真正该做的比较,是 Agentforce 对上一个基于模型 API 自建、再接进 CRM 的智能体。两者都成立,而只要把问题摆对,这个决定并不难。
Agentforce 替你买下三样自建起来很贵的东西。平台集成是实打实的:动作以运行用户的权限读写 Salesforce 对象,这是一套你否则得自己设计的安全模型。审计轨迹和治理界面已经存在,而企业买家的采购流程一定会问。而且围绕模型调用的商务条款已经有人替你谈好了。
自建买到的是模型选择权和按令牌计算的经济性。这件事比听上去更重要。不论底层模型调用是 500 个令牌还是 50,000 个令牌,Agentforce 都按一个动作收 20 点。这个统一价在重检索调用上非常划算,在琐碎调用上则很不划算;而一个作为普通软件开发交付的定制智能体,可以按每次调用真实消耗来计价。
决策规则。 如果你的大多数动作是对 Salesforce 记录的读写,而且审计记录必须留在 Salesforce 里,那就买 Agentforce。如果大部分工作发生在 Salesforce 之外,或者你的量很大而单个动作都很便宜,自建会把每次动作压到 GBP 0.08 以下。我们带客户走的流程,和处理任何其他自建还是采购的决定一样,而答案通常由数据在哪里决定,而不是由软件决定。
合规:英国 GDPR 与欧盟 AI 法案
任何面向客户的智能体都会碰到两项义务,两项都得在上线之前而不是之后写清楚。
告知。 欧盟 AI 法案第 50 条第 1 款要求提供者确保,打算与自然人直接交互的 AI 系统在设计上让这些人知道自己正在与 AI 系统交互,除非对一个消息灵通、注意力正常且谨慎的人来说这是显而易见的。条例 (EU) 2024/1689 第 113 条规定该条例自 2026 年 8 月 2 日起适用,所以这是现行法律,不是未来的期限。它也及于那些智能体服务欧盟客户的英国企业。
自动化决定。 英国信息专员办公室关于与自动化决策相关的权利的指引写明,具有法律效果或类似重大影响的完全自动化决定,只有在履行合同所必需、由国内法授权,或基于明确同意时才合法,并且必须提供获得人工干预和对该决定提出异议的简便途径。还应当做数据保护影响评估。
上下文窗口里装了什么
有一个 Agentforce 特有的细节属于你的数据保护影响评估。Salesforce 记载,在 Einstein Trust Layer 中基于模式和基于字段的数据脱敏对智能体是关闭的,因为脱敏会拿走智能体准确作答所需要的上下文。与模型提供方的零数据留存合约仍然适用,Salesforce 托管的模型也把数据留在信任边界内,但脱敏是关着的。把这一点记录下来,而不要假设平台替你剥掉了个人数据。
企业买家还会问对话记录的留存立场、转交人工的升级路径,以及智能体范围经过测试的证据。在第一个客户碰到它之前就把这些写下来。我们更广的 AI 集成服务工作通常从这套文档开始,因为它才是卡住上线的那部分。
实施到底要花多少钱
以下是我们在英国交付的内部估算,不含 Salesforce 许可与用量费用,并且假设是一个范围清晰的面向客户智能体,而不是整个平台的铺开。
需求调研与用例界定是一到两周 GBP 4,000 到 GBP 8,000,它的任务是砍掉那些回不了本的用例。知识库整改是 GBP 8,000 到 GBP 30,000,也是最容易失控的一条,因为在有人把内容全读一遍之前,没人知道自家内容有多糟。
智能体本身的构建,也就是子智能体、指令、动作、接地配置和升级路径,是 GBP 12,000 到 GBP 35,000。与 Salesforce 之外系统的集成再加 GBP 6,000 到 GBP 20,000。测试、护栏设计与可观测性是 GBP 5,000 到 GBP 12,000。
一个现实的首年总额是 GBP 35,000 到 GBP 90,000 的专业服务费,外加用量费用。持续调优与监控是每月 GBP 1,500 到 GBP 4,000,而且不是可选项,因为随着你的产品和政策变化,指令质量会漂移。要与其他 AI 工作对照,我们的 AI 集成成本指南对非 Salesforce 的构建给出了同样的区间。
决定要不要往下走
当你的客户数据已经在 Salesforce 里、知识库状态尚可或者你愿意出钱把它修好、并且有一个三个动作就真能解决客户问题的用例时,Agentforce 是一笔合理的采购。当它被买来是为了躲开一个文档项目时,它就是一笔糟糕的采购,而这也是它最常令人失望的原因。
在承诺之前先把算术做完。用你现实的月会话量,乘以你现实的动作次数,再乘 GBP 0.08,然后按设计比你期望的更差把它翻一倍。如果这个数字仍然成立,这个项目就成立。同样的纪律适用于任何智能体项目,所以我们另外写过AI 智能体的成本与失败方式。
Mecanik 在 Salesforce 上以及其他地方构建和集成智能体,而这类工作通常从知识审计开始,而不是从智能体开始。如果你希望在签合同之前用你的真实业务量跑一遍成本模型,我们的 AI 集成服务与软件开发团队做的正是这件事,而答案有时候是你不该造它。
常见问题
Agentforce 每次动作要花多少钱? 一次标准的 Agentforce 动作消耗 20 点 Flex Credits。Salesforce 以每 100,000 点 USD 500 或 GBP 400 出售点数,所以一次标准动作在生产环境是 USD 0.10 或 GBP 0.08,在沙箱里是 16 点。语音动作消耗 30 点,也就是 USD 0.15 和 GBP 0.12。
Agentforce 的按会话计费还能用吗? 能用。每次会话 USD 2 或 GBP 1.60 的会话计费仍是 Salesforce 定价页上的有效选项,并未退役。它不能与 Flex Credits 在同一个组织里运行,但现有组织可以把会话 SKU 换成 Flex Credit SKU 来切换。
Agentforce 的两种计费模式哪一种更便宜? 用会话价格除以动作价格得到 20,所以只有在每次会话超过 20 个动作时,会话计费才会更便宜。多数设计良好的智能体用三到五个动作就能解决一个请求,因此在几乎所有真实部署里,Flex Credits 都便宜得多。
Agentforce 和聊天机器人有什么区别? 聊天机器人沿着你事先写好的脚本路径走,所以每次会话成本固定。Agentforce 智能体在运行时选择调用哪些动作,一边检查结果一边决定下一步,最多循环七次,所以它的行为和成本都随设计好坏而变化。
我需要告诉客户他们正在与 AI 智能体对话吗? 欧盟 AI 法案第 50 条要求提供者告知人们他们正在与 AI 系统交互,除非这是显而易见的,而该要求自 2026 年 8 月 2 日起已经适用。服务欧盟客户的英国企业在适用范围内,英国信息专员办公室另外要求,在自动化处理具有法律效果或类似重大影响时应有保障措施。
评论