AI智能体成本怎么算?三种方案的月度账单拆解
AI智能体成本不能只看订阅价或 token 单价。本文以每月回复 1,000 封客服邮件为例,拆解成品助手、无代码工作流平台和自建 API 三种方案的账单,说明额度、年付首笔支出、重试、工具调用与人工审核怎样影响预算,帮你算清每条审核通过回复的真实成本,并判断哪种方案适合团队持续运营。

AI智能体成本该怎么算?以每月处理 1,000 封客服邮件为例,下文测算的软件预算分别是:成品智能体 $82,按年付费的托管工作流平台折合每月 $25.50,自建 API 工作流 $10.50。三种方案都需要邮箱、人工审核,以及系统出错时的负责人。真正值得关注的是:在一个月的账单里,每条审核通过的回复到底花了多少钱。
使用 AI 智能体,通常有三种付费方式
AI 智能体会调用模型完成任务,并在你使用的工具中执行操作。用于客服时,它可能先读邮件,再查相关政策,最后拟好回复。单独购买模型,并不包含邮箱接入、审批流程或完整的客服服务。
账单取决于这套系统中有多少部分由供应商提供:
- **成品智能体:**购买现成的助手,通常按订阅或席位付费。一个席位就是一个付费用户账号。订阅方案下还可能设有用量额度。
- **无代码工作流平台:**自己连接各个步骤,再按积分、任务或工作流执行次数付费。一次执行指完整跑完一遍流程;积分则是供应商用来计量任务消耗的单位。
- **自建 API 工作流:**由自己的软件通过 API 调用模型。API 是程序向模型发出任务请求的接口。你需要支付 token 费用,也就是模型读取和生成的文本片段费用,另外还要承担托管和付费工具的支出。
三种方案完成的是同一项工作,但责任分工不同。创业者可以买现成的邮箱草稿服务,运营负责人可以自行搭建流程,后端团队则可以开发并维护运行这套流程的软件。
本文价格于 2026 年 10 月 7 日在各厂商官网核对,金额均为 USD 美元。年付价格会单独标明,示例总额都是基于明确假设做出的预算预测,并非性能测试结果。初期配置所花的工时,应与持续发生的账单分开记录。
厂商报价怎么比?先看清计费单位
表中的模型价格采用常规费率,不含缓存、批处理折扣或加速服务溢价。同一封邮件交给不同模型,token 消耗和回复质量都可能不同。只有回复达到你的客服标准,更低的单价才有意义。
其他几行也要仔细看。Lindy 的入门价格,并不保证能回复 1,000 封邮件:起草回复适用日常任务的计费规则,而这类任务的用量范围很宽,为 2 到 250 积分;发送邮件还需要批准。增加活跃用户,就会增加付费席位。详见 Lindy 的用量和审批规则。
Gumloop 的积分也不只用于文本。按现行用量计费规则,每积分按 $0.005 计,每次成功调用连接器至少收取 1 积分,活跃会话每分钟收取 5 积分,此外还要加上常规的 8% 编排费。详见 Gumloop 完整积分计费规则。
如果使用自己的模型 API 密钥,工具和计算费用仍需支付,而且按现行用量计费政策,智能体编排费会变为 16%;老账号可能仍适用旧规则。这笔费用以整次运行原本的总成本为基数,其中也包括转由模型供应商收取的模型费用。不能只按平台上剩余的工具费用计算。
AI智能体成本测算:每月回复 1,000 封客服邮件
把任务说具体:一家小企业每月收到 1,000 封独立的客服邮件,都可以依据现有政策作答。工作流负责拟好回复,再由人工审核并发送通过审核的内容。
预算中预留 100 次额外起草尝试,合计 1,100 次尝试。这相当于预留 10% 的余量,并不代表任何产品的实际重试率。示例不含附件、互联网搜索或付费数据补全,现有邮箱费用也不计入新增软件费用小计。
工作流平台和 API 方案均假设:每次完整尝试消耗 3,000 个输入 token 和 400 个计费输出 token。这只覆盖一次模型调用;若工作流要多次调用模型,就应合计所有调用的用量。成品服务自行决定内部模型用量,因此要看它公布的任务计费规则。
方案 1:Marblism 原生邮件起草功能,每月 $82
SaaS 创业者使用 Marblism 的 Eva 时,费用从共享的计费时数中扣除。这些是固定的任务计费值,并非按 AI 实际运行时长计时:整理一封新邮件扣 20 秒,起草一条回复扣 5 分钟。详见 Marblism 的任务计费值与容量档位。
完成这项任务需要:
- 整理 1,000 封新邮件:1,000 × 20 秒 = 5.56 小时。
- 请求 1,100 次回复草稿,包含额外尝试:1,100 × 5 分钟 = 91.67 小时。
- 计费用量合计:97.22 小时。
这些用量能放进按月付费 $82 的 100 小时方案,但超出了基础的 $44、50 小时方案。若选择年付,100 小时档位折合 $45/月,需要按年付款。账号内其他 AI 任务也会消耗同一个时数池。
Eva 在邮箱中生成草稿,由人工审核并点击发送。因此,这份预算买到的是辅助回复客服邮件的能力,审批工作仍由你负责。详见 Eva 如何处理回复。
这里还有一个容易忽略的容量问题。Marblism 对一次应用集成操作或自动化运行,另外按 25 秒计费。如果每次尝试都增加一次这样的操作,就会多用 7.64 小时,总用量达到 104.86 小时,需要升级到 $120/月的 150 小时档位。$82 的估算仅覆盖原生的邮件整理和起草;增加其他操作前,先核对用量明细。
方案 2:n8n 搭配 Claude,折合每月 $25.50
电商运营负责人可以把收到的客服邮件、相关政策和模型调用串起来,再保存草稿供人工审核。n8n 的 Gmail 集成支持读取邮件和创建草稿,Anthropic 集成则支持使用自己的 API 密钥。参见 Gmail 操作说明、Anthropic 凭据配置。
假设每次尝试对应一次完整工作流执行,1,100 次执行在 Starter 的 2,500 次额度内。同一次运行中的各个步骤,不会分别算作一次执行;但额外触发的运行仍会占用额度。详见 n8n 的执行次数定义与方案说明。
使用自己的 Anthropic 密钥,模型费用单独计算:
1,100 × 3,000 = 3.3 百万个输入 token。
1,100 × 400 = 0.44 百万个输出 token。
按已核对的 Haiku 费率,3.3 × $1 + 0.44 × $5 = $5.50。再加上年付方案折合 $20/月,软件预算就是折合 $25.50/月。Starter 由 n8n 托管,因此本例不另加托管订阅费用。
还要区分 n8n 的两类积分余额。Assistant 积分用于辅助搭建和排查工作流;Gateway 积分用于支付工作流运行时调用模型的费用。本例使用自己的 Anthropic 密钥,不使用 Gateway 积分。Assistant 的积分额度不能抵扣这笔模型账单。详见两套积分体系。
方案 3:自建 Claude API 工作流加托管,每月 $10.50
后端团队可以在自己的应用中运行同样一套边界明确的流程:接收邮件、提供政策、请求草稿,并保存给人工审核。在上述 token 用量假设下,Haiku 仍是 $5.50/月。
给托管费用选一个具体参照:Cloudflare Workers Paid 每个账号每月 $5 起,包含 10 百万次请求,以及 30 百万毫秒的 CPU 时间。本例假设应用及其小型数据存储都在所含额度内。详见 Workers 与所含数据服务的价格。
软件费用小计为 $5.50 + $5 = $10.50/月。前提是已有邮箱,不使用额外的付费工具,也没有其他任务消耗该账号的额度。Workers 另有 Free 方案,但其限制是否适合你的实现,需要另行核对。
如果保持 token 用量不变,Sonnet 的 token 费用为 $11,加上上述托管费用则为 $16。GPT-6 Luna 的 token 费用为 $0.55,加上托管则为 $5.55。这只是费率比较,不能证明三个模型处理你的邮件时效果相同。
API 软件费用小计较低,也意味着团队需要承担维护责任:邮箱连接、草稿存储、错误处理和模型行为都由你们负责。测出实际工作量后,可进一步阅读 Claude API 定价指南,了解模型费率、缓存和批处理。
一个任务要用多少 token,怎么估算?
先盘点模型收到的全部内容,而不只是客户邮件。指令、历史消息、政策片段、工具描述和工具返回结果,都可能计入输入 token。后续每次调用模型时,其中一些内容还可能被再次处理。参见 Claude 工具调用的 token 计费说明。
做第一版预算表时,可以假设指令占 800 个 token,邮件和往来记录占 400 个,相关政策占 1,800 个,合计 3,000 个输入 token。草稿则假设需要 400 个计费输出 token。这些只是待实测替换的预算参数,并非厂商承诺的典型用量。
按所选模型统计完整输入
把完整请求提交到模型的 token 计数端点。Claude 的计数工具免费,并针对具体模型统计,但结果仍是估算值;对于使用大多数托管工具或外部工具连接的请求,应改看实际响应中的用量。靠字数粗估,不能确定最终账单。参见 Claude token 计数说明。
实测完整任务的用量
用有代表性的邮件跑一遍真实配置。记录每次模型调用的计费输入和输出,包括额外草稿及重试。若启用了缓存,单独记录缓存用量。使用积分制平台时,要看完整的任务费用拆解:点击 Gumloop 聊天顶部的积分数,可以展开明细面板。参见 Gumloop 费用明细。
乘以尝试次数,再加固定费用
每次尝试的成本 =(输入 token × 输入费率 + 输出 token × 输出费率)÷ 1,000,000。月度 token 费用 = 每次尝试的成本 × 月度尝试次数。最后加上平台或托管费用,以及单独计量的工具费用。
使用 Haiku 时,(3,000 × $1 + 400 × $5) ÷ 1,000,000 = 每次尝试 $0.005。1,100 次尝试就是上文的 $5.50。如果一个任务需要多次模型调用,先加总这些调用的费用,再乘以每月任务量;不能只计算最终草稿的费用。

哪些成本最容易漏算?
**人工审核和修改。**假设每封通过审核的邮件需要 30 秒审核,1,000 条回复就需要 500 分钟,即 8.33 小时。如果每条需要一分钟,则是 16.67 小时。把实测的审核、修改和转交工时,乘以你自己的综合小时成本,包括用工附加成本。再与原来处理同一批邮件所需的时间比较。
**重试和额外判断。**示例预留了 100 次额外尝试。智能体还可能通过不同的模型调用完成请求分类、信息检索和草稿检查。即使你只把审核通过的回复计为成果,这些调用和失败的任务也都应计入月度账单。
**工具调用。**token 账单低,并不意味着工具费用都已包含。Claude 网页搜索每 1,000 次收费 $10,搜索结果还会产生 token 费用。如果本例每次尝试都搜索一次,就会增加 $11 搜索费,以及更多输入 token。只依据自有政策作答的客服智能体,可能完全不需要搜索。参见 Claude 搜索定价。
**数据和其他 API。**检查工作流使用的邮箱、客服工单系统、CRM、数据库、文档存储和数据补全服务。方案包含某个连接器,只意味着可以连接该服务,并不自动包含所连接服务的订阅费或用量费。把已有成本和新增成本都列清楚,才能同时算出总运营预算,以及这个智能体带来的额外支出。
**维护和容量。**凭据失效、政策文档过时、模型行为变化,仍需要有人处理,应记录维护工时。订阅额度也有上限:其他任务可能消耗同一时数池或积分池,迫使你升级到更高档位。

对于按已解决问题计费的客服智能体,客服系统自建还是租用的成本指南讨论了另一种采购决策。其中的项目经济账,应与本文的持续软件费用预测分开计算。
上线后的前 30 天,该记录什么?
- **结果:**收到的邮件数、审核通过的回复数、重新打开的问题,以及转交人工的案例。
- **所有计费单位:**付费用户数、时数、积分、执行次数、输入/输出 token,以及计费工具调用次数。
- **额外工作:**每条审核通过的回复需要尝试多少次、修改多少次,以及重复运行多少次。
- **人工时间:**审核、转交和维护的工时,并与原有流程比较。
- **其他费用:**托管、存储、所连接的 API,以及下一个容量档位的价格。
- **每条审核通过回复的成本:**将所有可归属的软件、工具和人工费用,除以审核通过的回复数。如果还统计已解决问题数,应单独跟踪每个问题的解决成本。
选择团队能持续运营的方案
SaaS 创业者如果希望这周就能用上邮箱草稿,可以从成品助手开始。购买前,先按整个邮件队列核对额度,并明确谁来审核。好处是有现成可用的操作界面;要关注的指标,则是每个付费月能产出多少条审核通过的回复。
电商运营负责人如果需要整合邮件、政策和订单数据,可以选择工作流平台。先试跑完整流程,查看执行次数或积分明细。与更简单的草稿服务比较费用前,把付费的订单数据查询也算进去。
后端负责人如果有人员可以持续维护工作流,可以选择 API 方案。从一项边界明确的客服任务开始,评估达到回复标准所需的最低成本模型。只有持续投入的工程和审核工时也在预算内,节省 token 费用才有帮助。
这套方法也适用于其他场景。销售负责人应统计每条跟进消息和每次数据补全操作,而不只是联系过多少条线索。财务运营人员应统计每份定时报表的数据获取、模型调用和审核,再把审核通过的报表与它替代的人工耗时比较。
如果还说不清什么结果才算正确,或谁负责处理异常,先缓一缓大范围自主运行。如果现有的规则式工作流已能可靠完成任务,引入模型就会多一笔账单,而收益尚未得到证明。
订阅邮件通讯,获取更多实用的工具与预算拆解。
- 最近更新
- 2026年10月7日







