← 全部文章
智能体周刊2026 年第 32 期

2026-W32 周刊:Agent 产品的定价怎么设计

本周智能体生态聚焦:给 Agent 定个价,比让 Agent 干活难多了 这周没有一份像样的 agent 定价讨论,各家发论文、发平台,但有一份报告值得停下来看一眼:人类审批 agent 命令,40k 次运行里漏掉了三分之一的威胁。这个数字直接打在「按结果付费」的脸上——结果本身都没法可靠验收,凭什么按结果收钱?我的看法不变:席位打底,用量封顶,成本风险先攥在自己手里。 这周新料不多,但缺席本身就是信号 Cloudflare 发了 [Cloudflare OS](https:

YGG 智能体周刊5 分钟阅读#weekly#agent#architecture#skills#2026

给 Agent 定个价,比让 Agent 干活难多了

这周没有一份像样的 agent 定价讨论,各家发论文、发平台,但有一份报告值得停下来看一眼:人类审批 agent 命令,40k 次运行里漏掉了三分之一的威胁。这个数字直接打在「按结果付费」的脸上——结果本身都没法可靠验收,凭什么按结果收钱?我的看法不变:席位打底,用量封顶,成本风险先攥在自己手里。

这周新料不多,但缺席本身就是信号

Cloudflare 发了 Cloudflare OS,想当 agent 和应用层的统一入口;artificialanalysis 也开始排 agentic index;ArXiv 上还有几篇 agent 评估、调试、检索的论文。可翻一遍,没人在正经讨论「一个 agent 任务到底该收客户多少钱」。缺席就是信号:大家连自己的成本曲线都还没跑明白,定价只能靠赌。

按席位卖,是大胃王自助餐

按席位最好卖,客户熟,采购表也好过。但它和你的成本完全脱钩——一个重度用户开十个并发 agent,你的推理账单是十份,客户付的还是那一份。自助餐遇上大胃王,利润会被一个人吃掉。编码 agent 尤其明显,一个工程师能同时挂一堆任务,AI 替他当牛马,账单我们来扛。

按 token 收,透明是个幻觉

按用量听起来公平,实则客户会看懵账单。token 单价透明,总量是黑洞。agent 干活跟人不一样:链式思考、工具调用、失败重试,一个 session 烧掉的 token 远超「感觉上的工作量」。上个月预算还好,下个月翻倍,客户打电话来质问,你跟他解释上下文窗口和缓存命中率,他不想听。更要命的是 token 数和你的成本也不是线性,算力预留是固定的,这层消化不了。

按结果收,最性感,也最容易扯皮

客户最爱你主动提出按结果付费。「结果」谁来定义?你说是 ticket 办完了,客户说是业务指标涨了,两个数差着十万八千里。今天的 agent 连自评都不可信——前面那份报告说了,人肉审批 40k 次运行,漏掉 1/3 威胁。人自己都验收不了 agent 干得好坏,你怎么按结果报价?

就算双方勉强同意了结果定义,「验收」本身也是钱。AV-AIVAT 那篇论文讲明白了一件事:判断两个 agent 谁强,要打无数局游戏,每局都烧钱、烧推理、烧专家时间。评估「agent 好不好」都这么贵,按结果收费的验收成本谁来出?出不起,最后只能变成销售和客户互相拉锯。

要我说,席位打底,用量封顶

具体做法:基础费按席位收,现金流可预测,客户好理解;每个席位带一个用量额度,正常用户永远碰不到线,超了就限速或补差价。难的是这条线画在哪。别拍脑袋——拿内部真实用户的 trace 回放一遍计费逻辑,看大多数用户自然落在什么区间,把线画在区间上沿,留点余量。等上下文压缩、缓存命中这些手段把成本压下来,再慢慢收紧。

定价本质是给未来的成本结构下注。6 个月后回头可能被今天的判断打脸,但至少先把「重度用户吃垮利润」这条风险摁住,再谈优化。

延伸阅读

编辑说明

本文由 YGG 臻星科技团队整理,聚合 ArXiv、HackerNews 与公开厂商博客,人工审稿。