[控场AI]
· 3 分钟阅读· 1,577 字

Perplexity Decision API 降价 50%:输入价降至百万token 2美分

Perplexity Decision API 降价 50%:输入价降至百万token 2美分

Perplexity 将 Decision API 输入价格再度砍半至每百万 token 2 美分,加剧 AI API 市场价格竞争。

Perplexity 宣布 Decision API 的输入 token 价格再次减半,降至每百万 token 仅 2 美分。这是一次纯粹的价格调整,并不涉及功能升级,但在当前 AI API 市场普遍降价的背景下,释放出厂商通过压低推理成本争夺开发者生态的明确信号。Decision API 面向需要基于实时信息进行判断的应用场景,其内置的检索增强生成流程会显著放大输入 token 消耗,因此此次降价对 RAG 类和高频调用类应用的成本优化效果尤为突出。不过,官方此次仅公布了输入端定价,开发者在做完整成本测算时,仍需参考官方页面了解输出定价及速率限制等完整信息。

Perplexity 再度下调 Decision API 价格

Perplexity 宣布其 Decision API 的定价在原有基础上再次砍半,输入 token 的费用降至每百万 token 2 美分(2 cents per million input tokens)。这一调整直接降低了开发者调用该 API 的使用成本,对需要高频、大规模调用的应用场景尤其友好。

Perplexity Decision API 降价公告

从消息本身来看,这是一次纯粹的价格调整,而非功能层面的升级。但在当下 AI API 市场价格战愈演愈烈的背景下,这样的降价动作释放出明确信号:各家厂商正通过持续压低推理与调用成本来争夺开发者生态。

价格下探背后的行业逻辑

输入 token 定价降至每百万 2 美分,意味着处理海量文本的边际成本被进一步压缩。对于构建决策类、检索增强类应用的团队而言,这类成本优化会直接影响产品的毛利结构和可扩展性。

过去一段时间,主流 AI 服务商普遍走在降价通道上——无论是基础大模型 API,还是围绕搜索、决策、检索等垂直能力封装的专用接口。Perplexity 以搜索和实时信息检索见长,其 Decision API 面向的正是需要基于最新信息做出判断的应用场景。价格减半,有助于让更多中小开发者和初创团队将其纳入技术栈。

Decision API 是 Perplexity 推出的一类专用接口,其核心能力是在联网实时检索的基础上,对用户提出的问题给出结构化的判断或建议,而非仅返回原始搜索结果。与通用大模型 API 不同,Decision API 内置了检索增强生成(RAG)流程——它会先从互联网或指定数据源抓取最新信息,再结合语言模型进行推理,最终输出一个可供程序直接使用的决策性结论。这使其特别适合构建价格比较、产品推荐、竞品分析、实时舆情判断等需要"当下信息 + 推理"的应用场景。输入 token 的计费通常覆盖用户传入的提示词及检索召回内容,而输出 token 则对应模型返回的最终结果,两者共同构成完整的调用成本。

对开发者意味着什么

对使用 Decision API 的开发者来说,最直接的收益是成本减半。原本因预算限制而受限的调用量,现在可以在同样预算下翻倍,这为产品迭代和规模化测试提供了更大空间。

需要留意的是,官方此次公布的仅是输入 token 价格(input tokens),输出端定价、速率限制及其他计费细节并未在该消息中明确提及。开发者在做成本测算时,仍应以 Perplexity 官方定价页面的完整信息为准,综合评估输入与输出两端的实际开销。

检索增强生成(Retrieval-Augmented Generation,RAG)是当前 AI 应用开发中的主流架构之一。其基本思路是:在模型生成回答之前,先通过检索系统获取与问题相关的外部文档或实时数据,再将这些内容作为上下文拼入提示词,帮助模型给出更准确、更具时效性的答案。这种架构的优势在于无需重新训练模型即可注入新知识,但代价是提示词长度(即输入 token 数量)会随检索内容的增加而显著增长。因此,输入 token 的单价对 RAG 类应用的运营成本影响尤为突出——Perplexity 此次降价对这类场景的成本优化效果,往往比普通问答类应用更为明显。

小结

Perplexity Decision API 输入价格降至每百万 token 2 美分,是 AI API 市场持续价格竞争的又一个注脚。对追求成本效率的团队而言,这是一个值得关注的调整,但完整的性价比评估还需结合输出定价与实际业务调用模式来判断。

分享:

相关推荐