Summary
Tikoly 支持的所有模型的每百万 Token 成本分析。DeepSeek v4 Flash 为高吞吐智能体任务提供最低的每 Token 成本。
摘要
Tikoly 的定价团队分析了 15 个支持模型的每百万 Token 成本,综合考虑了输入、输出、缓存输入和推理 Token 费率。DeepSeek v4 Flash 是高吞吐智能体工作负载中最具成本效益的选择,而高级推理模型(o1、DeepSeek R1)因其复杂多步骤任务能力而定价较高。
主要发现
- 输入 Token 范围:$0.15/百万(DeepSeek v4 Flash)至 $15.00/百万(o1 含推理)
- 缓存输入折扣:所有支持模型的缓存命中均享受输入费率五折优惠
- 推理 Token 溢价:思考模型的内部推理 Token 消耗可达可见输出的 5-10 倍
- 套餐影响:Enterprise 级别(1 亿 Token,$30)将大多数模型的有效每 Token 成本降至 $0.30/百万以下
方法论
每个模型针对五个标准任务配置文件进行了基准测试:代码生成、翻译、PR 分析、多轮对话和深度研究。Token 计数通过 pi-ai 的 Usage 接口捕获,并与 tikoly.com 的费率表相乘计算。