重排序成本计算器
托管重排序服务的计费方式并不相同。Cohere 按次检索收费 —— 一个 query 加最多 100 篇文档,与长度无关;Voyage 则按 token 收费。因此哪家更便宜,取决于你的段落有多长、一次重排多少条。把你自己的数字填进去看看。
你的负载
每月成本
| 方案 | 计费单位 | 计费量 | 每月成本 |
|---|
为什么排名会变
按次计费对段落长度不敏感:重排 50 段 80 token 的内容,和重排 50 段 800 token 的内容价格完全一样。按 token 计费则随你发送的全部内容线性增长。由此可得一条简单经验:
- 段落短、top-k 大 —— 按 token 计费通常更划算,因为你实际付费的文本很少。
- 段落长 —— 按次计费通常更划算,而且分块每多一个 token,这个优势就更大一分。
- top-k 超过 100 —— Cohere 每次查询会多计一次检索,成本是阶梯式跳升而非平滑上升。
盈亏平衡点:—
那自托管呢?
自托管没有按调用计的价格,所以它不适合放进上面的表里 —— 你是用 GPU 账单加运维成本换掉了用量账单。只有放到你自己的量级上比较才有意义:把每月 GPU 成本除以上面的查询次数,再和表中的每次查询成本对比。每月几十万次查询以下,API 通常比一块专属 GPU 便宜;远高于这个量级后,自托管 Qwen3-Reranker 或 bge-reranker-v2-m3 才开始划算。服务端怎么搭见我们的自托管指南。
另外,模型小并不等于差 —— Jina Reranker v3 以 0.6B 的体量拿到 61.94 的 BEIR nDCG@10,所以最省资源的那个,可能同时也是最准的那个。
假设与来源
- Cohere Rerank 4 —— Pro 每次检索 $0.0025,Fast 每次检索 $0.002;一次检索指一个 query 加最多 100 篇文档。候选超过 100 会按多次检索计费。
- Voyage rerank-2.5 —— 每 100 万 token $0.05,
rerank-2.5-lite每 100 万 token $0.02。计费 token 包括 query 和你发送的每一篇文档。每个账号前 2 亿 token 免费,Batch API 另有 33% 折扣;上表两者均未计入。 - token 数为近似值 —— 各家分词方式不同,本页是用你填的平均值相乘,而非对真实文本做分词。
- 价格核对于 2026 年 8 月。做预算前请以 Cohere 与 Voyage 的最新价格为准。