Compare · 横评对比
Voyage AI vs Cohere:RAG 嵌入、重排费用与部署怎么选?
比较 Voyage 4、Rerank 3 与 Cohere Embed 5、Rerank 4 的模型档位、计费单位和部署路线。
| 维度 | voyage-ai | cohere |
|---|---|---|
| 嵌入主线 | Voyage 4 large / 标准 / lite | Embed 5 Pro / Fast |
| 重排主线 | Rerank 3 / 3-lite | Rerank 4 Pro / Fast |
| 检索输入任务 | query / document | search_query / search_document |
| 公共 API 嵌入费 | 按输入 token,$0.02–0.12/百万 | Embed 5 $0.08–0.12/百万 token |
| 公共 API 重排费 | 按处理 token,候选数量和长度影响费用 | 按 search unit,长文档可增加单位 |
| 企业部署 | API、云平台、客户 VPC 与定制部署询价 | API、云平台、Model Vault 专用实例 |
如果目标是在已有 RAG 系统里评估一组嵌入与重排 API,Voyage AI 和 Cohere 都应进入候选名单。Voyage 的按 token 计费便于核算候选长度;Cohere 公开 API 的重排按 search unit 计费。两家也提供云平台或企业部署选项。谁更适合,取决于资料类型、候选规模、部署条款和真实检索质量。
核心差异速览
| 维度 | Voyage AI | Cohere |
|---|---|---|
| 当前嵌入主线 | Voyage 4 large/标准/lite | Embed 5 Pro/Fast |
| 当前重排主线 | Rerank 3 / 3-lite | Rerank 4 Pro/Fast |
| 查询/文档任务 | query / document | search_query / search_document |
| 嵌入费用 | 标准接口按输入 token | 公共 API 按 token,专用部署另计 |
| 重排费用 | 处理 token | 公共 API 按 search unit |
| 部署评估 | API、云平台、客户 VPC 与定制部署询价 | API、云平台与 Model Vault 专用实例 |
Voyage 的试点路径
保持已有文档解析、chunk 规则和权限过滤,用 voyage-4-lite 建一个成本基线,再比较标准或 large 档位是否增加有效召回。Rerank 3 系列可直接处理第一阶段的候选,不需要先把 embedding 全部迁移过去,因此“保留原嵌入,只评估新 reranker”也是有效实验。
对照试验必须区分召回与排序:若正确证据从未进入候选,先检查切块、词法召回和向量模型;若正确证据在候选里但排得很后,再比较重排。不要同时换生成模型,否则难以说明是哪一层带来了改进。Voyage 官网还列出云平台、客户 VPC 及定制/本地部署路线;有专用部署要求时也应向它询价,核对地区、容量与许可。
Cohere 的试点路径
Cohere 于 2026 年 9 月 30 日发布 Embed 5 Pro/Fast,支持文本与多模态企业资料,Pro/Fast 共享嵌入空间。官方建议可用 Pro 做文档索引、Fast 处理查询;实际部署仍需统一维度和输出类型。Rerank 4 同样有 Pro/Fast 选项,适合分别测质量与延迟。
对需要专用资源或企业部署的团队,Cohere Model Vault 值得纳入采购,但其按实例/小时计费与公共 API 账单是两条预算。Trial key 可以试验,官网明确不允许生产或商业使用;正式上线要使用 Production key。应用仍要负责文档 ACL、删除、引用和生成结果的审核。
token 与 search unit 怎么算
Voyage 的处理 token 公式是:查询 token 数乘候选数量,再加候选 token 总数。以一个 50-token 查询和 20 个各 500-token 的候选为例,共处理 11,000 token;按 rerank-3 每百万 0.05 美元计算,同步重排约 0.00055 美元,未计免费额度、初始嵌入、向量库和生成。
截至 2026 年 10 月 10 日,Cohere 的实时公开 API 价格显示 Embed 5 Pro/Fast 每百万 token 分别为 0.12/0.08 美元,Rerank 4 Pro/Fast 每千 searches 为 2.50/2.00 美元。官网将一个 search unit 定义为一个查询最多 100 个文档;长文档可能按规则拆分并增加计费单元。因此不要把一次 HTTP 请求必然当成一个 unit,也不要把 Model Vault 每月实例费套到公共 API。
上述样例只能解释账单结构。中文 tokenizer、长文档切分、并发和免费额度会改变实际账单,需用同一批资料测量。
一周验收与选择
准备 50 个问题,覆盖中文、中英混合、长文档、表格文字、编号和缺少证据的情况。固定权限、chunk 和候选数,先测 Recall@20,再分别用四个重排档位测 MRR、前 5 条证据支持率、p95 延迟与费用。对所有输出做来源和版本核验;不能以 relevance score 作为自动批准业务操作的依据。
先跑 Voyage 按 token 计费的基线,并以相同题库对照 Cohere。多模态或专用部署需求较高时,分别向两家核对可用型号和部署条款。最终以业务质量、数据处理范围和总成本选择。
资料:Voyage 部署概览、Voyage 嵌入、Voyage 重排、Voyage 价格、Cohere Embed 5、Cohere 重排、Cohere 实时价格与计费 FAQ。
结论
两家都可进入嵌入与重排试点。Voyage 按处理 token 核算,Cohere 公共重排按 search unit;企业部署需分别询价,以业务题库、数据条款和完整成本选择。
常见问题
- Voyage Rerank 必须搭配 Voyage 嵌入吗?
- 不必。重排接收问题与候选文本,可接在已有向量检索或词法召回后单独试点。
- Cohere 当前嵌入和重排主线是什么?
- 截至 2026 年 10 月,官网展示 Embed 5 Pro/Fast 和 Rerank 4 Pro/Fast;上线时再核对账号可用型号。
- 一次 Cohere 重排 HTTP 请求就是一个 search unit 吗?
- 不应这样假定。官网按查询、候选数量及长文档切分定义 search unit,需按实际用量核算。
- Model Vault 月费是否等于 Cohere API 月费?
- 不同。Model Vault 是专用实例部署,公共 API 按对应 token 或 search unit 使用量计费。
- 免费试用能直接用于正式商业服务吗?
- 额度与使用许可是不同问题。Cohere Trial key 当前不允许生产或商业用途;各平台均需核对正式账号条款。
- 性能对比先看什么?
- 先确认正确证据进入候选,再看重排 MRR、引用支持率、延迟与总费用;不要把模型分数当成事实可信度。