模型简介
rerank-v4.0-fast 是Cohere的检索重排模型,根据查询与候选内容的相关性重新排序,用于搜索和知识问答的资料筛选。
这个型号的输入模态为 Text;上下文窗口为 32k。该型号属于系列中的效率取向分支。选择时可以重点记录等待时间、连续任务吞吐和单次任务成本,同时使用相同材料检查输出质量,避免只凭名称判断速度或准确率。
这个版本怎样理解
使用时以完整型号 rerank-v4.0-fast 为准。同一系列的其他版本可能改变输入范围、默认行为或运行配置,升级前可先对照下方参数与官方说明。
版本与模型标识
| 模型名称 | rerank-v4.0-fast |
|---|---|
| 模型 / 资源标识 | rerank-v4.0-fast |
| 版本标识 | rerank-v4.0-fast |
| 版本状态 | 官方在用目录 |
能力与参数
| 输入模态 | Text |
|---|---|
| 上下文窗口 | 32k |
放在召回之后使用
先由关键词或向量检索取得一批候选,再把问题与候选内容交给重排模型。输出分数或排序用于缩小资料范围,模型本身并不承担完整知识回答的写作。
实际使用时重点看什么
检查正确资料能否进入前几项,同时记录候选数量、文本长度和处理时间。分数的含义与具体接口有关,不宜直接拿不同模型的分值做统一比较。
价格与计费说明
查看官方计费与使用条件 ↗。API、产品订阅与自行部署是不同使用方式;开放权重不等于免费托管调用。
官方网址与文档
同厂商模型
- embed-v4.0 · 官方在用目录
- embed-english-v3.0 · 官方在用目录
- embed-english-light-v3.0 · 官方在用目录
- embed-multilingual-v3.0 · 官方在用目录
- embed-multilingual-light-v3.0 · 官方在用目录
- rerank-v4.0-pro · 官方在用目录
- rerank-v3.5 · 官方在用目录
- rerank-english-v3.0 · 官方在用目录
资料来源
型号、版本与参数依据以上官方公开资料整理。
