模型简介
llama-nemotron-rerank-vl-1b-v2 是NVIDIA的检索重排模型,根据查询与候选内容的相关性重新排序,用于搜索和知识问答的资料筛选。
NVIDIA 的模型目录包括 Nemotron 语言与推理模型,以及文档解析、语音和其他专用方向。
这个版本怎样理解
使用时以完整型号 nvidia/llama-nemotron-rerank-vl-1b-v2 为准。同一系列的其他版本可能改变输入范围、默认行为或运行配置,升级前可先对照下方参数与官方说明。
版本与模型标识
| 模型名称 | llama-nemotron-rerank-vl-1b-v2 |
|---|---|
| 模型 / 资源标识 | nvidia/llama-nemotron-rerank-vl-1b-v2 |
| 版本标识 | llama-nemotron-rerank-vl-1b-v2 |
| 版本状态 | 官方模型目录 |
NVIDIA 目录同时包含下载权重与托管推理服务,具体交付方式、许可和资源要求以模型卡为准。
放在召回之后使用
先由关键词或向量检索取得一批候选,再把问题与候选内容交给重排模型。输出分数或排序用于缩小资料范围,模型本身并不承担完整知识回答的写作。
实际使用时重点看什么
检查正确资料能否进入前几项,同时记录候选数量、文本长度和处理时间。分数的含义与具体接口有关,不宜直接拿不同模型的分值做统一比较。
价格与计费说明
查看官方计费与使用条件 ↗。API、产品订阅与自行部署是不同使用方式;开放权重不等于免费托管调用。
官方网址与文档
同厂商模型
- nemotron-3-embed-1b · 官方模型目录
- llama-nemotron-embed-vl-1b-v2 · 官方模型目录
资料来源
型号、版本与参数依据以上官方公开资料整理。