基本介绍
BGE 是北京智源人工智能研究院的检索模型家族,主要包括向量嵌入和重排模型。它常用于知识库、语义搜索和检索增强生成,让系统依据问题找到相关资料,再交给语言模型形成回答。
为什么要分两步检索
嵌入模型适合从大量内容中快速获取候选,重排模型再细看问题与每条候选资料的关系。BGE-M3 等分支还提供多种检索表示,具体索引方式应与模型能力对应。
更换模型的影响
不同语言、维度和检索形式不能随意混用。更新向量模型时,应重新检查文档索引、查询编码和召回效果,使用真实问题评估是否找到正确证据。
模型与版本目录
AI搜索 · 22 项
| 模型与版本 | 完整标识 | 版本状态 |
|---|---|---|
| bge-base-en | BAAI/bge-base-en | 开放权重 |
| bge-base-en-v1.5 | BAAI/bge-base-en-v1.5 | 开放权重 |
| bge-base-zh | BAAI/bge-base-zh | 开放权重 |
| bge-base-zh-v1.5 | BAAI/bge-base-zh-v1.5 | 开放权重 |
| bge-en-icl | BAAI/bge-en-icl | 开放权重 |
| bge-large-en | BAAI/bge-large-en | 开放权重 |
| bge-large-en-v1.5 | BAAI/bge-large-en-v1.5 | 开放权重 |
| bge-large-zh | BAAI/bge-large-zh | 开放权重 |
| bge-large-zh-v1.5 | BAAI/bge-large-zh-v1.5 | 开放权重 |
| bge-m3 | BAAI/bge-m3 | 开放权重 |
| bge-multilingual-gemma2 | BAAI/bge-multilingual-gemma2 | 开放权重 |
| bge-reranker-base | BAAI/bge-reranker-base | 开放权重 |
| bge-reranker-large | BAAI/bge-reranker-large | 开放权重 |
| bge-reranker-v2-gemma | BAAI/bge-reranker-v2-gemma | 开放权重 |
| bge-reranker-v2-m3 | BAAI/bge-reranker-v2-m3 | 开放权重 |
| bge-reranker-v2-minicpm-layerwise | BAAI/bge-reranker-v2-minicpm-layerwise | 开放权重 |
| bge-reranker-v2.5-gemma2-lightweight | BAAI/bge-reranker-v2.5-gemma2-lightweight | 开放权重 |
| bge-small-en | BAAI/bge-small-en | 开放权重 |
| bge-small-en-v1.5 | BAAI/bge-small-en-v1.5 | 开放权重 |
| bge-small-zh | BAAI/bge-small-zh | 开放权重 |
| bge-small-zh-v1.5 | BAAI/bge-small-zh-v1.5 | 开放权重 |
| llm-embedder | BAAI/llm-embedder | 开放权重 |
价格与使用条件
官方价格与使用条件 ↗。产品订阅、按量调用与自行部署具有不同成本,选择前结合任务量和所需功能计算。