欢迎来到尧图网

客户服务关于我们

您的位置：首页 > 科技 > IT业 > 如何选择向量数据库Milvus Cloud合适的 Embedding 模型？

如何选择向量数据库Milvus Cloud合适的 Embedding 模型？

2024/10/24 5:19:10 来源：https://blog.csdn.net/qinglingye/article/details/140084268 浏览: 次关键词：如何选择向量数据库Milvus Cloud合适的 Embedding 模型？

检索增强生成（RAG）是生成式 AI （GenAI）中的一类应用，支持使用自己的数据来增强 LLM 模型（如 ChatGPT）的知识。

RAG 通常会用到三种不的AI模型，即 Embedding 模型、Rerankear模型以及大语言模型。本文将介绍如何根据您的数据类型以及语言或特定领域（如法律）选择合适的 Embedding 模型。

1

文本数据：MTEB 排行榜

HuggingFace 的 MTEB leaderboard 是一个一站式的文本 Embedding 模型榜！您可以了解每个模型的平均性能。

您可以将“Retrieval Average”列进行降序排序，因为这最符合向量搜索的任务。然后，寻找排名最高、占内存最小的模型。

Embedding 向量维度是向量的长度，即 f(x)=y 中的 y，模型将输出此结果。
最大 Token 数是输入文本块的长度，即 f(x)=y 中的 x ，您可以输入到模型中。

除了通过 Retrieval 任务排序外，您还可以根据以下条件进行过滤：

语言：支持法语、英语、中文、波兰语。（例如：task=retrieval,

Language=chinese）
法律领域文本。

（例如：task=r

版权声明:

本网仅为发布的内容提供存储空间，不对发表、转载的内容提供任何形式的保证。凡本网注明“来源：XXX网络”的作品，均转载自其它媒体，著作权归作者所有，商业转载请联系作者获得授权，非商业转载请注明出处。

我们尊重并感谢每一位作者，均已注明文章来源和作者。如因作品内容、版权或其它问题，请及时与我们联系，联系邮箱：809451989@qq.com，投稿邮箱：809451989@qq.com

相关资讯

热文排行

最新新闻

推荐新闻

热搜词

申请https证书 Python项目内网环境pdm install超时httpx.ReadTimeout: timed out 好奇心漫谈 org.json.JSONException: No value for ec是什么错误？虹科免拆诊断案例 | 保时捷卡宴V6发动机失火诊断故障码和发动机警告灯之谜 Skydel 24.9版本震撼发布，升级五大关键功能