对于 AI 代理:可在 https://www.mongodb.com/zh-cn/docs/llms.txt 获取文档索引—通过在任何 URL 路径后添加 .md 可获取所有页面的 Markdown 版本。
Docs 菜单

上下文化数据块嵌入

voyage-context-4 是一种上下文化的数据块嵌入模型,可为捕获完整文档上下文的数据段生成向量,而无需任何手动元数据和上下文增强。与有或没有增强相比,这可以提高检索准确性。该模型也更简单、更快且更便宜。它可作为标准嵌入的直接替代品,无需更改下游工作流程,并降低了分块策略的敏感性。

要学习;了解更多信息,请参阅博客文章。

模型
上下文长度
维度
说明

voyage-context-4

120,000 tokens *

1024(默认)、256、512、2048

针对通用和多语言检索质量优化的上下文化数据块嵌入。

注意

* 如果为 enable_auto_chunk = true,则所有输入的词元总数不得超过 120K;否则,不得超过 32K。

仍可通过API访问以下旧模型,但建议使用新模型,以提高质量和效率。

最新模型在质量、上下文长度、延迟和吞吐量等各个方面都比旧版模型表现更好。

模型
上下文长度
维度
说明

voyage-context-3

120,000 tokens *

1024(默认)、256、512、2048

针对通用和多语言检索质量优化的上下文化数据块嵌入。

要学习更多信息,请参阅博客文章。

有关使用上下文化数据数据块嵌入的教程,请参阅使用 Voyage AI Embeddings 进行语义搜索。