voyage-context-4 是一种上下文化的数据块嵌入模型,可为捕获完整文档上下文的数据段生成向量,而无需任何手动元数据和上下文增强。与有或没有增强相比,这可以提高检索准确性。该模型也更简单、更快且更便宜。它可作为标准嵌入的直接替代品,无需更改下游工作流程,并降低了分块策略的敏感性。
要学习;了解更多信息,请参阅博客文章。。
可用型号
模型 | 上下文长度 | 维度 | 说明 |
|---|---|---|---|
| 120,000 tokens * | 1024(默认)、256、512、2048 | 针对通用和多语言检索质量优化的上下文化数据块嵌入。 |
注意
* 如果为 enable_auto_chunk = true,则所有输入的词元总数不得超过 120K;否则,不得超过 32K。
最新模型在质量、上下文长度、延迟和吞吐量等各个方面都比旧版模型表现更好。
模型 | 上下文长度 | 维度 | 说明 |
|---|---|---|---|
| 120,000 tokens * | 1024(默认)、256、512、2048 | 针对通用和多语言检索质量优化的上下文化数据块嵌入。 要学习更多信息,请参阅博客文章。 |
Tutorial
有关使用上下文化数据数据块嵌入的教程,请参阅使用 Voyage AI Embeddings 进行语义搜索。