文本嵌入¶
为文档正文生成文本向量,并把向量附加到原文档记录中。
适用于需要在工作流内继续使用带向量文档的场景。如果目标是直接建立可检索知识库,使用嵌入并添加到知识库。
配置输入与模型¶
输入或配置 |
说明 |
|---|---|
文档 |
必须提供非空文档数组,通常来自解析、清洗或分段节点 |
模型 |
选择文本嵌入模型;未指定时使用工作区文本嵌入服务配置 |
选择支持文本嵌入的模型。未指定模型时,需要先配置可用的工作区文本嵌入服务。
使用输出¶
输出仍为 documents。节点对非空正文生成向量,填入对应文档的 embedding,并保留文档元数据。
生成的向量保存在输出文档中。需要持久保存时,继续连接写入节点;需要建立检索索引时,使用知识库写入节点。
示例:给分段结果附加向量¶
流程示意:文档解析 → 分段 → 文本嵌入。
将分段结果整体传入 documents,选择文本嵌入模型。检查输出时,核对正文与对应向量仍在同一文档记录中。
继续阅读¶
最后更新于