Skip to content

LangChain 全部 Splitter,其实只需要其中的一个

上节我们学了 loader 和 splitter:知识可能有各种来源,比如一个视频、一个 pdf、一个网页、一个 word 文档,这时候就需要通过各种 loader 从中提取信息,把它们转换成 Document。但是 Document 可能会很大,需要用 Splitter 分割成一个个比较小的 Document(chunk),之后用嵌入模型,把分块的文档向量化后存入向量数据库。

阅读

基于 VitePress 构建 · 专注前端与 AI 实战