Skip to content

知识库配置

在知识库模块,您可以创建和管理知识库,上传各种格式的文件,并生成内容总结。知识库是智能体的重要信息来源,让智能体能够访问您的私有数据和文档。

🔧 创建知识库

  1. 点击左侧知识库列表上方的"创建知识库"按钮
  2. 在弹出的创建面板中,填写以下配置项:
配置项说明
知识库名称必填,名称必须唯一,且只能包含中文字符或小写字母,不允许空格、斜杠等特殊字符。系统会在输入时自动检测名称是否重复
向量模型选择用于文档向量化的 Embedding 模型。模型分为两类:文本向量模型(embedding)多模态向量模型(multi_embedding)。选择多模态向量模型后,知识库将自动支持图片等非文本内容的向量化处理。详见向量模型说明
用户组选择知识库可见的用户组(多选),控制哪些用户组可以查看和使用该知识库
组内权限设置用户组内成员对该知识库的操作权限:编辑(EDIT) - 可上传/删除文件;只读(READ_ONLY) - 仅可查看和检索;私有(PRIVATE) - 仅创建者可用
保留源文件开启后,上传的原始文件会被保留存储在系统中,方便后续重新处理或下载;关闭则仅保留向量化后的数据
存储配额可选,为该知识库设置存储上限(支持 GB/MB 单位切换)。当上传文件导致存储用量接近配额时,系统会发出预警提示
  1. 配置完成后,在下方文件上传区域选择要上传的文件(可跳过,后续再上传)
  2. 文件上传后系统自动创建知识库并开始处理文件

创建知识库

📁 上传文件

上传文件

  1. 在知识库列表中选择要上传文件的知识库
  2. 点击文件上传区域,选择要上传的文件(支持多选),或直接拖拽文件到上传区域
  3. 系统会自动处理上传的文件,提取文本内容并进行向量化
  4. 可在列表中查看文件的处理状态

文件大小限制

单个文件上传大小限制为 20 MB。超过此限制的文件将无法上传。

文件处理状态

文件上传后会经过多个处理阶段,共有 6 种状态:

状态说明
等待处理文件已上传,排队等待开始解析
解析中系统正在提取文件文本内容
入库中文本内容正在进行向量化并写入向量数据库
已就绪文件处理完成,可正常检索使用
解析失败文件解析过程中出错。将光标移至状态图标可查看详细错误原因和排查建议
入库失败向量化入库过程中出错。将光标移至状态图标可查看详细错误原因和排查建议

💡 光标移动至状态图标,以了解当前处理进度(如"已处理 23/50 个分片")及失败状态的报错原因

文件进度与错误提示

支持的文件格式

Nexent支持多种文件格式,包括:

  • 文本: .txt, .md, .json文件
  • PDF: .pdf文件
  • Word: .docx文件
  • PowerPoint: .pptx文件
  • Excel: .xlsx文件
  • EPUB .epub文件
  • 数据文件: .csv文件
  • Web content: .html, .xml文件

📊 知识库总结

建议您为每个知识库配置准确且完整的总结描述,这有助于后续智能体在进行检索时,准确选择合适的知识库。

手动生成与编辑总结

  1. 点击知识库名称右侧的"详细内容"按钮,进入知识库概览页面
  2. 在概览页面选择合适的大语言模型(LLM),点击"自动总结"按钮为知识库自动生成内容总结
  3. 您可对生成的内容总结进行编辑修改,使其更准确
  4. 最后记得点击"保存"将您的修改保存

内容总结

自动总结频率

除了手动触发总结,您还可以为知识库设置定时自动总结,让系统在后台定期重新生成知识库的内容总结:

频率选项说明
1 小时高频更新,适用于内容变化频繁的知识库
3 小时中高频更新
6 小时中频更新
1 天每天更新一次,适用于大多数场景
1 周每周更新一次,适用于内容较为稳定的知识库

在概览页面的总结区域选择频率即可。系统会智能判断知识库是否有文档更新,若无新文档变更则跳过本次自动生成,避免不必要的资源消耗。

📂 Chunk 分片管理

文档上传后,系统会将文档拆分为多个 Chunk(分片),每个分片包含一段文本内容并生成对应的向量索引。您可以对分片进行精细化管理:

查看分片

  1. 点击知识库名称进入文档列表
  2. 点击上方"Chunk 详情"标签页
  3. 页面顶部会列出知识库中的所有文档,点击某个文档即可查看该文档被拆分出的全部分片
  4. 分片以卡片形式展示,包含分片内容和所属文件名

搜索分片

在 Chunk 详情页使用搜索框进行搜索,系统会同时对结果进行关键词匹配和语义匹配(混合搜索),按综合相关性排序展示。

手动管理分片

操作说明
创建在 Chunk 详情页手动添加自定义分片内容
编辑点击分片卡片进入编辑模式,修改分片文本内容
删除删除不需要的分片
下载将分片内容导出下载

模型兼容性限制

分片的编辑和创建操作依赖向量模型的一致性。如果模型配置发生变化,相关操作可能被自动禁用,以防止产生不兼容的向量数据。

分片管理

🧩 向量模型说明

系统中的 Embedding 模型分为两类:

  • 文本向量模型(embedding):用于纯文本文档的向量化,如 BGE、M3E 等
  • 多模态向量模型(multi_embedding):可同时处理文本和图片内容,如 DashScope、Jina 等

知识库创建时选择的向量模型会与该知识库绑定。建议在创建知识库时根据文档类型选择合适的模型,创建后该模型将贯穿知识库的整个生命周期。

🔧 使用知识库

Nexent 支持知识库与智能体绑定。创建智能体时,在工具配置区域启用对应的知识库检索工具,并选择关联的知识库。

根据知识库来源的不同,系统提供对应的检索工具。Nexent 原生知识库使用 knowledge_base_search 工具:

工具1

工具2

在工具配置弹窗中,您可看到已绑定的知识库列表,支持搜索和勾选操作。每个知识库旁边会显示其向量模型信息,帮助您确认兼容性。

🔍 知识库管理

查看知识库

  1. 知识库列表

    • 知识库页面左侧展示了所有已创建的知识库
    • 知识库列表处支持按名称搜索、按知识库来源和向量模型筛选
    • 每张知识库卡片展示以下信息:
    信息项说明
    知识库名称创建时设定的名称
    文档数量已上传的文档总数
    分片数量文档拆分后的 chunk 总数
    来源知识库来源(Nexent 原生 / 外部来源)
    创建时间知识库创建日期
    向量模型绑定的 Embedding 模型名称
    多模态标签若启用多模态则显示
    用户组标签该知识库可见的用户组名称
    权限图标当前用户对该知识库的操作权限(将光标移至图标查看说明)
    无源文件标签若已关闭"保留源文件"则显示
  2. 知识库详情

    • 点击知识库名称,可查看知识库中全部文档信息
    • 点击"详细内容",可进入知识库概览页面查看和编辑内容总结

点击编辑,可管理知识库的名称、可见的用户组及组内权限

知识库权限

编辑知识库

  1. 删除知识库

    • 点击知识库名称右侧"删除"按钮
    • 确认删除操作(此操作不可恢复)
  2. 删除或新增文件

    • 点击知识库名称,在文件列表中点击"删除"按钮,可从知识库中删除文件
    • 点击知识库名称,在文件列表下方文件上传区域,可新增文件到知识库中

🚀 下一步

完成知识库配置后,建议您继续配置:

  1. 智能体开发 - 创建和配置智能体
  2. 开始问答 - 与智能体进行交互

如果您在使用过程中遇到任何问题,请参考我们的 常见问题 或在GitHub Discussions中进行提问获取支持。