知识库(Knowledge)
知识库让 Lyncore 记住你的资料,并在对话时自动检索、注入上下文,实现"问什么答什么、引原文标出处"。
版本:个人版与企业版均支持(个人版用本地向量库,企业版用 pgvector)。
混合检索
Lyncore 采用 向量检索 + BM25 全文检索 的混合方案:
- 融合公式:
finalScore = vectorWeight × (1 + vecScore) + keywordWeight × kwScore - BM25 参数
k1 = 1.5 - 兼顾"语义相似"与"关键词命中",比单一向量检索更稳
上传与索引
- 新建知识库并命名
- 上传文档
- 系统自动完成「分块(ChunkSize 500 / Overlap 100)→ 生成 embedding → 存储」
支持格式(上传白名单):
- 文本 / 数据:
TXTJSONPDFCSVXLSXLSX - 多模态:
PNGJPGJPEGGIF(用于图片理解) - ❌ 不支持
.md/.docx直接上传 - 单文件上限 50MB
对话挖掘(Conversation Mining)
Lyncore 能从历史对话中自动提炼知识:仅处理 assistant 消息且内容 > 50 字符,按优先级 warning > procedure > fact 分类沉淀为知识,反哺后续检索。
管理接口(企业版为主,个人版有别名)
| 能力 | 企业版路径 | 个人版别名 |
|---|---|---|
| 文档管理 | /api/v1/knowledge/documents | /create、/:kb_id/upload |
| 检索 | /api/v1/knowledge/search | /search |
| 对话挖掘 | /api/v1/knowledge/mining | /mining* |
提示
- 文档太杂会稀释检索质量,建议按主题拆分知识库
- 用更具体的问题触发更精准的命中
- 重新上传文档可触发重新向量化