概述

更新时间:
复制 MD 格式

向量检索服务 Milvus 版提供企业级知识服务能力,构建了从文档解析、内容切片、向量化、混合检索、重排优化到大模型生成的端到端全链路。它能够将分散在文档、表格、图片及音视频中的多源私有知识,高效转化为可检索、可问答、可追溯、可持续运营的核心数字化资产。

功能说明

知识库覆盖知识应用的完整生命周期,包含数据接入、知识治理、索引构建、检索增强、问答生成和版本发布等环节。您既可以在控制台完成知识库创建、数据导入与检索验证,也可以通过 OpenAPI 与 SDK 将检索能力集成到自己的业务系统中。

依托阿里云 Milvus 在向量数据库领域的检索能力积累,知识库可支撑从百万级、千万级到十亿级向量数据的语义检索场景。您可以在准确率、召回速度、资源成本与并发能力之间灵活平衡:高频知识优先保障低延迟访问,海量历史资料通过分层存储降低成本,查询压力增长时通过扩展计算资源提升吞吐。

核心概念

概念

说明

业务空间

知识库的管理单元。同一地域下的知识库归属于业务空间,控制台默认提供默认业务空间

知识库类型

知识库的服务规格,当前为标准版,在知识库列表的知识库类型列展示。

数据类型

决定知识库可接收的数据形态,创建时二选一且不可更改:全模态知识库按文档版面解析分段,适用于内容丰富、版面复杂的资料;结构化知识库按表格行生成切片,可指定一个或多个字段参与向量化。

向量模型

将数据与查询转换为向量的模型,创建时指定且不可更改。可选内置模型(如 text-embedding-v3,向量维度 1024)或私有/外部模型(接入您自有的 OpenAI 兼容模型服务)。

知识库

按场景或领域组织知识内容的实体,ID 形如 kd-1d6d96067c5f1。创建时需指定数据类型、向量模型、规格配置与网络,其中数据类型与向量模型创建后不可更改。

数据

导入知识库的原始文件或结构化内容,支持本地上传与 OSS 导入两种方式。

处理策略

决定数据如何被解析与切分。系统提供默认策略(智能切分,最大长度 512 字符),您也可以新建自定义策略。

切片

数据经处理策略切分后的最小检索单元,检索结果以切片为粒度返回。

版本

知识库内容的快照。数据变更后需发布版本,检索时通过版本号(如 v1)或 LATEST_PUBLISHED 指定检索范围。

支持的数据格式

创建知识库时需选择数据类型,可选全模态知识库结构化知识库,创建后不可更改。选择全模态知识库时支持以下格式:

mp4mp3pngpdfppttxtmarkdowndocsxlsxcsvjsonlfaq

说明

文件名应能表达文档主题,文档正文应包含完整标题和上下文,这有助于提升检索命中质量。

应用场景

智能客服

导入产品手册、常见问题、服务政策与故障排查指南,通过语义检索理解用户的不同表达方式,提升长尾问题命中率。检索结果返回命中数据与原文片段,便于坐席确认依据;知识更新通过版本化发布生效,降低口径不一致的风险。

企业内部知识助手

整合分散在各部门的制度规范、业务流程、会议纪要、项目资料与技术文档。员工使用自然语言提问即可定位所需信息,无需记住准确标题或关键词,并支持从多份资料中关联相关信息。

行业资料检索

面向金融、政务、制造、医疗等行业,统一处理法规、标准、报告、标书、说明书等不同格式的资料,识别专业概念与上下文条件,汇总跨数据的相关片段并保留原文出处便于复核。

重要

在合规、医疗等高要求场景中,检索与生成结果仅作为辅助材料,最终判断仍应由专业人员完成。

个人知识库

上传个人文档、笔记等资料,围绕已积累的内容完成检索与问答。具体操作请参见搭建个人知识问答应用

支持的地域

知识库当前在华东1(杭州)、华北2(北京)、华北3(张家口)、华南1(深圳)提供服务。控制台左侧导航的 知识库服务 入口在各地域均可见,但仅在上述地域可用;在其他地域单击后会返回控制台概览页。

说明

知识库当前处于邀测阶段,需由后台为您的阿里云账号添加白名单后方可使用。如需申请免费试用名额,请联系技术支持。

使用限制

  • 知识库名称需为 2~64 个字符,不支持中文,且在同一租户内唯一。

  • 创建知识库时可在高级配置中预先定义标签字段,单个知识库最多定义 180 个字段;标签用于导入数据时标注,并支持检索过滤。

  • 创建知识库时必须选择规格配置(当前最小规格为 4CU,4 vCPU / 16 GiB)与网络配置(专有网络与交换机),创建完成后可在详情页调整规格配置。

  • 版本发布、数据导入等管理操作在控制台完成;OpenAPI 与 SDK 当前提供获取预签名地址、注册数据、检索三类接口。

后续步骤

端到端搭建一个知识问答应用:搭建个人知识问答应用