接入钉钉数据源
AI原生数据库服务支持将钉钉作为数据源接入RAGFlow知识库。您可以将钉钉云盘中的文件或钉钉知识库中的文档同步至RAGFlow,用于构建企业级智能问答和知识检索服务。
支持的数据类型
数据类型 | 说明 |
钉钉云盘文件 | 支持同步钉钉云盘中的文档,包括PDF、Word、Excel、PPT等格式。 |
钉钉知识库文档 | 支持同步钉钉知识库中的在线文档。需通过KBSync工具在Linux环境下导出和同步。 |
前提条件
已在AI原生数据库服务控制台创建RAGFlow实例。
已在钉钉开放平台创建企业内部应用,并获取应用的Client ID(即AppKey)和Client Secret(即AppSecret)。
如需同步钉钉知识库文档,运行KBSync工具的机器需满足以下条件:
操作系统为Linux。
已安装Chrome浏览器(用于文档渲染和导出)。
步骤一:配置应用权限
登录钉钉开放平台,进入已创建的企业内部应用,在权限管理页面添加以下6项权限。
权限名称 | 权限标识 | 用途 |
通讯录个人信息读权限 | Contact.User.Read | 获取员工UserID |
通讯录部门信息读权限 | Contact.Department.Read | 读取部门信息 |
云盘文件只读权限 | Drive.File.Read | 读取云盘文件内容 |
云盘空间信息只读权限 | Drive.Spaces.Read | 获取云盘空间列表 |
知识库文档只读权限 | Wiki.Doc.Read | 读取知识库文档 |
知识库空间只读权限 | Wiki.Space.Read | 获取知识库空间列表 |
添加权限后,需要在钉钉管理后台对应用进行授权,确保应用拥有访问企业数据的权限。
步骤二:获取员工UserID
获取需要同步数据的员工UserID。您可以通过以下方式获取:
在钉钉管理后台的通讯录中查看员工详情,获取UserID。
通过钉钉开放平台API调用
/topapi/v2/user/getbymobile接口,根据手机号查询UserID。
步骤三:配置数据源并同步
登录AI原生数据库服务控制台,在左侧导航栏的AI 数据准备区域单击多模数据准备,单击目标RAGFlow实例进入详情页面,配置钉钉数据源。
同步钉钉云盘文件
在数据源配置中填写以下参数:
参数 | 说明 |
sourceType | 设置为 |
Client ID | 钉钉应用的AppKey。 |
Client Secret | 钉钉应用的AppSecret。 |
UserID | 步骤二中获取的员工UserID。 |
同步钉钉知识库文档
钉钉知识库文档需要通过KBSync工具进行同步。操作步骤如下:
在Linux环境中安装Chrome浏览器和KBSync工具。
配置KBSync工具参数,包括Client ID、Client Secret和目标员工的UserID。
运行KBSync工具,工具将自动导出钉钉知识库中的文档并同步至RAGFlow知识库。
KBSync工具依赖Chrome浏览器进行文档渲染,请确保运行环境已正确安装Chrome。如使用无头模式,请确认Chrome版本支持--headless=new参数。
执行结果
数据源配置完成并同步成功后,钉钉中的文件和文档将出现在RAGFlow知识库中。您可以在AI原生数据库服务控制台的AI 数据准备 > 多模数据准备页面单击目标实例,查看同步状态和已导入的文档列表。