接入钉钉数据源

更新时间:
复制 MD 格式

AI原生数据库服务支持将钉钉作为数据源接入RAGFlow知识库。您可以将钉钉云盘中的文件或钉钉知识库中的文档同步至RAGFlow,用于构建企业级智能问答和知识检索服务。

支持的数据类型

数据类型

说明

钉钉云盘文件

支持同步钉钉云盘中的文档,包括PDF、Word、Excel、PPT等格式。

钉钉知识库文档

支持同步钉钉知识库中的在线文档。需通过KBSync工具在Linux环境下导出和同步。

前提条件

  • 已在AI原生数据库服务控制台创建RAGFlow实例。

  • 已在钉钉开放平台创建企业内部应用,并获取应用的Client ID(即AppKey)和Client Secret(即AppSecret)。

  • 如需同步钉钉知识库文档,运行KBSync工具的机器需满足以下条件:

    • 操作系统为Linux。

    • 已安装Chrome浏览器(用于文档渲染和导出)。

步骤一:配置应用权限

登录钉钉开放平台,进入已创建的企业内部应用,在权限管理页面添加以下6项权限。

权限名称

权限标识

用途

通讯录个人信息读权限

Contact.User.Read

获取员工UserID

通讯录部门信息读权限

Contact.Department.Read

读取部门信息

云盘文件只读权限

Drive.File.Read

读取云盘文件内容

云盘空间信息只读权限

Drive.Spaces.Read

获取云盘空间列表

知识库文档只读权限

Wiki.Doc.Read

读取知识库文档

知识库空间只读权限

Wiki.Space.Read

获取知识库空间列表

说明

添加权限后,需要在钉钉管理后台对应用进行授权,确保应用拥有访问企业数据的权限。

步骤二:获取员工UserID

获取需要同步数据的员工UserID。您可以通过以下方式获取:

  • 在钉钉管理后台的通讯录中查看员工详情,获取UserID。

  • 通过钉钉开放平台API调用/topapi/v2/user/getbymobile接口,根据手机号查询UserID。

步骤三:配置数据源并同步

登录AI原生数据库服务控制台,在左侧导航栏的AI 数据准备区域单击多模数据准备,单击目标RAGFlow实例进入详情页面,配置钉钉数据源。

同步钉钉云盘文件

在数据源配置中填写以下参数:

参数

说明

sourceType

设置为DingDing

Client ID

钉钉应用的AppKey。

Client Secret

钉钉应用的AppSecret。

UserID

步骤二中获取的员工UserID。

同步钉钉知识库文档

钉钉知识库文档需要通过KBSync工具进行同步。操作步骤如下:

  1. Linux环境中安装Chrome浏览器和KBSync工具。

  2. 配置KBSync工具参数,包括Client ID、Client Secret和目标员工的UserID。

  3. 运行KBSync工具,工具将自动导出钉钉知识库中的文档并同步至RAGFlow知识库。

重要

KBSync工具依赖Chrome浏览器进行文档渲染,请确保运行环境已正确安装Chrome。如使用无头模式,请确认Chrome版本支持--headless=new参数。

执行结果

数据源配置完成并同步成功后,钉钉中的文件和文档将出现在RAGFlow知识库中。您可以在AI原生数据库服务控制台的AI 数据准备 > 多模数据准备页面单击目标实例,查看同步状态和已导入的文档列表。