MaxCompute涉及的术语及其概念_云原生大数据计算服务 MaxCompute(MaxCompute)-阿里云帮助中心

A

AccessKey
简称AK，包括AccessKey ID和AccessKey Secret，是访问阿里云API的密钥。在阿里云官网注册云账号后，可以在AccessKey管理页面生成该信息，用于标识用户，为访问MaxCompute、其他阿里云产品或连接第三方工具做签名验证。请妥善保管AccessKey Secret，必须保密，如果存在泄露风险，请及时禁用或更新AccessKey。
安全
MaxCompute提供多租户数据安全体系，主要包括用户认证、项目的用户与授权管理、跨项目的资源分享以及项目的数据保护。更多MaxCompute安全操作信息，请参见权限概述。

Console
即MaxCompute客户端，是运行在Window或Linux下的工具，您可以在MaxCompute客户端通过运行命令的方式完成项目管理、DDL、DML等操作。MaxCompute客户端的操作指导，请参见使用客户端（odpscmd）连接。

Data Type
MaxCompute表中列的数据类型。MaxCompute支持的数据类型版本及各版本的数据类型列表，请参见数据类型版本说明。
DDL
Data Definition Language，数据定义语言。例如创建表、创建视图等操作。更多DDL语法信息，请参见DDL语句。
DML
Data Manipulation Language，数据操作语言。例如INSERT、UPDATE、DELETE操作。更多DML语法信息，请参见DML操作。

Function（函数）
MaxCompute提供函数功能，包括内建函数和UDF。更多函数信息，请参见函数。
fuxi（伏羲）
伏羲是飞天平台内核中负责资源管理和任务调度的模块，同时也为应用开发提供了一套编程基础框架。MaxCompute的底层任务调度模块为fuxi的调度模块。

MapReduce
MapReduce是处理数据的一种编程模型，通常用于大规模数据集的并行运算。您可以使用MapReduce提供的接口（Java API）编写MapReduce程序，来处理MaxCompute中的数据。编程思想是将数据的处理方式分为Map（映射）和Reduce（规约）。

在正式执行Map前，需要将输入的数据进行分片。所谓分片，就是将输入数据切分为大小相等的数据块，每一块作为单个Map Worker的输入被处理，以便于多个Map Worker同时工作。每个Map Worker在读入各自的数据后，进行计算处理，最终通过Reduce函数整合中间结果，从而得到最终计算结果。详情请参见MapReduce。
MapReduce Backups
MapReduce Backups是MapReduce的一种加速调优方式。MaxCompute会查看您的任务，如果存在一些任务的工作量特别大，便为其开启备份任务，两个任务执行一样的数据，结果用最先执行结束的任务，因此存在Backups。但是如果任务量非常大，Backups也无法起作用，因为原本的任务和Backups都没有执行完成。

Networklink（网络连接）
当您使用外部表、UDF或湖仓一体功能时，MaxCompute默认未建立与外网或VPC网络间的网络连接，您需要开通网络连接以访问外网或VPC中的目标服务（例如HBase、RDS、Hadoop等）。更多开通网络连接信息，请参见网络开通流程。

Partition（分区）
分区Partition是指一张表下，根据分区字段（一个或多个字段的组合）对数据存储进行划分。如果表没有分区，数据是直接放在表所在的目录下。如果表有分区，每个分区对应表下的一个目录，数据是分别存储在不同的分区目录下。更多分区信息，请参见分区。
Project（项目）
项目是MaxCompute的基本组织单元，类似于传统数据库的Database或Schema的概念，是进行多用户隔离和访问控制的主要边界。更多项目信息，请参见项目。

Role（角色）
角色是MaxCompute安全功能中的概念，可以理解为拥有相同权限的用户的集合。多个用户可以同时存在于一个角色下，一个用户也可以隶属于多个角色。给角色授权后，该角色下的所有用户拥有相同的权限。更多角色管理信息，请参见角色规划。
Resource（资源）
资源是MaxCompute中特有的概念。当您使用MaxCompute的自定义函数（UDF）或MapReduce功能时，需要依赖资源来完成。更多资源信息，请参见资源。

SDK
Software Development Kit，软件开发工具包。一般都是一些被软件工程师用于为特定的软件包、软件实例、软件框架、硬件平台、操作系统、文档包等建立应用软件的开发工具的集合。MaxCompute支持Java SDK和Python SDK。
授权
项目管理员或者项目Owner可以授予其他角色对MaxCompute中的对象（例如表、任务、资源等）进行某种操作的权限，包括读、写、查看等。更多授权信息，请参见用户规划与管理。
沙箱（Sandboxie）
沙箱是一种按照安全策略限制程序行为的执行环境。沙箱机制是一种安全机制，将Java代码限定在特定的运行范围中，并且严格限制代码对本地系统资源访问，通过这样的措施来保证对代码的有效隔离，防止对本地系统造成破坏。MaxCompute MapReduce及UDF程序在分布式环境中运行时受到Java沙箱的限制。

Table（表）
表是MaxCompute的数据存储单元。更多表信息，请参见表。
Tunnel
MaxCompute的数据通道，提供高并发的离线数据上传下载服务。您可以使用Tunnel服务向MaxCompute批量上传数据或者向本地进行批量数据下载。相关命令请参见Tunnel命令或批量数据通道SDK。

UDF
User Defined Function，用户自定义函数。

广义的UDF代表了自定义标量函数、自定义聚合函数及自定义表值函数三种类型。MaxCompute支持通过Java、Python编程接口开发自定义函数，详情请参见MaxCompute UDF。

狭义的UDF指用户自定义标量函数（User Defined Scalar Function），它的输入与输出是一对一的关系，即读入一行数据，写出一条输出值。
UDAF
User Defined Aggregation Function，自定义聚合函数。它的输入与输出是多对一的关系，即将多条输入记录聚合成一条输出值。可以与SQL中的GROUP BY语句联用。详情请参见UDAF。
UDTF
User Defined Table Valued Function，自定义表值函数。它是唯一能返回多个字段的自定义函数。详情请参见UDTF。
User（用户）
用户是MaxCompute安全功能中的概念，MaxCompute支持您通过阿里云账号、RAM用户或RAM角色访问MaxCompute。非MaxCompute项目所有者（Project Owner）的用户必须被加入MaxCompute项目中，且被授予相应的权限，才能操作MaxCompute项目中的数据、作业、资源及函数。更多用户管理信息，请参见用户规划与管理。

View（视图）
视图是在表之上建立的虚拟表，它的结构和内容都来自表。一个视图可以对应一个表或多个表。如果您想保留查询结果，但不想创建表占用存储，可以通过视图实现。更多视图信息，请参见视图操作。