A
|
AccumulatedRelativeError
|
累积相对误差算法。
精度比对算法之一,计算结果取值范围为0到无穷大,值越接近于0,表明越相近,值越大,表明差距越大。
|
Advisor
|
专家系统。
用于聚焦模型和算子的性能调优Top问题,识别性能瓶颈,重点构建模型和算子瓶颈分析并提供优化推荐,支撑开发效率提升的工具。
|
ADK
|
Ascend Development Kit,解决方案提供的开发者套件包。
通过安装相关软件包后获得开发必需的API、库、工具链等开发组件。
|
AI
|
Artificial Intelligence,人工智能。
研究、开发用于模拟、延伸和扩展人的智能的理论、方法、技术及应用系统的一门新的技术科学。
|
AI CPU
|
昇腾AI处理器上提供的用于通用计算的CPU,主要负责AI CPU算子计算和确定性任务的调度。
|
AIPP
|
Artificial Intelligence Pre-Processing,AI预处理。AIPP用于在AI Core上完成图像预处理,包括改变图像尺寸、色域转换(转换图像格式)、减均值/乘系数(改变图像像素),数据处理之后再进行真正的模型推理。
|
AMCT
|
Ascend Model Compression Toolkit,昇腾模型压缩工具。
是一个针对昇腾芯片亲和的深度学习模型压缩工具包,提供量化、张量分解等多种模型压缩特性,压缩后模型体积变小,部署到NPU IP加速器上后可使能低比特运算,提高计算效率,达到性能提升的目标。
|
AOE
|
Ascend Optimization Engine,昇腾调优引擎。
用于封装调优过程中的ATC编译及AscendCL运行服务接口,提供并行调优功能。
|
AOL
|
Ascend Operator Library,昇腾算子库。
|
AscendCL
|
Ascend Computing Language,昇腾编程语言。
提供运行时管理、单算子调用、模型推理、媒体数据处理等API,能够实现利用底层硬件计算资源,在CANN平台上进行深度学习推理计算、图形图像预处理、单算子加速计算等。
|
Ascend IR
|
Ascend Intermediate Representation,昇腾AI处理器专用的、用于表达计算流程的抽象数据结构。在本文档中,若无特殊说明,IR默认指代Ascend IR。
|
ATC
|
Ascend Tensor Compiler,昇腾张量编译器。
- 通过ATC,可以将开源框架的网络模型(如Caffe、TensorFlow等)转换成NPU IP加速器支持的离线模型。模型转换过程中可以实现算子调度的优化、权值数据重排、内存使用优化等
- 通过ATC,可以进行算子编译。
|
B
|
Batch
|
模型训练的一次迭代(即一次梯度更新)中使用的样本集。
|
Batch size
|
模型迭代一次,使用的样本集的大小。
|
BIU
|
Bus Interface Unit,总线接口单元。AI Core与总线交互的接口。
|
C
|
CANN
|
Compute Architecture for Neural Networks,异构计算架构。
CANN是昇腾针对AI场景推出的异构计算架构,对上支持多种AI框架,对下服务AI处理器与编程,发挥承上启下的关键作用,是提升昇腾AI处理器计算效率的关键平台。同时针对多样化应用场景,提供高效易用的编程接口,支持用户快速构建基于昇腾平台的AI应用和业务。
|
CNN
|
Convolutional Neural Network,卷积神经网络。
是一种前馈神经网络,人工神经元可以响应周围单元,可以进行大型图像处理。
|
CosineSimilarity
|
余弦相似度算法。
精度比对算法之一,计算结果取值范围为[-1,1],比对的结果如果越接近1,表示两者的值越相近,越接近-1意味着两者的值越相反。
|
Cube
|
AI Core上的Cube计算单元,负责执行矩阵运算。Cube每次执行可完成两个float16类型的16x16矩阵的乘法操作。
|
D
|
DataFlow
|
用于描述完整的计算流,该计算流由一个或多个计算处理点采用数据队列以数据驱动方式组成。
|
DDP
|
Distributed Data Parallel,分布式数据并行。
|
DDR
|
Double Data Rate,双倍数据速率。
严格的说DDR应该叫DDR SDRAM,人们习惯称为DDR,其中,SDRAM是Synchronous Dynamic Random Access Memory的缩写,即同步动态随机存取存储器。而DDR SDRAM是Double Data Rate SDRAM的缩写,是双倍速率同步动态随机存储器的意思。DDR内存是在SDRAM内存基础上发展而来的,仍然沿用SDRAM生产体系,因此对于内存厂商而言,只需对制造普通SDRAM的设备稍加改进,即可实现DDR内存的生产,可有效的降低成本。
与传统的单数据速率相比,DDR技术实现了一个时钟周期内进行两次读/写操作,即在时钟的上升沿和下降沿分别执行一次读/写操作。
|
DL
|
Deep Learning,深度学习。
是机器学习的分支,是一种试图使用包含复杂结构或由多重非线性变换构成的多个处理层对数据进行高层抽象的算法。
|
DVPP
|
Digital Vision Pre-Processing,数字视觉预处理。
提供对特定格式的视频和图像的进行解码、缩放等预处理操作,以及对处理后的视频、图像进行编码再输出的能力。
|
单算子比对
|
精度比对工具里Tensor比对的一种方式。选择网络模型中一个或多个参与计算的算子进行精度比对。
|
E
|
ECC
|
Error Checking and Correction,错误检查和纠错技术。
该技术在原来的数据位中增加校验位,通过检验位来检测数据错误,并具备错误纠正能力。
|
EMMC
|
Embedded Multimedia Card,多媒体存储卡。
是一种新的存储技术,外部提供的接口和SD卡接口类似,内部存储介质为Flash,并且内建坏块管理系统。
|
Epoch
|
数据集的一次完整遍历。
|