Ascend C提供一组Conv3D高阶API,方便用户快速实现3维卷积正向矩阵运算。3维正向卷积的示意图如图1,其计算公式为:

Cin为Input的输入通道大小Channel;Din为Input的Depth维度大小;Hin为Input的Height维度大小;Win为Input的Width维度大小;Cout为Weight、Output的输出通道大小;Dout为Output的Depth维度的大小;Hout为Output的Height维度大小;Wout为Output的Width维度大小;下文中提及的M维度,为卷积正向操作过程中的输入Input在img2col展开后的纵轴,数值上等于Hout * Wout。
Channel、Depth、Height、Width后续简称为C、D、H、W。
除上述基础运算外,在Conv3D计算中可以设置参数Padding、Stride和Dilation,具体含义如下。
使用Conv3D高阶API实现Conv3D运算的具体步骤如下:
1 2 3 4 5 6 7 8 |
#include "lib/conv/conv3d/conv3d_api.h" using inputType = ConvApi::ConvType<AscendC::TPosition::GM, ConvFormat::NDC1HWC0, bfloat16_t>; using weightType = ConvApi::ConvType<AscendC::TPosition::GM, ConvFormat::FRACTAL_Z_3D, bfloat16_t>; using outputType = ConvApi::ConvType<AscendC::TPosition::GM, ConvFormat::NDC1HWC0, bfloat16_t>; using biasType = ConvApi::ConvType<AscendC::TPosition::GM, ConvFormat::ND, float>; // 可选参数 Conv3dApi::Conv3D<inputType, weightType, outputType, biasType> conv3dApi; |
创建对象时需要传入Input、Weight和Output参数类型信息;Bias的参数类型为可选参数,不带Bias输入的卷积计算场景,不传入该参数。类型信息通过ConvType来定义,包括:内存逻辑位置、数据格式、数据类型。
1 2 3 4 5 6 |
template <TPosition POSITION, ConvFormat FORMAT, typename TYPE> struct ConvType { constexpr static TPosition pos = POSITION; // Conv3d输入或输出在内存上的位置 constexpr static ConvFormat format = FORMAT; // Conv3d输入或者输出的数据格式 using T = TYPE; // Conv3d输入或输出的数据类型 }; |
|
参数 |
说明 |
|---|---|
|
TPosition |
内存逻辑位置。
|
|
ConvFormat |
|
|
TYPE |
数据类型。
注意:输入输出的矩阵数据类型需要对应,具体支持的数据类型组合关系请参考表2。 |
1 2 3 |
Conv3dApi::Conv3D<inputType, weightType, outputType, biasType> conv3dApi; TPipe pipe; // 初始化TPipe conv3dApi.Init(&tiling); // 初始化conv3dApi |
1 2 3 4 5 6 7 8 9 10 11 12 13 |
conv3dApi.SetWeight(weightGm); // 设置当前核的输入weight在gm上的地址 if (biasFlag) { conv3dApi.SetBias(biasGm); // 设置当前核的输入bias在gm上的地址 } // 设置input各个维度在当前核的偏移 conv3dApi.SetInputStartPosition(diStartPos, mStartPos); // 设置当前核的cout,dout,m大小 conv3dApi.SetSingleOutputShape(singleCoreCout, singleCoreDout, singleCoreM); // 当前Conv3D仅支持单batch的卷积计算,多batch场景通过for循环实现,在循环间计算当前batch的地址偏移 for (uint64_t batchIter = 0; batchIter < singleCoreBatch; ++batchIter) { conv3dApi.SetInput(inputGm[batchIter * inputOneBatchSize]); // 设置当前核的输入input在gm上的地址 } |
1 2 3 4 5 |
for (uint64_t batchIter = 0; batchIter < singleCoreBatch; ++batchIter) { ... conv3dApi.IterateAll(outputGm[batchIter * outputOneBatchSize]); // 调用IterateAll完成Conv3D计算 ... } |
1 2 3 4 |
for (uint64_t batchIter = 0; batchIter < singleCoreBatch; ++batchIter) { ... conv3dApi.End(); //清除EventID和释放内部申请的临时内存 } |