--precision_mode

功能说明

设置网络模型的精度模式。

关联参数

当取值为allow_mix_precision时，如果用户想要在内置优化策略基础上进行调整，自行指定哪些算子允许降精度，哪些算子不允许降精度，则需要参见--modify_mixlist参数设置。
推理场景下，使用--precision_mode参数设置整个网络模型的精度模式，可能会有个别算子存在性能或精度问题，该场景下可以使用--keep_dtype参数，使原始网络模型编译时保持个别算子的计算精度不变，但--precision_mode参数取值为must_keep_origin_dtype时，--keep_dtype不生效。

关联参数示意图如图1所示。

图1 关联参数示意图

设置具体算子精度模式场景下：

首先读取--op_precision_mode参数，校验该参数的ini配置文件是否存在，若存在则解析文件并读取算子的精度模式，否则上报异常。
--op_precision_mode不存在则读取--op_select_implmode参数：
1. 首先检测是否配置为high_xxx_for_all参数，若是则解析high_xxx_for_all.ini文件并读取算子的精度模式。
2. 若配置为high_xxx参数，则检测是否配置--optypelist_for_implmode参数，若是，则读取该参数配置的算子精度模式；否则解析high_xxx.ini文件并读取算子的精度模式。

参数取值

参数值：

force_fp32：表示网络模型中算子支持float16和float32时，强制选择float32，若原图精度为float16，也会强制转为float32。
如果网络模型中存在部分算子，并且该算子实现不支持float32，比如Conv2D卷积算子仅支持float16类型，则该参数不生效，仍然使用支持的float16；如果该算子不支持float32，且又配置了黑名单（precision_reduce = false），则会使用float32的aicpu算子。
force_fp16：表示网络模型中算子支持float16和float32时，强制选择float16。
allow_fp32_to_fp16：优先保持原图精度，如果网络模型中算子支持float32，则保留原始精度float32；如果网络模型中算子不支持float32，则直接降低精度到float16。
must_keep_origin_dtype：表示保持原图精度：如果网络模型中存在部分算子，并且该算子实现不支持float32，比如Conv2D卷积算子仅支持float16类型，则不能使用该参数。
allow_mix_precision：表示使用混合精度模式（混合精度模式是通过混合使用float16和float32数据类型来处理神经网络的过程）：
针对网络模型中float32数据类型的算子，按照内置的优化策略，自动将部分float32的算子降低精度到float16，从而在精度损失很小的情况下提升系统性能并减少内存使用。

若配置了该种模式，则可以在OPP软件包安装路径${INSTALL_DIR}/opp/op_impl/built-in/ai_core/tbe/config/<soc_version>/aic-<soc_version>-ops-info.json内置优化策略文件中查看“precision_reduce”参数的取值：
- 若取值为true（白名单），则表示允许将当前float32类型的算子，降低精度到float16。
- 若取值为false（黑名单），则不允许将当前float32类型的算子降低精度到float16，相应算子仍旧使用float32精度。
- 若网络模型中算子没有配置该参数（灰名单），当前算子的混合精度处理机制和前一个算子保持一致，即如果前一个算子支持降精度处理，当前算子也支持降精度；如果前一个算子不允许降精度，当前算子也不支持降精度。

参数默认值：force_fp16

示例

--precision_mode=force_fp16

支持的芯片型号

Atlas 200/300/500 推理产品

Atlas 训练系列产品

依赖约束

无。

父主题： 算子调优选项

--precision_mode

功能说明

关联参数

参数取值

推荐配置及收益

示例

支持的芯片型号

依赖约束