C++工程解析onnx模型进行量化时报错。
收藏回复举报
C++工程解析onnx模型进行量化时报错。
t('forum.solved') 已解决
发表于2024-06-21 10:01:23
0 查看

首先调用aclgrphParseONNX接口解析onnx文件中的模型,然后调用aclgrphCalibration接口对模型进行量化,代码如下:

我的校准数据算法如下:使用测试集中的图片生成bin文件

量化过程中出现错误:

(base) root@davinci-mini:~/zzc/model/graph# ./ir_build  ./best_float32.onnx ./mask_cali_data/img_bs1_n1.bin ./best_int8.om 

..[ERROR] AMCT(15965,ir_build):2024-06-20-20:53:48[bias_quant_pass.cpp:93]scale_w[0] 0.000814 multiply scale_d 0.000000 is zero. 

[ERROR] AMCT(15965,ir_build):2024-06-20-20:53:48[graph_optimizer.cpp:43]pass run failed 

[ERROR] AMCT(15965,ir_build):2024-06-20-20:53:48[quantize_api.cpp:329]Do save optimizer pass failed. 

[ERROR] AMCT(15965,ir_build):2024-06-20-20:53:48[quantize_api.cpp:382]Do GenerateDeployGraph failed. 

[ERROR] AMCT(15965,ir_build):2024-06-20-20:54:01[inner_graph_calibration.cpp:78]Failed to excute InnerQuantizeGraph failed. 

请问这是什么原因?总是提示scale_d为0,scale_d是量化过程中的activate数据量化因子,这个因子为什么会是0呢,是我的校准算法有问题吗?

我要发帖子