单算子模型执行和单算子api执行2种方法的执行效率相差300倍(=0.147421/0.000481),请问是否有办法提高单算子模型执行这种方法的执行效率?
1.acl_execute_add示例使用”单算子模型执行” ,执行加法算子用时0.147421秒。此方法的优势是支持FFT内置算子
2.AddCustomSample 示例使用“单算子api执行”,执行加法算子用时0.000481秒。此方法支持各种api内置算子,但是FFT内置算子不是api内置算子,所以不支持FFT
acl_execute_add示例:
\samples\cplusplus\level1_single_api\4_op_dev\2_verify_op\acl_execute_add

自定义算子示例:
/samples/operator/AddCustomSample/FrameworkLaunch/AclNNInvocationNaive/

单算子模型执行和单算子api执行2种方法的执行效率相差300倍(=0.147421/0.000481),请问是否有办法提高单算子模型执行这种方法的执行效率?
1.acl_execute_add示例使用”单算子模型执行” ,执行加法算子用时0.147421秒。此方法的优势是支持FFT内置算子
2.AddCustomSample 示例使用“单算子api执行”,执行加法算子用时0.000481秒。此方法支持各种api内置算子,但是FFT内置算子不是api内置算子,所以不支持FFT
acl_execute_add示例:
\samples\cplusplus\level1_single_api\4_op_dev\2_verify_op\acl_execute_add
自定义算子示例:
/samples/operator/AddCustomSample/FrameworkLaunch/AclNNInvocationNaive/