1、我希望同时使用Mmad和Matmul,但是它们都需要用到L1和L0 buffer。在Mmad中,通过pipe->InitBuffer(inQueueA1, 2, 131072); 初始化buffer之后应该如何释放供后续Matmul使用?Matmul如何释放buffer供Mmad使用,通过调用End()函数吗?
2、AllocTensor<T>()似乎有比较大的scalar开销,是否可以仅在最开始做一次申请,之后反复利用进行数据加载和计算:AllocTensor申请缓存->LoadData加载数据->Mmad计算->LoadData加载数据->Mmad计算(重复若干次)->FreeTensor释放缓存?
1、我希望同时使用Mmad和Matmul,但是它们都需要用到L1和L0 buffer。在Mmad中,通过pipe->InitBuffer(inQueueA1, 2, 131072); 初始化buffer之后应该如何释放供后续Matmul使用?Matmul如何释放buffer供Mmad使用,通过调用End()函数吗?
2、AllocTensor<T>()似乎有比较大的scalar开销,是否可以仅在最开始做一次申请,之后反复利用进行数据加载和计算:AllocTensor申请缓存->LoadData加载数据->Mmad计算->LoadData加载数据->Mmad计算(重复若干次)->FreeTensor释放缓存?