---
title: allocate_blocks_cache
description: "| 产品 | 是否支持 |"
url: https://www.hiascend.com/document/detail/zh/canncommercial/latest/others/llmdatadistdev/llmpr_42_0043.html
sourcePath: /source/zh/canncommercial/900/others/llmdatadistdev/llmpr_42_0043.html
indexId: c979b873a2593d510a56d6292319926a8e3f8c47a717ec4261c515c5e24a4c6070
---
# allocate_blocks_cache

#### 产品支持情况

| 产品 | 是否支持 |
| --- | --- |
| Atlas 350 加速卡 | x |
| Atlas A3 训练系列产品 / Atlas A3 推理系列产品 | √ |
| Atlas A2 训练系列产品 / Atlas A2 推理系列产品 | √ |
| Atlas 200I/500 A2 推理产品 | x |
| Atlas 推理系列产品 | x |
| Atlas 训练系列产品 | x |


说明：针对 Atlas A2 训练系列产品 / Atlas A2 推理系列产品 ，仅支持Atlas 800I A2 推理服务器、A200I A2 Box 异构组件。


#### 函数功能

PagedAttention场景下，分配多个blocks的Cache，Cache分配成功后，可通过deallocate_cache释放内存。


#### 函数原型

```
allocate_blocks_cache(cache_desc: CacheDesc, blocks_cache_key: Optional[BlocksCacheKey] = None)
```


#### 参数说明

| 参数名称 | 数据类型 | 取值说明 |
| --- | --- | --- |
| cache\_desc | CacheDesc | Cache的描述。 |
| blocks\_cache\_key | Optional[BlocksCacheKey] | 仅当LLMRole为PROMPT时可设置，用于在Decode拉取KV。 |


#### 调用示例

```
from llm_datadist import BlocksCacheKey
num_blocks = 1000
cache_desc = CacheDesc(80, [num_blocks , 128 * 1024], DataType.DT_FLOAT16)
blocks_cache_key = BlocksCacheKey(0, 0)
kv_cache = kv_cache_manager.allocate_blocks_cache(cache_desc, blocks_cache_key)
```


#### 返回值

正常情况下返回KvCache。

参数错误可能抛出TypeError或ValueError。

执行时间超过sync_kv_timeout配置会抛出LLMException异常。


#### 约束说明

本接口不支持并发调用。
