---
title: 推荐业务配置
description: "本节分别针对 Atlas A3 训练系列产品 / Atlas A3 推理系列产品 、 Atlas A2 训练系列产品 / Atlas A2 推理系列产品 的常见业务场景，提供推荐的业务配置。"
url: https://www.hiascend.com/document/detail/zh/canncommercial/latest/API/hcclug/hcclug_000112.html
sourcePath: /source/zh/canncommercial/900/API/hcclug/hcclug_000112.html
indexId: 1eb9bea44e46b3e5b90b5a35b7b31e647f41b916812a3d6c2f2c8f55b4f8be1e59
---
# 推荐业务配置

本节分别针对 Atlas A3 训练系列产品 / Atlas A3 推理系列产品 、 Atlas A2 训练系列产品 / Atlas A2 推理系列产品 的常见业务场景，提供推荐的业务配置。

本节仅给出了推荐配置环境变量的功能说明和配置示例，详细使用说明可参见《环境变量参考(https://www.hiascend.com/document/detail/zh/canncommercial/900/maintenref/envvar/envref_07_0001.html)》的“集合通信”章节。


#### Atlas A3 训练系列产品 / Atlas A3 推理系列产品

- 训练场景| 环境变量 | 配置说明 |
| --- | --- |
| HCCL\_CONNECT\_TIMEOUT | 配置socket建链超时等待时间，默认值为120，单位s。该场景下，建议根据网络规模大小适当调整建链超时等待时间。 export HCCL\_CONNECT\_TIMEOUT=1200 |
| HCCL\_OP\_EXPANSION\_MODE | 配置通信算子的展开模式。 该场景下建议保持默认值“AI\_CPU”，代表通信算子在AI CPU展开。 export HCCL\_OP\_EXPANSION\_MODE="AI\_CPU" |


- 推理场景

  - Prefill-Decode混合部署| 环境变量 | 配置说明 |
| --- | --- |
| HCCL\_OP\_EXPANSION\_MODE | 配置通信算子的展开模式。 该场景下建议配置为“AIV”，代表通信算子在Vector Core展开。 export HCCL\_OP\_EXPANSION\_MODE="AIV" |
| HCCL\_DETERMINISTIC | 是否开启确定性计算，用户可以根据使用场景选择开启或关闭，默认值为false，代表关闭确定性计算。 export HCCL\_DETERMINISTIC=false |


  - Prefill-Decode分离部署| 环境变量 | 配置说明 |
| --- | --- |
| HCCL\_INTRA\_ROCE\_ENABLE | 仅使用LLM\-DataDist作为集群管理组件的场景下，建议通过此环境变量配置超节点内使用RoCE链路进行通信；非LLM\-DataDist场景，无需配置。 export HCCL\_INTRA\_ROCE\_ENABLE=1 |
| HCCL\_OP\_EXPANSION\_MODE | 配置通信算子的展开模式。 该场景下建议配置为“AIV”，代表通信算子在Vector Core展开。 export HCCL\_OP\_EXPANSION\_MODE="AIV" |
| HCCL\_DETERMINISTIC | 是否开启确定性计算，用户可以根据使用场景选择开启或关闭，默认值为false，代表关闭确定性计算。 export HCCL\_DETERMINISTIC=false |


- 强化学习训推一体| 环境变量 | 配置说明 |
| --- | --- |
| HCCL\_CONNECT\_TIMEOUT | 配置socket建链超时等待时间，默认值为120，单位s。该场景下，建议根据网络规模大小适当调整建链超时等待时间。 export HCCL\_CONNECT\_TIMEOUT=1200 |
| HCCL\_OP\_EXPANSION\_MODE | 配置通信算子的展开模式。 该场景下建议保持默认值“AI\_CPU”，代表通信算子在AI CPU展开。 export HCCL\_OP\_EXPANSION\_MODE="AI\_CPU" 需要注意： 针对推理通信域，需要通过通信域级别的配置参数将推理通信域的算子展开位置设置为“Vector Core”，针对PyTorch框架网络，可通过“hccl\_op\_expansion\_mode”参数配置，配置方法如下： options = torch\_npu.\_C.\_distributed\_c10d.ProcessGroupHCCL.Options() options.hccl\_config ={"hccl\_op\_expansion\_mode":3} torch.distributed.init\_process\_group(backend="hccl", pg\_options=options) PyTorch框架参数的详细介绍可参见《Ascend Extension for PyTorch 框架特性指南(https://www.hiascend.com/document/detail/zh/Pytorch/2600/ptmoddevg/Frameworkfeatures/docs/zh/framework\_feature\_guide\_pytorch/overview.md)》中的“通过pg\_options配置HCCL通信域参数(https://www.hiascend.com/document/detail/zh/Pytorch/2600/ptmoddevg/Frameworkfeatures/docs/zh/framework\_feature\_guide\_pytorch/setting\_HCCL\_communicator\_parameter.md)”章节。 |
| HCCL\_DETERMINISTIC | 是否开启确定性计算，用户可以根据使用场景选择开启或关闭，默认值为false，代表关闭确定性计算。 export HCCL\_DETERMINISTIC=false |


#### Atlas A2 训练系列产品 / Atlas A2 推理系列产品

- 训练场景| 环境变量 | 配置说明 |
| --- | --- |
| HCCL\_CONNECT\_TIMEOUT | 配置socket建链超时等待时间，默认值为120，单位s。该场景下，建议根据网络规模大小适当调整建链超时等待时间。 export HCCL\_CONNECT\_TIMEOUT=1200 |
| HCCL\_OP\_EXPANSION\_MODE | 配置通信算子的展开模式 。 该场景下建议保持默认值“HOST”，代表通信算子在Host侧CPU展开。 export HCCL\_OP\_EXPANSION\_MODE="HOST" |
| HCCL\_DETERMINISTIC | 是否开启确定性计算，用户可以根据使用场景选择开启或关闭，默认值为false，代表关闭确定性计算。 export HCCL\_DETERMINISTIC=false |


- 推理场景| 环境变量 | 配置说明 |
| --- | --- |
| HCCL\_OP\_EXPANSION\_MODE | 配置通信算子的展开模式。 该场景下建议保持默认值“HOST”，代表通信算子在Host侧CPU展开。 export HCCL\_OP\_EXPANSION\_MODE="HOST" |
| HCCL\_DETERMINISTIC | 是否开启确定性计算，用户可以根据使用场景选择开启或关闭，默认值为false，代表关闭确定性计算。 export HCCL\_DETERMINISTIC=false |


- 强化学习训推一体| 环境变量 | 配置说明 |
| --- | --- |
| HCCL\_CONNECT\_TIMEOUT | 配置socket建链超时等待时间，默认值为120，单位s。该场景下，建议根据网络规模大小适当调整建链超时等待时间。 export HCCL\_CONNECT\_TIMEOUT=1200 |
| HCCL\_OP\_EXPANSION\_MODE | 配置通信算子的展开模式。 该场景下建议保持默认值“HOST”，代表通信算子在Host侧CPU展开。 export HCCL\_OP\_EXPANSION\_MODE="HOST" |
| HCCL\_DETERMINISTIC | 是否开启确定性计算，用户可以根据使用场景选择开启或关闭，默认值为false，代表关闭确定性计算。 export HCCL\_DETERMINISTIC=false |
