A300 DUO 8卡16芯测试DeepSeek-R1-Distill-Qwen-32B不能拉起服务化
收藏回复举报
A300 DUO 8卡16芯测试DeepSeek-R1-Distill-Qwen-32B不能拉起服务化
t('forum.solved') 已解决
发表于2025-04-18 17:55:55
0 查看
 

[2025-04-18 17:53:42,033] [251802] [281458045415776] [llm] [INFO] [logging.py-331] : trans to 29 

[2025-04-18 17:53:42,033] [251802] [281458045415776] [llm] [INFO] [logging.py-331] : trans to 29 

[2025-04-18 17:53:42,033] [251802] [281458045415776] [llm] [INFO] [logging.py-331] : trans to 29 

[2025-04-18 17:53:42,034] [251802] [281458045415776] [llm] [INFO] [logging.py-331] : trans to 29 

[2025-04-18 17:53:42,035] [251802] [281458045415776] [llm] [INFO] [logging.py-331] : trans to 29 

[2025-04-18 17:53:42,206] [251842] [281454349185376] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

[2025-04-18 17:53:43,002] [251802] [281458045415776] [llm] [INFO] [logging.py-331] : <<<<<<< ori k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

[2025-04-18 17:53:43,005] [251802] [281458045415776] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

[2025-04-18 17:53:43,005] [251802] [281458045415776] [llm] [INFO] [logging.py-331] : >>>>>>id of kcache is 281465383950032 id of vcache is 281465383950128 

[2025-04-18 17:53:43,317] [251857] [281457754567008] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

2025-04-18 17:53:43,325 [ERROR] model.py:39 - [Model]   >>> Exception:Execute fail, enable log: export ASDOPS_LOG_LEVEL=ERROR, export ASDOPS_LOG_TO_STDOUT=1 to findthe first error. For more details, see the MindIE official document. 

Traceback (most recent call last): 

  File "/usr/local/lib/python3.11/site-packages/model_wrapper/model.py", line 37, in initialize 

    return self.python_model.initialize(config) 

           ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ 

  File "/usr/local/lib/python3.11/site-packages/model_wrapper/standard_model.py", line 146, in initialize 

    self.generator = Generator( 

                     ^^^^^^^^^^ 

  File "/usr/local/lib/python3.11/site-packages/mindie_llm/text_generator/generator.py", line 119, in __init__ 

    self.warm_up(max_prefill_tokens, max_seq_len, max_input_len, max_iter_times, inference_mode) 

  File "/usr/local/lib/python3.11/site-packages/mindie_llm/text_generator/generator.py", line 303, in warm_up 

    raise e 

  File "/usr/local/lib/python3.11/site-packages/mindie_llm/text_generator/generator.py", line 296, in warm_up 

    self._generate_inputs_warm_up_backend(input_metadata, inference_mode, dummy=True) 

  File "/usr/local/lib/python3.11/site-packages/mindie_llm/text_generator/generator.py", line 378, in _generate_inputs_warm_up_backend 

    self.generator_backend.warm_up(model_inputs, inference_mode=inference_mode) 

  File "/usr/local/lib/python3.11/site-packages/mindie_llm/text_generator/adapter/generator_torch.py", line 198, in warm_up 

    super().warm_up(model_inputs) 

  File "/usr/local/lib/python3.11/site-packages/mindie_llm/text_generator/adapter/generator_backend.py", line 170, in warm_up 

    _ = self.forward(model_inputs, **kwargs) 

        ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ 

  File "/usr/local/lib/python3.11/site-packages/mindie_llm/utils/decorators/time_decorator.py", line 38, in wrapper 

    return func(*args, **kwargs) 

           ^^^^^^^^^^^^^^^^^^^^^ 

  File "/usr/local/lib/python3.11/site-packages/mindie_llm/text_generator/adapter/generator_torch.py", line 153, in forward 

    logits = self.model_wrapper.forward(model_inputs, self.cache_pool.npu_cache, **kwargs) 

             ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ 

  File "/usr/local/lib/python3.11/site-packages/mindie_llm/modeling/model_wrapper/atb/atb_model_wrapper.py", line 89, in forward 

    logits = self.forward_tensor( 

             ^^^^^^^^^^^^^^^^^^^^ 

  File "/usr/local/lib/python3.11/site-packages/mindie_llm/modeling/model_wrapper/atb/atb_model_wrapper.py", line 116, in forward_tensor 

    logits = self.model_runner.forward( 

             ^^^^^^^^^^^^^^^^^^^^^^^^^^ 

  File "/usr/local/Ascend/atb-models/atb_llm/runner/model_runner.py", line 193, in forward 

    return self.model.forward(**kwargs) 

           ^^^^^^^^^^^^^^^^^^^^^^^^^^^^ 

  File "/usr/local/Ascend/atb-models/atb_llm/models/base/flash_causal_lm.py", line 458, in forward 

    logits = self.execute_ascend_operator(acl_inputs, acl_param, is_prefill) 

             ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ 

  File "/usr/local/Ascend/atb-models/atb_llm/models/qwen2/flash_causal_qwen2.py", line 374, in execute_ascend_operator 

    acl_model_out = model_operation.execute(acl_inputs, acl_param) 

                    ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ 

RuntimeError: Execute fail, enable log: export ASDOPS_LOG_LEVEL=ERROR, export ASDOPS_LOG_TO_STDOUT=1 to findthe first error. For more details, see the MindIE official document. 

 

2025-04-18 17:53:43,329 [ERROR] model.py:42 - [Model]   >>> return initialize error result: {'status': 'error', 'npuBlockNum': '0', 'cpuBlockNum': '0'} 

[ERROR] TBE Subprocess[task_distribute] raise error[], main process disappeared! 

[ERROR] TBE Subprocess[task_distribute] raise error[], main process disappeared! 

[ERROR] TBE Subprocess[task_distribute] raise error[], main process disappeared! 

[ERROR] TBE Subprocess[task_distribute] raise error[], main process disappeared! 

[ERROR] TBE Subprocess[task_distribute] raise error[], main process disappeared! 

[ERROR] TBE Subprocess[task_distribute] raise error[], main process disappeared! 

[ERROR] TBE Subprocess[task_distribute] raise error[], main process disappeared! 

[ERROR] TBE Subprocess[task_distribute] raise error[], main process disappeared! 

[2025-04-18 17:53:43,758] [251812] [281455862542688] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

[2025-04-18 17:53:44,570] [251819] [281460178415968] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

[2025-04-18 17:53:45,065] [251815] [281460290351456] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

[2025-04-18 17:53:45,154] [251888] [281464037962080] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

[2025-04-18 17:53:45,156] [251885] [281459049165152] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

/usr/lib64/python3.11/multiprocessing/resource_tracker.py:254: UserWarning: resource_tracker: There appear to be 30 leaked semaphore objects to clean up at shutdown 

  warnings.warn('resource_tracker: There appear to be %d ' 

[2025-04-18 17:53:45,218] [251810] [281464418398560] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

[2025-04-18 17:53:45,343] [251808] [281450290540896] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

[2025-04-18 17:53:45,846] [251870] [281457528402272] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

[2025-04-18 17:53:47,983] [251806] [281460324233568] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

[2025-04-18 17:53:48,200] [251804] [281457998164320] [llm] [INFO] [flash_causal_qwen2.py-394] : <<<<<<<after transdata k_caches[0].shape=torch.Size([1, 8, 128, 16]) 

Daemon is killing... 

Killed 

[root@AT9508-13-82 mindie-service]# 

我要发帖子