DeepSeek-R1-Distill-Qwen-1.5B使用MindIE1.0.0版本推理存在乱码问题
收藏回复举报
DeepSeek-R1-Distill-Qwen-1.5B使用MindIE1.0.0版本推理存在乱码问题
t('forum.solved') 已解决
发表于2025-02-06 17:01:21
0 查看

系统信息:MindIE1.0.0,Atlas 800I A2

【报错日志】

[2025-02-06 17:00:04,713] [5133] [281455798186336] [llm] [INFO] [dist.py-77] : initialize_distributed has been Set 

[2025-02-06 17:00:04,714] [5133] [281455798186336] [llm] [INFO] [logging.py-331] : init tokenizer done: LlamaTokenizerFast(name_or_path='/root/llm/new/g/DeepSeek-R1-Distill-Qwen-1.5B', vocab_size=151643, model_max_length=16384, is_fast=True, padding_side='left', truncation_side='right', special_tokens={'bos_token': '<\uff5cbegin\u2581of\u2581sentence\uff5c>', 'eos_token': '<\uff5cend\u2581of\u2581sentence\uff5c>', 'pad_token': '<\uff5cend\u2581of\u2581sentence\uff5c>'}, clean_up_tokenization_spaces=False),  added_tokens_decoder={ 

        151643: AddedToken("<\uff5cend\u2581of\u2581sentence\uff5c>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True), 

        151644: AddedToken("<\uff5cUser\uff5c>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

        151645: AddedToken("<\uff5cAssistant\uff5c>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

        151646: AddedToken("<\uff5cbegin\u2581of\u2581sentence\uff5c>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True), 

        151647: AddedToken("<|EOT|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

        151648: AddedToken("<think>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

        151649: AddedToken("</think>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

        151650: AddedToken("<|quad_start|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True), 

        151651: AddedToken("<|quad_end|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True), 

        151652: AddedToken("<|vision_start|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True), 

        151653: AddedToken("<|vision_end|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True), 

        151654: AddedToken("<|vision_pad|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True), 

        151655: AddedToken("<|image_pad|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True), 

        151656: AddedToken("<|video_pad|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True), 

        151657: AddedToken("<tool_call>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

        151658: AddedToken("</tool_call>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

        151659: AddedToken("<|fim_prefix|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

        151660: AddedToken("<|fim_middle|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

        151661: AddedToken("<|fim_suffix|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

        151662: AddedToken("<|fim_pad|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

        151663: AddedToken("<|repo_name|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

        151664: AddedToken("<|file_sep|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False), 

--- Logging error --- 

[2025-02-06 17:00:04,718] [5133] [281455798186336] [llm] [INFO] [logging.py-331] : NPUSocInfo(soc_name='', soc_version=224, need_nz=False, matmul_nd_nz=False) 

Traceback (most recent call last): 

  File "/usr/lib64/python3.11/logging/__init__.py", line 1113, in emit 

    stream.write(msg + self.terminator) 

UnicodeEncodeError: 'ascii' codec can't encode character '\uff5c' in position 319: ordinal not in range(128) 

Call stack: 

  File "/usr/lib64/python3.11/threading.py", line 1002, in _bootstrap 

    self._bootstrap_inner() 

  File "/usr/lib64/python3.11/threading.py", line 1045, in _bootstrap_inner 

    self.run() 

  File "/usr/lib64/python3.11/threading.py", line 982, in run 

    self._target(*self._args, **self._kwargs) 

  File "/usr/local/Ascend/atb-models/atb_llm/utils/log/multiprocess_logging_handler.py", line 80, in receive 

    self.log_handler.emit(record) 

Message: 'init tokenizer done: LlamaTokenizerFast(name_or_path=\'/root/llm/new/g/DeepSeek-R1-Distill-Qwen-1.5B\', vocab_size=151643, model_max_length=16384, is_fast=True, padding_side=\'left\', truncation_side=\'right\', special_tokens={\'bos_token\': \'<\uff5cbegin\u2581of\u2581sentence\uff5c>\', \'eos_token\': \'<\uff5cend\u2581of\u2581sentence\uff5c>\', \'pad_token\': \'<\uff5cend\u2581of\u2581sentence\uff5c>\'}, clean_up_tokenization_spaces=False),  added_tokens_decoder={\n\t151643: AddedToken("<\uff5cend\u2581of\u2581sentence\uff5c>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True),\n\t151644: AddedToken("<\uff5cUser\uff5c>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n\t151645: AddedToken("<\uff5cAssistant\uff5c>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n\t151646: AddedToken("<\uff5cbegin\u2581of\u2581sentence\uff5c>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True),\n\t151647: AddedToken("<|EOT|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n\t151648: AddedToken("<think>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n\t151649: AddedToken("</think>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n\t151650: AddedToken("<|quad_start|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True),\n\t151651: AddedToken("<|quad_end|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True),\n\t151652: AddedToken("<|vision_start|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True),\n\t151653: AddedToken("<|vision_end|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True),\n\t151654: AddedToken("<|vision_pad|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True),\n\t151655: AddedToken("<|image_pad|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True),\n\t151656: AddedToken("<|video_pad|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=True),\n\t151657: AddedToken("<tool_call>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n\t151658: AddedToken("</tool_call>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n\t151659: AddedToken("<|fim_prefix|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n\t151660: AddedToken("<|fim_middle|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n\t151661: AddedToken("<|fim_suffix|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n\t151662: AddedToken("<|fim_pad|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n\t151663: AddedToken("<|repo_name|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n\t151664: AddedToken("<|file_sep|>", rstrip=False, lstrip=False, single_word=False, normalized=False, special=False),\n}' 

Arguments: () 

我要发帖子