mis-tei镜像run bge-m3启动报错
收藏回复举报
mis-tei镜像run bge-m3启动报错
t('forum.solved') 已解决
发表于2025-03-12 09:14:28
0 查看

参考页面:https://www.hiascend.com/developer/ascendhub/detail/mis-tei

权重所在路径:/data/0310/bge-m3
映射到容器里面pwd显示路径:/home/HwHiAiUser/model

docker run -e -itd --name=tei --net=host -v /data/0310/bge-m3:/home/HwHiAiUser/model swr.cn-south-1.myhuaweicloud.com/ascendhub/mis-tei:6.0.0-300I-Duo-aarch64 BAAI/bge-m3 192.168.137.135 8111

有一点不理解的地方为文字加粗部分写的是否正确(下载模型链接为:https://huggingface.co/BAAI/bge-m3)

具体报错信息如下:

[root@bogon ~]# docker logs tei

Model 'bge-m3' exists.

NPU_ID: 32896, CHIP_ID: 0, CHIP_LOGIC_ID: 0 CHIP_TYPE: 310P3, MEMORY_TYPE: DDR, CAPACITY: 43693, USAGE_RATE: 3, AVAIL_CAPACITY: 42382

Using NPU: 0 start TEI service

Starting TEI service on 192.168.137.135:8111...

2025-03-11T14:29:06.389322Z  INFO text_embeddings_router: router/src/main.rs:140: Args { model_id: "/hom*/**********/*****/**e-m3", revision: None, tokenization_workers: None, dtype: None, pooling: None, max_concurrent_requests: 512, max_batch_tokens: 16384, max_batch_requests: None, max_client_batch_size: 32, auto_truncate: false, hf_api_token: None, hostname: "192.168.137.135", port: 8111, uds_path: "/tmp/text-embeddings-inference-server", huggingface_hub_cache: None, payload_limit: 2000000, api_key: None, json_output: false, otlp_endpoint: None, cors_allow_origin: None }

2025-03-11T14:29:06.790580Z  INFO text_embeddings_router: router/src/lib.rs:169: Maximum number of tokens per request: 8192

2025-03-11T14:29:06.791315Z  INFO text_embeddings_core::tokenization: core/src/tokenization.rs:23: Starting 128 tokenization workers

2025-03-11T14:29:27.921081Z  INFO text_embeddings_router: router/src/lib.rs:198: Starting model backend

2025-03-11T14:29:27.921414Z  INFO text_embeddings_backend_python::management: backends/python/src/management.rs:62: Starting Python backend

2025-03-11T14:29:31.773656Z  WARN python-backend: text_embeddings_backend_python::logging: backends/python/src/logging.rs:39: Could not import Flash Attention enabled models: No module named 'dropout_layer_norm'

2025-03-11T14:29:38.018563Z  INFO text_embeddings_backend_python::management: backends/python/src/management.rs:126: Waiting for Python backend to be ready...

2025-03-11T14:29:40.520215Z ERROR python-backend: text_embeddings_backend_python::logging: backends/python/src/logging.rs:40: Error when initializing model

Traceback (most recent call last):

  File "/home/HwHiAiUser/.local/bin/python-text-embeddings-server", line 8, in <module>

    sys.exit(app())

  File "/home/HwHiAiUser/.local/lib/python3.11/site-packages/typer/main.py", line 311, in __call__

    return get_command(self)(*args, **kwargs)

  File "/home/HwHiAiUser/.local/lib/python3.11/site-packages/click/core.py", line 1157, in __call__

    return self.main(*args, **kwargs)

  File "/home/HwHiAiUser/.local/lib/python3.11/site-packages/typer/core.py", line 716, in main

    return _main(

  File "/home/HwHiAiUser/.local/lib/python3.11/site-packages/typer/core.py", line 216, in _main

    rv = self.invoke(ctx)

  File "/home/HwHiAiUser/.local/lib/python3.11/site-packages/click/core.py", line 1434, in invoke

    return ctx.invoke(self.callback, **ctx.params)

  File "/home/HwHiAiUser/.local/lib/python3.11/site-packages/click/core.py", line 783, in invoke

    return __callback(*args, **kwargs)

  File "/home/HwHiAiUser/.local/lib/python3.11/site-packages/typer/main.py", line 683, in wrapper

    return callback(**use_params)  # type: ignore

  File "/home/HwHiAiUser/text-embeddings-inference/backends/python/server/text_embeddings_server/cli.py", line 51, in serve

    server.serve(model_path, dtype, uds_path, pool)

  File "/home/HwHiAiUser/text-embeddings-inference/backends/python/server/text_embeddings_server/server.py", line 94, in serve

    asyncio.run(serve_inner(model_path, dtype))

  File "/usr/lib/python3.11/asyncio/runners.py", line 190, in run

    return runner.run(main)

  File "/usr/lib/python3.11/asyncio/runners.py", line 118, in run

    return self._loop.run_until_complete(task)

  File "/usr/lib/python3.11/asyncio/base_events.py", line 641, in run_until_complete

    self.run_forever()

  File "/usr/lib/python3.11/asyncio/base_events.py", line 608, in run_forever

    self._run_once()

  File "/usr/lib/python3.11/asyncio/base_events.py", line 1936, in _run_once

    handle._run()

  File "/usr/lib/python3.11/asyncio/events.py", line 84, in _run

    self._context.run(self._callback, *self._args)

> File "/home/HwHiAiUser/text-embeddings-inference/backends/python/server/text_embeddings_server/server.py", line 63, in serve_inner

    model = get_model(model_path, dtype, pool)

  File "/home/HwHiAiUser/text-embeddings-inference/backends/python/server/text_embeddings_server/models/__init__.py", line 83, in get_model

    return DefaultModel(model_path, device, dtype, pool)

  File "/home/HwHiAiUser/text-embeddings-inference/backends/python/server/text_embeddings_server/models/default_model.py", line 20, in __init__

    model = AutoModel.from_pretrained(model_path).to(dtype).to(device).eval()

  File "/home/HwHiAiUser/.local/lib/python3.11/site-packages/transformers/models/auto/auto_factory.py", line 563, in from_pretrained

    return model_class.from_pretrained(

  File "/home/HwHiAiUser/.local/lib/python3.11/site-packages/transformers/modeling_utils.py", line 3305, in from_pretrained

    raise EnvironmentError(

OSError: Error no file named pytorch_model.bin, model.safetensors, tf_model.h5, model.ckpt.index or flax_model.msgpack found in directory /home/HwHiAiUser/model/bge-m3.

2025-03-11T14:29:48.020359Z  INFO text_embeddings_backend_python::management: backends/python/src/management.rs:126: Waiting for Python backend to be ready...

Error: Could not create backend

Caused by:

    Could not start backend: Python backend failed to start

我要发帖子