华为计算微信公众号
昇腾AI开发者公众号
华为计算微博
华为计算今日头条
参考bge-large-zh-v1.5部署文档部署完成后,接入dify平台后,经测试调用,能正常使用。
但是当输入文字切片字符超过一定大小后(如2000),返回403错粗,疑似NPU容器或者模型适配问题。报错如下:
[openai_api_compatible] Bad Request Error, 413 Client Error: Request Entity To Large for url: http://172.21.39.54:8003/v1/embeddings
经过查询后,发现是:请求实体超出模型服务器处理大小限制 网上给出的解决方案是:需要客户侧修改模型服务配置,增加代理服务器允许的请求体大小限制。例如nginx服务可以通过client_max_body_size设置
在这个模型的部署部署中,应该怎么修改呢?
我要发帖子
问题描述
参考bge-large-zh-v1.5部署文档部署完成后,接入dify平台后,经测试调用,能正常使用。
但是当输入文字切片字符超过一定大小后(如2000),返回403错粗,疑似NPU容器或者模型适配问题。报错如下:
经过查询后,发现是:请求实体超出模型服务器处理大小限制 网上给出的解决方案是:需要客户侧修改模型服务配置,增加代理服务器允许的请求体大小限制。例如nginx服务可以通过client_max_body_size设置
在这个模型的部署部署中,应该怎么修改呢?