---
title: 提前终止请求接口
description: "目前该接口只支持提前终止Triton推理请求。"
url: https://www.hiascend.com/document/detail/zh/mindie/latest/mindiellm/llmdev/mindie_llm0039.html
sourcePath: /source/zh/mindie/310/mindiellm/llmdev/mindie_llm0039.html
indexId: 1061c038f409639a7dcc86354ed6f98b2e00d03ac2146cc297843038f0a2889b58
---
# 提前终止请求接口

目前该接口只支持提前终止Triton推理请求。


#### 接口功能

参考Triton接口定义，提供提前终止请求接口。


#### 接口格式

操作类型：POST

URL：https://{ip}:{port}/v2/models/${MODEL_NAME}[/versions/${MODEL_VERSION}]/stopInfer

- {ip}和{port}请使用业务面的IP地址和端口号，即“ipAddress”和“port”。
- ${MODEL_NAME}字段指定需要查询的模型名称。
- [/versions/${MODEL_VERSION}]字段暂不支持，不传递。


#### 请求参数

| 参数 | 是否必选 | 说明 | 取值要求 |
| --- | --- | --- | --- |
| id | 必选 | 推理请求ID。 | 长度不超过256的非空字符串。 |


#### 使用样例

请求样例：

```
POST https://
{ip}:{port}
/v2/models/llama3-70b/stopInfer
```

请求消息体：

```
{
"id":"a123"
}
```

响应样例：

```
{
"id":"a123"
}
```

响应状态码：200


#### 输出说明

| 返回值 | 类型 | 说明 |
| --- | --- | --- |
| id | string | 成功停止推理请求ID。 2.1.RC1及之前版本调用该接口后不会立即终止推理，会放到executor中和调度一起处理，最后会返回一个无效token。自2.2.RC1版本起，调用该接口后立即终止推理，不会返回无效token。 |
