Skip to main content
Gerenciamento de modelos

Atualize limites de taxa de modelos

Chame o endpoint POST /api/v1/models/limits para atualizar as cotas de limite de taxa (QPM / TPM) dos modelos em um workspace específico. O sistema suporta operações de "mesclagem com sobreposição" e "exclusão de limite de taxa".

Pré-requisitos

Crie uma chave de API e configure-a como a variável de ambiente DASHSCOPE_API_KEY. Para mais informações, consulte Configure an API key in environment variables.

Requisição

  • Método HTTP: POST
  • URL da requisição
    Substitua {WorkspaceId} pelo ID do seu workspace.

    Região

    Endpoint

    China (Beijing)

    https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/models/limits

  • Autenticação Defina Authorization: Bearer {API_KEY} no cabeçalho da requisição.

Parâmetros da requisição

Envie todos os parâmetros no corpo da requisição.

Parâmetro

Tipo

Obrigatório

Descrição

models

Array[Object]

Sim

Lista de itens de limite de taxa por modelo. Obrigatório. A quantidade de itens deve variar de 1 a 200. Exemplo: [{"model":"qwen-plus","request_limit":60}]

models[].model

String

Sim

ID do modelo. Não pode estar vazio. Exemplos: qwen-plus, qwen3-max.

models[].operation_type

String

Não

Tipo de operação. Valores válidos:

  • OVERLAY: Mesclagem com sobreposição (sobrescreve apenas os campos enviados; os campos omitidos mantêm seus valores atuais).

  • DELETE: Exclua o limite de taxa (todos os campos de valor de limite de taxa devem estar vazios).

Valor padrão: OVERLAY.

models[].request_limit

Number

Não

Limite de contagem de requisições (QPM), não negativo. Defina o número máximo de requisições por minuto. Deixe vazio quando operation_type=DELETE. Valor padrão: null (sem alteração). Exemplo: 60

models[].request_limit_period

Number

Não

Período do limite de taxa de requisições, em segundos (inteiro positivo). Por exemplo, 60 equivale a 1 minuto. Valor padrão: null (sem alteração).

models[].usage_limit

Number

Não

Limite de uso (TPM), não negativo. Defina o uso máximo de tokens por minuto. Deixe vazio quando operation_type=DELETE. Valor padrão: null (sem alteração). Exemplo: 100000

models[].usage_limit_period

Number

Não

Período do limite de uso, em segundos (inteiro positivo). Por exemplo, 60 equivale a 1 minuto. Valor padrão: null (sem alteração).

Parâmetros da resposta

Parâmetro

Tipo

Descrição

request_id

String

ID da requisição. Exemplo: d5f5201f-ee7a-9e3d-8569-bc0eedec21f9

code

String

Código de erro. Retorna null em caso de sucesso.

message

String

Mensagem de erro. Retorna null em caso de sucesso.

success

Boolean

Indica se a chamada foi bem-sucedida. Exemplo: true

output

Object

Dados comerciais. Retorna null para este endpoint.

Cenário de isenção de TPM

Para limitar apenas o RPM e isentar o TPM, siga esta abordagem de duas etapas: primeiro, chame este endpoint com {"model":"X","operation_type":"DELETE"} para excluir todos os limites de taxa do modelo alvo. Em seguida, envie {"model":"X","operation_type":"OVERLAY","request_limit":60,"request_limit_period":60} para definir apenas o QPM. Essas etapas não são atômicas, portanto, existe uma breve janela sem limites entre elas.

Exemplos de requisições

Exemplo 1: Definir QPM=60 e TPM=100000
curl -X POST "https://dashscope.aliyuncs.com/api/v1/models/limits" \
    --header "Authorization: Bearer ${DASHSCOPE_API_KEY}" \
    --header 'Content-Type: application/json' \
    --data '{
        "models": [
            {
                "model": "qwen-plus",
                "operation_type": "OVERLAY",
                "request_limit": 60,
                "request_limit_period": 60,
                "usage_limit": 100000,
                "usage_limit_period": 60
            }
        ]
    }'
Exemplo 2: Exclua limites de taxa
curl -X POST "https://dashscope.aliyuncs.com/api/v1/models/limits" \
    --header "Authorization: Bearer ${DASHSCOPE_API_KEY}" \
    --header 'Content-Type: application/json' \
    --data '{
        "models": [
            {"model": "qwen-plus", "operation_type": "DELETE"}
        ]
    }'

Exemplo de resposta

Exemplo de sucesso
{
    "code": null,
    "message": null,
    "success": true,
    "output": null,
    "request_id": "d5f5201f-ee7a-9e3d-8569-bc0eedec21f9"
}
Exemplo de falha
{
    "code": "InvalidParameter",
    "message": "Cannot set TPM without QPM for model qwen-plus: no existing QPM limit, please set QPM first",
    "success": false,
    "output": null,
    "request_id": "d5f5201f-ee7a-9e3d-8569-bc0eedec21f9"
}

Códigos de erro

Em caso de falha na chamada, o sistema retorna uma mensagem de erro. Para obter mais informações sobre códigos de erro e soluções, consulte Error messages.
Referência da API de Geração de Texto
Geração de Imagens
  • FAQ
Geração de Vídeo
Áudio
API em tempo real
Incorporação de Texto
Produção de Modelos