調用 GET /api/v1/models/limits 介面查詢當前 API Key 下各模型的限流配額,包括請求頻率限制和用量限制,用於瞭解和規劃 API 呼叫量。
前提條件
已建立 API Key 並配置為環境變數 DASHSCOPE_API_KEY。配置方法請參見配置API Key到環境變數。
請求說明
- HTTP 方法:GET
-
請求地址
調用時請將
{WorkspaceId}替換為您的業務空間 ID。地區
Endpoint
華北2(北京)
https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/models/limits -
認證方式
在請求 Header 中設定
Authorization: Bearer {API_KEY}。
請求參數
所有參數均通過 Query String 傳遞。
參數 | 類型 | 必選 | 描述 |
|---|---|---|---|
name | String | 否 | 按模型名稱進行模糊搜尋。樣本: |
model | String | 否 | 按模型 ID 進行精確查詢。樣本: |
page_no | Integer | 否 | 頁碼,從 1 開始。預設值: |
page_size | Integer | 否 | 每頁返回的模型數量。預設值: |
返回參數
參數 | 類型 | 描述 |
|---|---|---|
request_id | String | 請求 ID,用於問題排查。 |
output.total | Number | 合格模型總數。 |
output.page_no | Number | 當前頁碼。 |
output.page_size | Number | 每頁條數。 |
output.quotas[].model | String | 模型 ID。 |
output.quotas[].workspace_id | String | 業務空間 ID。 |
output.quotas[].model_limit | Object | 帳號層級限流,即該模型在當前帳號下的總限流上限。包含以下欄位:
|
output.quotas[].workspace_limit | Object | 業務空間層級限流。您可以為每個業務空間單獨設定限流,但所有業務空間的總限流不能超過 |
請求樣本
樣本一:查詢所有模型的限額
返回樣本
qwen3-max:每秒最多 500 次請求,每 6 秒最多使用 500,000 Token,未設定業務空間層級限制。wan2.6-i2v-flash:每秒最多 5 次請求,無用量限制,非同步任務最大排隊數 500、最大並發數 5。qwen-image-max:每分鐘最多 2 次請求,每分鐘最多使用 1,000,000 Token,未設定業務空間層級限制。