Skip to main content
文本產生

glm-5.2-fast-preview

GLM-5.2-Fast-Preview 是智譜 AI 旗艦模型 GLM-5.2 的高速版本,支援 1M 超長上下文,模型能力對齊 GLM-5.2 標準版,具備邏輯推理、長文本理解與代碼產生能力。通過推理加速最佳化,輸出 TPS 可達 GLM-5.2 標準版的 1.5~2 倍,顯著提升輸出速度,適用於即時對話、Agent 多輪調用、流式代碼產生等對輸出速度敏感的情境。

推理服務供應商

glm-5.2-fast-preview模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

不支援

Function Calling

支援

結構化輸出

支援

連網搜尋

支援

首碼續寫

支援

上下文緩衝

支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

1048576

最大輸出長度

131072

上下文長度

1048576

最大輸入長度(思考模式下)

1048576

最大輸出長度(思考模式下)

131072

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
  • 新加坡
計費項目價格(美元)單位

輸入

2.2

每百萬tokens

輸出

7.702

每百萬tokens

輸入(快取命中)

0.55

每百萬tokens

限流

  • 華北2(北京)
  • 新加坡
參數

RPM(每分鐘請求數)

30000

TPM(每分鐘tokens)

1,000,000

快照版本

glm-5.2-fast-preview

GLM-5.2-Fast-Preview 是智譜 AI 旗艦模型 GLM-5.2 的高速版本,支援 1M 超長上下文,模型能力對齊 GLM-5.2 標準版,具備邏輯推理、長文本理解與代碼產生能力。通過推理加速最佳化,輸出 TPS 可達 GLM-5.2 標準版的 1.5~2 倍,顯著提升輸出速度,適用於即時對話、Agent 多輪調用、流式代碼產生等對輸出速度敏感的情境。

推理服務供應商

glm-5.2-fast-preview模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

不支援

Function Calling

支援

結構化輸出

支援

連網搜尋

支援

首碼續寫

支援

上下文緩衝

支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

1048576

最大輸出長度

131072

上下文長度

1048576

最大輸入長度(思考模式下)

1048576

最大輸出長度(思考模式下)

131072

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
  • 新加坡
計費項目價格(美元)單位

輸入

2.2

每百萬tokens

輸出

7.702

每百萬tokens

輸入(快取命中)

0.55

每百萬tokens

限流

  • 華北2(北京)
  • 新加坡
參數

RPM(每分鐘請求數)

30000

TPM(每分鐘tokens)

1,000,000

Token Plan
模型體驗
  • 音樂產生
用量統計與效能監控
資產中心
服務支援