GLM-5.2-Fast-Preview 是智譜 AI 旗艦模型 GLM-5.2 的高速版本,支援 1M 超長上下文,模型能力對齊 GLM-5.2 標準版,具備邏輯推理、長文本理解與代碼產生能力。通過推理加速最佳化,輸出 TPS 可達 GLM-5.2 標準版的 1.5~2 倍,顯著提升輸出速度,適用於即時對話、Agent 多輪調用、流式代碼產生等對輸出速度敏感的情境。
推理服務供應商
glm-5.2-fast-preview模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text | 輸出模態 | Text |
模型體驗 | 不支援 | Function Calling | 支援 |
結構化輸出 | 支援 | 連網搜尋 | 支援 |
首碼續寫 | 支援 | 上下文緩衝 | 支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 1048576 | 最大輸出長度 | 131072 |
上下文長度 | 1048576 | 最大輸入長度(思考模式下) | 1048576 |
最大輸出長度(思考模式下) | 131072 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 2.2 | 每百萬tokens |
輸出 | 7.702 | 每百萬tokens |
輸入(快取命中) | 0.55 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 30000 |
TPM(每分鐘tokens) | 1,000,000 |
快照版本
glm-5.2-fast-preview
GLM-5.2-Fast-Preview 是智譜 AI 旗艦模型 GLM-5.2 的高速版本,支援 1M 超長上下文,模型能力對齊 GLM-5.2 標準版,具備邏輯推理、長文本理解與代碼產生能力。通過推理加速最佳化,輸出 TPS 可達 GLM-5.2 標準版的 1.5~2 倍,顯著提升輸出速度,適用於即時對話、Agent 多輪調用、流式代碼產生等對輸出速度敏感的情境。
推理服務供應商
glm-5.2-fast-preview模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text | 輸出模態 | Text |
模型體驗 | 不支援 | Function Calling | 支援 |
結構化輸出 | 支援 | 連網搜尋 | 支援 |
首碼續寫 | 支援 | 上下文緩衝 | 支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 1048576 | 最大輸出長度 | 131072 |
上下文長度 | 1048576 | 最大輸入長度(思考模式下) | 1048576 |
最大輸出長度(思考模式下) | 131072 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 2.2 | 每百萬tokens |
輸出 | 7.702 | 每百萬tokens |
輸入(快取命中) | 0.55 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 30000 |
TPM(每分鐘tokens) | 1,000,000 |