千問3系列Max模型,相較preview版本在智能體編程與工具調用方向進行了專項升級。本次發布的正式版模型達到領域SOTA水平,適配情境更加複雜的智能體需求。該模型版本功能等同於快照模型 qwen3-max-2026-01-23。
推理服務供應商
qwen3-max模型的推理服務供應商為阿里雲百鍊。
模型能力
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
- 中國香港
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text | 輸出模態 | Text |
模型體驗 | 支援 | Function Calling | 支援 |
結構化輸出 | 支援 | 連網搜尋 | 支援 |
首碼續寫 | 支援 | 上下文緩衝 | 支援 |
批量推理 | 支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 258048 | 最大輸出長度 | 65536 |
上下文長度 | 262144 | 最大輸入長度(思考模式下) | 258048 |
最大輸出長度(思考模式下) | 32768 | 最大思維鏈長度 | 81920 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
- 中國香港
輸入<=32k
輸入<=32k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.359 | 每百萬tokens |
輸出 | 1.434 | 每百萬tokens |
輸入(快取命中) | 0.072 | 每百萬tokens |
輸入(Batch File) | 0.18 | 每百萬tokens |
輸出(Batch File) | 0.717 | 每百萬tokens |
顯式緩衝建立 | 0.448 | 每百萬tokens |
顯式快取命中 | 0.036 | 每百萬tokens |
輸入(Batch Chat) | 0.359 | 每百萬tokens |
輸出(Batch Chat) | 1.434 | 每百萬tokens |
32k<輸入<=128k
32k<輸入<=128k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.574 | 每百萬tokens |
輸出 | 2.294 | 每百萬tokens |
輸入(快取命中) | 0.115 | 每百萬tokens |
輸入(Batch File) | 0.287 | 每百萬tokens |
輸出(Batch File) | 1.147 | 每百萬tokens |
顯式緩衝建立 | 0.717 | 每百萬tokens |
顯式快取命中 | 0.058 | 每百萬tokens |
輸入(Batch Chat) | 0.574 | 每百萬tokens |
輸出(Batch Chat) | 2.294 | 每百萬tokens |
128k<輸入<=256k
128k<輸入<=256k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 1.004 | 每百萬tokens |
輸出 | 4.014 | 每百萬tokens |
輸入(快取命中) | 0.201 | 每百萬tokens |
輸入(Batch File) | 0.502 | 每百萬tokens |
輸出(Batch File) | 2.007 | 每百萬tokens |
顯式緩衝建立 | 1.255 | 每百萬tokens |
顯式快取命中 | 0.101 | 每百萬tokens |
輸入(Batch Chat) | 1.004 | 每百萬tokens |
輸出(Batch Chat) | 4.014 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
- 中國香港
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 30000 |
TPM(每分鐘tokens) | 5,000,000 |
快照版本
qwen3-max-preview
Qwen3系列Max模型Preview版本,實現思考模式和非思考模式的有效融合。思考模式下在智能體編程能力、常識知識推理能力、數學/科學/通用類推理等能力上均有顯著增強。
推理服務供應商
qwen3-max-preview模型的推理服務供應商為阿里雲百鍊。
模型能力
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text | 輸出模態 | Text |
模型體驗 | 支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 258048 | 最大輸出長度 | 65536 |
上下文長度 | 262144 | 最大輸入長度(思考模式下) | 258048 |
最大輸出長度(思考模式下) | 32768 | 最大思維鏈長度 | 81920 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
輸入<=32k
輸入<=32k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.861 | 每百萬tokens |
輸出 | 3.441 | 每百萬tokens |
輸入(快取命中) | 0.173 | 每百萬tokens |
32k<輸入<=128k
32k<輸入<=128k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 1.434 | 每百萬tokens |
輸出 | 5.735 | 每百萬tokens |
輸入(快取命中) | 0.287 | 每百萬tokens |
128k<輸入<=256k
128k<輸入<=256k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 2.151 | 每百萬tokens |
輸出 | 8.602 | 每百萬tokens |
輸入(快取命中) | 0.431 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 600 |
TPM(每分鐘tokens) | 1,000,000 |
qwen3-max-2026-01-23
千問3系列Max模型,相較2025年9月23日快照,此版本實現思考模式和非思考模式的有效融合,模型整體效果得到全方位的大幅度提升。在思考模式下,同時發布Web搜尋、Web資訊提取和代碼解譯器工具能力,使得模型在慢思考的同時,能夠通過引入外部工具,以更高的準確性解決更有難度的問題。此版本為2026年1月23日快照。
推理服務供應商
qwen3-max-2026-01-23模型的推理服務供應商為阿里雲百鍊。
模型能力
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 中國香港
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text | 輸出模態 | Text |
模型體驗 | 支援 | Function Calling | 支援 |
結構化輸出 | 支援 | 連網搜尋 | 支援 |
首碼續寫 | 支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 258048 | 最大輸出長度 | 65536 |
上下文長度 | 262144 | 最大輸入長度(思考模式下) | 258048 |
最大輸出長度(思考模式下) | 32768 | 最大思維鏈長度 | 81920 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 中國香港
輸入<=32k
輸入<=32k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.359 | 每百萬tokens |
輸出 | 1.434 | 每百萬tokens |
32k<輸入<=128k
32k<輸入<=128k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.574 | 每百萬tokens |
輸出 | 2.294 | 每百萬tokens |
128k<輸入<=256k
128k<輸入<=256k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 1.004 | 每百萬tokens |
輸出 | 4.014 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 中國香港
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 600 |
TPM(每分鐘tokens) | 1,000,000 |
qwen3-max-2025-09-23
千問3系列Max模型,相較preview版本在智能體編程與工具調用方向進行了專項升級。本次發布的正式版模型達到領域SOTA水平,適配情境更加複雜的智能體需求。此版本為2025年9月23日快照。
推理服務供應商
qwen3-max-2025-09-23模型的推理服務供應商為阿里雲百鍊。
模型能力
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text | 輸出模態 | Text |
模型體驗 | 支援 | Function Calling | 支援 |
結構化輸出 | 支援 | 連網搜尋 | 支援 |
首碼續寫 | 支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 258048 | 最大輸出長度 | 32768 |
上下文長度 | 262144 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
輸入<=32k
輸入<=32k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.86 | 每百萬tokens |
輸出 | 3.44 | 每百萬tokens |
32k<輸入<=128k
32k<輸入<=128k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 1.434 | 每百萬tokens |
輸出 | 5.734 | 每百萬tokens |
128k<輸入<=256k
128k<輸入<=256k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 2.15 | 每百萬tokens |
輸出 | 8.601 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 60 |
TPM(每分鐘tokens) | 100,000 |