Skip to main content
文本產生

qwen3.8-max

2.4萬億參數的MoE架構旗艦模型,在編程與辦公情境能力提升,適用於法律、金融、設計等專業任務。具備原生視覺理解能力,支援超長文檔與長視頻的語義解析,並支援長程任務的自主規劃與迭代。

模型調用 ID(model 參數取值):qwen3.8-max

模型能力

  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
  • 日本(東京)
  • 中國香港

能力項

支援情況

能力項

支援情況

輸入模態

Image Text Video

輸出模態

Text

模型體驗

支援

Function Calling

支援

結構化輸出

支援

連網搜尋

支援

首碼續寫

支援

上下文緩衝

支援

批量推理

支援

模型調優

不支援

上下文限制

參數

參數

最大輸入長度

991808

最大輸出長度

131072

最大輸入長度(思考模式下)

983616

最大輸出長度(思考模式下)

131072

上下文長度

1000000

最大思維鏈長度

262144

在不同的API輸入參數組合下,模型支援的長度可能會有變化。

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
  • 日本(東京)
  • 中國香港

計費項目

價格(美元)

單位

輸入

1.65

每百萬tokens

輸出

4.951

每百萬tokens

輸入(快取命中)

0.206

每百萬tokens

輸入(Batch File)

0.825

每百萬tokens

輸出(Batch File)

2.475

每百萬tokens

顯式緩衝建立

2.063

每百萬tokens

顯式快取命中

0.137

每百萬tokens

輸入(Batch Chat)

1.65

每百萬tokens

輸出(Batch Chat)

4.951

每百萬tokens

限流

  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
  • 日本(東京)
  • 中國香港

參數

RPM(每分鐘請求數)

30,000

TPM(每分鐘tokens)

5,000,000

Token Plan
模型體驗
  • 音樂產生
用量統計與效能監控
資產中心
服務支援