Skip to main content
文本產生

qwen3.8-flash

Qwen3.8-Flash 是通義千問最新推出的多模態大模型,兼具強大的理解與生成能力和出色的回應速度。模型原生支援百萬級上下文視窗,能夠一次性處理超長文件、程式碼倉庫和複雜對話。在程式編寫輔助、智慧體協作、圖文理解等場景中表現尤為出色。同時相容 OpenAI 與 Anthropic 主流介面協定,可無縫接入 Claude Code、Codex 等開發者工具,輕鬆構建高併發應用與智慧工作流。憑藉優異的效能與極具競爭力的推理成本,Qwen3.8-Flash 是開發者和企業在 AI 應用中兼顧效果與效率的理想選擇。

模型能力

  • 中國(北京)
  • 新加坡
能力項支援情況能力項支援情況

輸入模態

圖片 文字 影片

輸出模態

文字

模型體驗

支援

Function Calling

支援

結構化輸出

支援

網路搜尋

支援

前綴續寫

支援

上下文快取

支援

批次推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

991808

最大輸出長度

131072

最大輸入長度(思考模式下)

983616

最大輸出長度(思考模式下)

131072

上下文長度

1000000

最大思維鏈長度

262144

模型價格

本文僅展示模型呼叫原價,不包含限時優惠等活動資訊,請前往 Model Studio 控制台查看活動優惠。
  • 中國(北京)
  • 新加坡
計費項價格(USD)單位

輸入

0.14

每百萬 tokens

輸出

0.42

每百萬 tokens

輸入(快取命中)

0.014

每百萬 tokens

顯式快取建立

0.177

每百萬 tokens

顯式快取命中

0.014

每百萬 tokens

限流

  • 中國(北京)
  • 新加坡
參數

RPM(每分鐘請求數)

30,000

TPM(每分鐘 tokens)

5,000,000

Token Plan
模型體驗
  • 音樂產生
用量統計與效能監控
資產中心
服務支援