Qwen3.8-Flash 是通義千問最新推出的多模態大模型,兼具強大的理解與生成能力和出色的回應速度。模型原生支援百萬級上下文視窗,能夠一次性處理超長文件、程式碼倉庫和複雜對話。在程式編寫輔助、智慧體協作、圖文理解等場景中表現尤為出色。同時相容 OpenAI 與 Anthropic 主流介面協定,可無縫接入 Claude Code、Codex 等開發者工具,輕鬆構建高併發應用與智慧工作流。憑藉優異的效能與極具競爭力的推理成本,Qwen3.8-Flash 是開發者和企業在 AI 應用中兼顧效果與效率的理想選擇。
模型能力
- 中國(北京)
- 新加坡
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | 圖片 文字 影片 | 輸出模態 | 文字 |
模型體驗 | 支援 | Function Calling | 支援 |
結構化輸出 | 支援 | 網路搜尋 | 支援 |
前綴續寫 | 支援 | 上下文快取 | 支援 |
批次推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 991808 | 最大輸出長度 | 131072 |
最大輸入長度(思考模式下) | 983616 | 最大輸出長度(思考模式下) | 131072 |
上下文長度 | 1000000 | 最大思維鏈長度 | 262144 |
模型價格
本文僅展示模型呼叫原價,不包含限時優惠等活動資訊,請前往 Model Studio 控制台查看活動優惠。
- 中國(北京)
- 新加坡
| 計費項 | 價格(USD) | 單位 |
|---|---|---|
輸入 | 0.14 | 每百萬 tokens |
輸出 | 0.42 | 每百萬 tokens |
輸入(快取命中) | 0.014 | 每百萬 tokens |
顯式快取建立 | 0.177 | 每百萬 tokens |
顯式快取命中 | 0.014 | 每百萬 tokens |
限流
- 中國(北京)
- 新加坡
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 30,000 |
TPM(每分鐘 tokens) | 5,000,000 |