Skip to main content
視覺理解

qwen-vl-ocr

千問VL-OCR(qwen-vl-ocr),即基於Qwen-VL訓練的OCR識別大模型。通過統一模型的方式彙總多種圖文識別、解析、處理類任務,提供強大的圖文識別能力。該模型版本功能等同於快照模型 qwen-vl-ocr-2025-11-20。

推理服務供應商

qwen-vl-ocr模型的推理服務供應商為阿里雲百鍊。

模型能力

  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
能力項支援情況能力項支援情況

輸入模態

Text Image

輸出模態

Text

模型體驗

支援

Function Calling

不支援

結構化輸出

不支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

不支援

批量推理

支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

30000

最大輸出長度

8192

上下文長度

38192

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
計費項目價格(美元)單位

輸入

0.043

每百萬tokens

輸出

0.072

每百萬tokens

輸入(Batch File)

0.022

每百萬tokens

輸出(Batch File)

0.036

每百萬tokens

限流

  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
參數

RPM(每分鐘請求數)

600

TPM(每分鐘tokens)

6,000,000

動態更新

qwen-vl-ocr-latest

千問VL-OCR(qwen-vl-ocr),即基於Qwen-VL訓練的OCR識別大模型。通過統一模型的方式彙總多種圖文識別、解析、處理類任務,提供強大的圖文識別能力。

推理服務供應商

qwen-vl-ocr-latest模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text Image

輸出模態

Text

模型體驗

支援

Function Calling

不支援

結構化輸出

不支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

不支援

批量推理

支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

30000

最大輸出長度

8192

上下文長度

38192

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
計費項目價格(美元)單位

輸入

0.043

每百萬tokens

輸出

0.072

每百萬tokens

限流

  • 華北2(北京)
參數

RPM(每分鐘請求數)

6000

TPM(每分鐘tokens)

30,000,000

快照版本

qwen-vl-ocr-2025-11-20

本模型為2025年11月20日的快照版本,基於最新Qwen-VL3架構全面升級,在文檔解析,文字定位能力全面升級,端到端時延,幻覺大幅降低。

推理服務供應商

qwen-vl-ocr-2025-11-20模型的推理服務供應商為阿里雲百鍊。

模型能力

  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
能力項支援情況能力項支援情況

輸入模態

Text Image

輸出模態

Text

模型體驗

支援

Function Calling

不支援

結構化輸出

不支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

不支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

30000

最大輸出長度

8192

上下文長度

38192

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
計費項目價格(美元)單位

輸入

0.043

每百萬tokens

輸出

0.072

每百萬tokens

限流

  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
參數

RPM(每分鐘請求數)

6000

TPM(每分鐘tokens)

30,000,000

qwen-vl-ocr-2025-04-13

千問VL-OCR(qwen-vl-ocr-2025-04-13),即基於Qwen-VL訓練的OCR識別大模型。通過統一模型的方式彙總多種圖文識別、解析、處理類任務,提供強大的圖文識別能力。模型內建六種識別任務分別是:通用識別、文檔解析、表格解析、資訊抽取、多語言識別、公式識別。本模型為2025年04月13日的快照版本。

推理服務供應商

qwen-vl-ocr-2025-04-13模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text Image

輸出模態

Text

模型體驗

支援

Function Calling

不支援

結構化輸出

不支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

不支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

30000

最大輸出長度

4096

上下文長度

34096

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
計費項目價格(美元)單位

輸入

0.717

每百萬tokens

輸出

0.717

每百萬tokens

限流

  • 華北2(北京)
參數

RPM(每分鐘請求數)

600

TPM(每分鐘tokens)

6,000,000

qwen-vl-ocr-1028

千問VL-OCR(qwen-vl-ocr),即基於Qwen-VL訓練的OCR識別大模型。通過統一模型的方式彙總多種圖文識別、解析、處理類任務,提供強大的圖文識別能力。本模型為2024年10月28日的快照版本。

推理服務供應商

qwen-vl-ocr-1028模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text Image

輸出模態

Text

模型體驗

支援

Function Calling

不支援

結構化輸出

不支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

不支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

30000

最大輸出長度

4096

上下文長度

34096

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
計費項目價格(美元)單位

輸入

0.717

每百萬tokens

輸出

0.717

每百萬tokens

限流

  • 華北2(北京)
參數

RPM(每分鐘請求數)

600

TPM(每分鐘tokens)

6,000,000

Token Plan
模型體驗
  • 音樂產生
用量統計與效能監控
資產中心