Skip to main content
Vision

qwen-vl-ocr

Qwen-VL_OCR adalah model OCR yang dilatih berdasarkan Qwen-VL. Model ini mengintegrasikan berbagai tugas pengenalan, parsing, dan pemrosesan teks-gambar dalam satu pendekatan terpadu, sehingga memberikan kemampuan pengenalan teks-gambar yang kuat. Secara fungsional, versi model ini setara dengan snapshot model qwen-vl-ocr-2025-11-20.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen-vl-ocr adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Input Modality

Text Image

Output Modality

Text

Model Experience

Didukung

Function Calling

Tidak Didukung

Structured Outputs

Tidak Didukung

Web Search

Tidak Didukung

Prefix Completion

Tidak Didukung

Context Caching

Tidak Didukung

Batch Inference

Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

30000

Max Output Length

8192

Context Window

38192

Harga

Halaman ini hanya menampilkan harga standar untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
Item PenagihanHarga (USD)Unit

Input

0,043

Per 1 juta token

Output

0,072

Per 1 juta token

Input(Batch File)

0,022

Per 1 juta token

Output(Batch File)

0,036

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

6.000.000

Pembaruan Dinamis

qwen-vl-ocr-latest

VL-OCR (qwen-vl-ocr), Qwen-VL OCR.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen-vl-ocr-latest adalah Alibaba Cloud Model Studio.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Input Modality

Text Image

Output Modality

Text

Model Experience

Didukung

Function Calling

Tidak Didukung

Structured Outputs

Tidak Didukung

Web Search

Tidak Didukung

Prefix Completion

Tidak Didukung

Context Caching

Tidak Didukung

Batch Inference

Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

30000

Max Output Length

8192

Context Window

38192

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
Item PenagihanHarga (USD)Unit

Input

0,043

Per 1 juta token

Output

0,072

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
ParameterNilai

RPM (Requests Per Minute)

6000

TPM (Tokens Per Minute)

30.000.000

Versi Snapshot

qwen-vl-ocr-2025-11-20

Model ini merupakan versi snapshot per 20 November 2025, berdasarkan arsitektur Qwen-VL3 terbaru dengan peningkatan komprehensif. Model ini menunjukkan peningkatan signifikan dalam kemampuan parsing dokumen dan lokalisasi teks, serta pengurangan substansial dalam latensi end-to-end dan ilusi.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen-vl-ocr-2025-11-20 adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Input Modality

Text Image

Output Modality

Text

Model Experience

Didukung

Function Calling

Tidak Didukung

Structured Outputs

Tidak Didukung

Web Search

Tidak Didukung

Prefix Completion

Tidak Didukung

Context Caching

Tidak Didukung

Batch Inference

Tidak Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

30000

Max Output Length

8192

Context Window

38192

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
Item PenagihanHarga (USD)Unit

Input

0,043

Per 1 juta token

Output

0,072

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

6000

TPM (Tokens Per Minute)

30.000.000

qwen-vl-ocr-2025-04-13

VL-OCR (qwen-vl-ocr-2025-04-13), Qwen-VL OCR, 20250413.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen-vl-ocr-2025-04-13 adalah Alibaba Cloud Model Studio.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Input Modality

Text Image

Output Modality

Text

Model Experience

Didukung

Function Calling

Tidak Didukung

Structured Outputs

Tidak Didukung

Web Search

Tidak Didukung

Prefix Completion

Tidak Didukung

Context Caching

Tidak Didukung

Batch Inference

Tidak Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

30000

Max Output Length

4096

Context Window

34096

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
Item PenagihanHarga (USD)Unit

Input

0,717

Per 1 juta token

Output

0,717

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
ParameterNilai

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

6.000.000

qwen-vl-ocr-1028

VL-OCR (qwen-vl-ocr), Qwen-VL OCR. 28 Oktober 2024.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen-vl-ocr-1028 adalah Alibaba Cloud Model Studio.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Input Modality

Text Image

Output Modality

Text

Model Experience

Didukung

Function Calling

Tidak Didukung

Structured Outputs

Tidak Didukung

Web Search

Tidak Didukung

Prefix Completion

Tidak Didukung

Context Caching

Tidak Didukung

Batch Inference

Tidak Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

30000

Max Output Length

4096

Context Window

34096

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
Item PenagihanHarga (USD)Unit

Input

0,717

Per 1 juta token

Output

0,717

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
ParameterNilai

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

6.000.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center