O Qwen-VL_OCR é um modelo de OCR treinado com base no Qwen-VL. Ele integra diversas tarefas de reconhecimento, análise e processamento de texto em imagens em uma abordagem de modelo unificado, oferecendo recursos avançados de reconhecimento óptico de caracteres. Esta versão do modelo é funcionalmente equivalente ao snapshot qwen-vl-ocr-2025-11-20.
Provedor de service de inferência
O Alibaba Cloud Model Studio fornece o service de inferência para qwen-vl-ocr.
Capacidades do modelo
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text Image | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Unsupported |
Saídas estruturadas | Unsupported | Pesquisa na web | Unsupported |
Conclusão de prefixo | Unsupported | Cache de contexto | Unsupported |
Inferência em lote | Supported | Ajuste fino | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 30000 | Comprimento máximo de saída | 8192 |
Janela de contexto | 38192 |
Preços
Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0,043 | Por 1 milhão de tokens |
Saída | 0,072 | Por 1 milhão de tokens |
Entrada (arquivo em lote) | 0,022 | Por 1 milhão de tokens |
Saída (arquivo em lote) | 0,036 | Por 1 milhão de tokens |
Limites de taxa
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Parâmetro | Valor |
RPM (solicitações por minuto) | 600 |
TPM (tokens por minuto) | 6.000.000 |
Atualizações dinâmicas
qwen-vl-ocr-latest
O VL-OCR (qwen-vl-ocr) é a versão mais recente do Qwen-VLOCR.
Provedor de service de inferência
O Alibaba Cloud Model Studio fornece o service de inferência para qwen-vl-ocr-latest.
Capacidades do modelo
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text Image | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Unsupported |
Saídas estruturadas | Unsupported | Pesquisa na web | Unsupported |
Conclusão de prefixo | Unsupported | Cache de contexto | Unsupported |
Inferência em lote | Supported | Ajuste fino | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 30000 | Comprimento máximo de saída | 8192 |
Janela de contexto | 38192 |
Preços
Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
- China (Beijing)
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0,043 | Por 1 milhão de tokens |
Saída | 0,072 | Por 1 milhão de tokens |
Limites de taxa
- China (Beijing)
Parâmetro | Valor |
RPM (solicitações por minuto) | 6000 |
TPM (tokens por minuto) | 30.000.000 |
Versões snapshot
qwen-vl-ocr-2025-11-20
Este modelo é um snapshot de 20 de novembro de 2025, baseado na arquitetura mais recente do Qwen-VL3 com uma atualização abrangente. Apresenta melhorias significativas nas capacidades de análise de documentos e localização de texto, além de reduções substanciais na latência de ponta a ponta e nas alucinações.
Provedor de service de inferência
O Alibaba Cloud Model Studio fornece o service de inferência para qwen-vl-ocr-2025-11-20.
Capacidades do modelo
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text Image | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Unsupported |
Saídas estruturadas | Unsupported | Pesquisa na web | Unsupported |
Conclusão de prefixo | Unsupported | Cache de contexto | Unsupported |
Inferência em lote | Unsupported | Ajuste fino | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 30000 | Comprimento máximo de saída | 8192 |
Janela de contexto | 38192 |
Preços
Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0,043 | Por 1 milhão de tokens |
Saída | 0,072 | Por 1 milhão de tokens |
Limites de taxa
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Parâmetro | Valor |
RPM (solicitações por minuto) | 6000 |
TPM (tokens por minuto) | 30.000.000 |
qwen-vl-ocr-2025-04-13
O VL-OCR (qwen-vl-ocr-2025-04-13) é uma versão do Qwen-VLOCR. Este snapshot foi lançado em 13 de abril de 2025.
Provedor de service de inferência
O Alibaba Cloud Model Studio fornece o service de inferência para qwen-vl-ocr-2025-04-13.
Capacidades do modelo
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text Image | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Unsupported |
Saídas estruturadas | Unsupported | Pesquisa na web | Unsupported |
Conclusão de prefixo | Unsupported | Cache de contexto | Unsupported |
Inferência em lote | Unsupported | Ajuste fino | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 30000 | Comprimento máximo de saída | 4096 |
Janela de contexto | 34096 |
Preços
Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
- China (Beijing)
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0.717 | Por 1 milhão de tokens |
Saída | 0.717 | Por 1 milhão de tokens |
Limites de taxa
- China (Beijing)
Parâmetro | Valor |
RPM (solicitações por minuto) | 600 |
TPM (tokens por minuto) | 6.000.000 |
qwen-vl-ocr-1028
O VL-OCR (qwen-vl-ocr) é uma versão do Qwen-VLOCR. Este snapshot foi lançado em 28 de outubro de 2024.
Provedor de service de inferência
O Alibaba Cloud Model Studio fornece o service de inferência para qwen-vl-ocr-1028.
Capacidades do modelo
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text Image | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Unsupported |
Saídas estruturadas | Unsupported | Pesquisa na web | Unsupported |
Conclusão de prefixo | Unsupported | Cache de contexto | Unsupported |
Inferência em lote | Unsupported | Ajuste fino | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 30000 | Comprimento máximo de saída | 4096 |
Janela de contexto | 34096 |
Preços
Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
- China (Beijing)
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0.717 | Por 1 milhão de tokens |
Saída | 0.717 | Por 1 milhão de tokens |
Limites de taxa
- China (Beijing)
Parâmetro | Valor |
RPM (solicitações por minuto) | 600 |
TPM (tokens por minuto) | 6.000.000 |