Skip to main content
Geração de Texto

qwen-long

O Qwen-Long é um modelo de linguagem grande projetado para processamento de contexto ultra-longo, com suporte a chinês, inglês e outros idiomas. Ele processa até 10 milhões de tokens (aproximadamente 15 milhões de caracteres ou 15.000 páginas de documentos) em diálogos. Integrado a serviços de documentos, o modelo permite analisar e dialogar com arquivos de texto (TXT, DOCX, PDF, XLSX, EPUB, MOBI, MD, CSV) e de imagem (BMP, PNG, JPG/JPEG, GIF, digitalizações em PDF). Observação: requisições HTTP aceitam até 1 milhão de tokens; para conteúdos mais extensos, recomenda-se o envio de arquivos.

Provedor do service de inferência

O provedor do service de inferência para qwen-long é o Alibaba Cloud Model Studio.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Unsupported

Saídas estruturadas

Unsupported

Pesquisa na web

Unsupported

Conclusão de prefixo

Unsupported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

10.000.000

Comprimento máximo de saída

8.192

Janela de contexto

10.000.000

Atualizações dinâmicas

qwen-long-latest

O Qwen-Long é um modelo de linguagem grande projetado para processamento de contexto ultra-longo, com suporte a chinês, inglês e outros idiomas. Ele processa até 10 milhões de tokens (aproximadamente 15 milhões de caracteres ou 15.000 páginas de documentos) em diálogos. Integrado a serviços de documentos, o modelo permite analisar e dialogar com arquivos de texto (TXT, DOCX, PDF, XLSX, EPUB, MOBI, MD, CSV) e de imagem (BMP, PNG, JPG/JPEG, GIF, digitalizações em PDF). Observação: requisições HTTP aceitam até 1 milhão de tokens; para conteúdos mais extensos, recomenda-se o envio de arquivos.

Provedor do service de inferência

O provedor do service de inferência para qwen-long-latest é o Alibaba Cloud Model Studio.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Unsupported

Saídas estruturadas

Unsupported

Pesquisa na web

Unsupported

Conclusão de prefixo

Unsupported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

10.000.000

Comprimento máximo de saída

8.192

Janela de contexto

10.000.000

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,072

Por 1M tokens

Saída

0,287

Por 1M tokens

Entrada (arquivo em lote)

0,036

Por 1M tokens

Saída (arquivo em lote)

0,143

Por 1M tokens

Limites de taxa

  • China (Beijing)

Parâmetro

Valor

RPM (requisições por minuto)

1.200

TPM (tokens por minuto)

60.000

Versões snapshot

qwen-long-2025-01-25

O Qwen-Long é um modelo de linguagem grande projetado para processamento de contexto ultra-longo, com suporte a chinês, inglês e outros idiomas. Ele processa até 10 milhões de tokens (aproximadamente 15 milhões de caracteres ou 15.000 páginas de documentos) em diálogos. Integrado a serviços de documentos, o modelo permite analisar e dialogar com arquivos de texto (TXT, DOCX, PDF, XLSX, EPUB, MOBI, MD, CSV) e de imagem (BMP, PNG, JPG/JPEG, GIF, digitalizações em PDF). Observação: requisições HTTP aceitam até 1 milhão de tokens; para conteúdos mais extensos, recomenda-se o envio de arquivos.

Provedor do service de inferência

O provedor do service de inferência para qwen-long-2025-01-25 é o Alibaba Cloud Model Studio.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Unsupported

Saídas estruturadas

Unsupported

Pesquisa na web

Unsupported

Conclusão de prefixo

Unsupported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

10.000.000

Comprimento máximo de saída

8.192

Janela de contexto

10.000.000

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,072

Por 1M tokens

Saída

0,287

Por 1M tokens

Limites de taxa

  • China (Beijing)

Parâmetro

Valor

RPM (requisições por minuto)

3

TPM (tokens por minuto)

7.500

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento