O Qwen-Long processa documentos de até 10 milhões de tokens por meio de um mecanismo de upload e referência de arquivos, superando os limites de contexto dos modelos padrão.
Este documento se aplica apenas à região da China continental (Beijing). Para usar o modelo, utilize uma chave de API da região da China continental (Beijing).
Como usar
Use o Qwen-Long em duas etapas: faça o upload dos arquivos e depois chame a API.
-
Upload e análise de arquivos:
- Faça o upload de um arquivo usando a API. Para obter detalhes sobre os formatos de arquivo suportados e limites de tamanho, consulte Formatos suportados.
- Após um upload bem-sucedido, o sistema retorna um
file-idúnico para sua conta e inicia a análise. Não há cobrança pelo upload, armazenamento ou análise do arquivo.
-
Chamada de API e faturamento:
- Ao chamar o modelo, referencie um ou mais
file-ids na mensagemsystem. - O modelo executa a inferência com base no conteúdo de texto associado ao
file-id. - Em cada chamada de API, o número de tokens no conteúdo do arquivo referenciado conta como tokens de entrada daquela solicitação.
- Ao chamar o modelo, referencie um ou mais
Primeiros passos
Pré-requisitos
- Obtenha uma chave de API e configure-a como variável de ambiente.
- Para chamar o modelo via SDK, instale o OpenAI SDK.
Fazer upload de um documento
Este exemplo faz o upload do arquivo Model_Studio_Phone_Product_Introduction.docx para o armazenamento seguro do Model Studio por meio da interface compatível com OpenAI e obtém um file-id. Consulte a documentação da API para ver os parâmetros de upload.
Python
file-id do arquivo enviado.
Passar informações e conversar usando um ID de arquivo
Passe o file-id nas mensagens do sistema: a primeira mensagem define a função, a segunda contém o file-id e, em seguida, adicione as perguntas do usuário.
Documentos mais longos exigem maior tempo de análise. Aguarde a conclusão da análise antes de fazer a chamada.
Python
Passar vários documentos
Passe vários file-id s em uma única mensagem do sistema ou adicione mensagens de sistema separadas para cada documento.
- Pass multiple documents
- Append documents
Python
Passar informações como texto simples
Em vez de usar file-id s, passe o conteúdo do documento diretamente como string. Adicione as definições de função na primeira mensagem para evitar confusão com o conteúdo do documento.
Se o conteúdo do documento exceder 1 milhão de tokens, use um ID de arquivo devido aos limites de tamanho da API.
- Simple example
- Pass multiple documents
- Append documents
Insira o conteúdo do documento diretamente na Mensagem do Sistema.
Python
Preços do modelo
China continental
Se você selecionar o escopo de implantação China continental, os recursos de computação para inferência do modelo ficarão restritos à China continental. Os dados estáticos são armazenados na região selecionada. Região suportada: China (Beijing).
| Modelo | Versão | Janela de contexto | Entrada máx. | Saída máx. | Custo de entrada | Custo de saída | Cota gratuitaNota |
|---|---|---|---|---|---|---|---|
| (tokens) | (por 1M tokens) | ||||||
qwen-longChamadas em lote pela metade do preço | Estável | 10.000.000 | 10.000.000 | 32.768 | 0,5 CNY | 2 CNY | 1 milhão de tokens cadaVálido por 90 dias após ativar o Model Studio |
qwen-long-latestSempre corresponde à versão snapshot mais recente Chamadas em lote pela metade do preço | Mais recente | ||||||
qwen-long-2025-01-25Também conhecido como qwen-long-0125 | Snapshot | 0,5 CNY | 2 CNY | ||||
| Nome do modelo | Versão | Tamanho do contexto | Entrada máx. | Saída máx. | Custo de entrada | Custo de saída |
|---|---|---|---|---|---|---|
| (Tokens) | (por 1 milhão de tokens) | |||||
qwen-long-latestSempre possui os mesmos recursos da versão snapshot mais recente. | Mais recente | 10.000.000 | 10.000.000 | 32.768 | $0,072 | $0,287 |
qwen-long-2025-01-25Também conhecido como qwen-long-0125. | Snapshot | |||||
Perguntas frequentes
- O modelo Qwen-Long suporta o envio de jobs em lote? Sim. O Qwen-Long suporta a API Batch da OpenAI com 50% das taxas de chamadas em tempo real. Envie jobs em lote como arquivos; os jobs são executados assincronicamente e retornam resultados após a conclusão ou timeout.
- Onde os arquivos são salvos após o upload usando a API de arquivos compatível com OpenAI? Os arquivos são enviados para o bucket do Model Studio sem custo. Consulte a API de Arquivos OpenAI para consultar e gerenciar arquivos.
-
O que é
qwen-long-2025-01-25? Trata-se de um snapshot de versão congelado em um ponto específico no tempo. É mais estável quelateste não tem data de expiração. -
Como garantir que o modelo gere uma string JSON em formato padrão?
O
qwen-longe todos os snapshots suportam saída estruturada. Especifique um JSON Schema para garantir um JSON válido que corresponda à sua estrutura.
Referência da API
Consulte Detalhes da API Qwen para ver os parâmetros de entrada e saída do modelo Qwen-Long.
Códigos de erro
Se a chamada do modelo falhar e retornar uma mensagem de erro, consulte Códigos de erro para resolução.
Limites
-
Dependências do SDK:
- Operações de arquivo (upload, exclusão, consulta) exigem um SDK compatível com OpenAI.
- Invoque modelos usando um SDK compatível com OpenAI ou Dashscope SDK.
-
Upload de arquivos:
- Formatos suportados: TXT, DOCX, PDF, XLSX, EPUB, MOBI, MD, CSV, JSON, BMP, PNG, JPG/JPEG e GIF.
- Tamanho do arquivo: O tamanho máximo para arquivos de imagem é 20 MB. Para outros formatos de arquivo, o limite é 150 MB.
- Cota da conta: Máximo de 10.000 arquivos ou 100 GB por conta. Os uploads falham quando qualquer um dos limites é atingido. Exclua arquivos para liberar cota. Consulte Compatível com OpenAI - Arquivo.
- Período de armazenamento: Atualmente, não há limite de expiração para arquivos armazenados.
-
Entradas da API:
- A primeira mensagem
systemdefine a função. A segunda contém o conteúdo do documento oufileid://xxx. A mensagemusercontém a consulta. - Ao referenciar arquivos usando um
file-id, uma única solicitação pode referenciar no máximo 100 arquivos. - Com uma segunda mensagem
system, o limite da mensagemuseré de 9.000 tokens. Não há limite com apenas uma mensagem de sistema. - O tamanho total do contexto é limitado a 10 milhões de tokens.
- A primeira mensagem
-
Saídas da API:
- O comprimento máximo de saída é 32.768 tokens.
-
Compartilhamento de arquivos:
- Os
file-ids são específicos da conta e não podem ser usados entre contas diferentes ou com chaves de API de usuários RAM.
- Os
- Limitação de taxa: Para obter informações sobre as condições de limitação de taxa do modelo, consulte Limitação de taxa.