Parâmetros de entrada e saída para chamar o Qwen-MT por meio da interface compatível com OpenAI ou da API do DashScope .
Referências: Tradução automática (Qwen-MT)
Compatível com OpenAI
- Região de Singapura
- Região da Virgínia
- Região de Pequim
base_url para SDK: https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1Endpoint HTTP: POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1/chat/completionsPrimeiro, crie uma chave de API e configure-a como variável de ambiente . Se você usar o SDK da OpenAI, instale o SDK .
Corpo da solicitação |
|
model string (Obrigatório)Nome do modelo. Suportados: qwen-mt-plus, qwen-mt-flash, qwen-mt-lite, qwen-mt-turbo. | |
messages array (Obrigatório)Array de mensagens que fornecem contexto ao modelo. Apenas mensagens de usuário são suportadas.
Tipo de mensagem Mensagem do Usuário object (Obrigatório)Uma mensagem do usuário contendo a frase a ser traduzida.
Propriedades content string (Obrigatório)Frase a ser traduzida.role string (Obrigatório)Função da mensagem do usuário. Deve ser definida como user. | |
stream boolean (Opcional) O padrão é false.Ativa o modo de saída em streaming.Valores válidos:
Os modelos qwen-mt-flash e qwen-mt-lite retornam dados incrementalmente (cada parte contém apenas conteúdo novo). Já os modelos qwen-mt-plus e qwen-mt-turbo retornam dados não incrementalmente (cada parte contém toda a sequência até o momento). Esse comportamento não pode ser alterado. Exemplo:II didnI didn'tI didn't laughI didn't laugh after... | |
stream_options object (Opcional)Itens de configuração para saída em streaming. Este parâmetro só tem efeito quando stream está definido como true.
Propriedades include_usage boolean (Opcional) O padrão é false.Inclui informações de consumo de tokens na última parte dos dados.Valores válidos:
| |
max_tokens integer (Opcional)Número máximo de tokens a serem gerados. Se a saída exceder esse valor, a resposta será truncada.Os valores padrão e máximo correspondem ao comprimento máximo de saída do modelo. Para mais informações, consulte Seleção de modelo. | |
seed integer (Opcional)Semente de número aleatório para resultados reproduzíveis. Usar a mesma seed e os mesmos parâmetros gera uma saída consistente.Intervalo de valores: [0, 2 31 -1]. | |
temperature float (Opcional) O padrão é 0,65.Temperatura de amostragem que controla a diversidade do texto gerado.Valores mais altos produzem texto mais diversificado. Valores mais baixos resultam em texto mais determinístico.Intervalo de valores: [0, 2)Tanto temperature quanto top_p controlam a diversidade do texto. Defina apenas um deles. | |
top_p float (Opcional) O padrão é 0,8.Limiar de probabilidade para amostragem de núcleo que controla a diversidade do texto gerado.Valores mais altos produzem texto mais diversificado. Valores mais baixos resultam em texto mais determinístico.Intervalo de valores: (0, 1,0]Tanto temperature quanto top_p controlam a diversidade do texto. Defina apenas um deles. | |
top_k integer (Opcional) O padrão é 1.Tamanho do conjunto de candidatos para amostragem durante a geração. Por exemplo, definir isso como 50 significa que apenas os 50 principais tokens por pontuação formarão o pool de amostragem. Valores maiores aumentam a aleatoriedade; valores menores aumentam o determinismo. Se o valor for None ou maior que 100, top_k é desativado e apenas top_p tem efeito.O valor deve ser maior ou igual a 0.Parâmetro não padrão da OpenAI. SDK Python: coloque no objeto extra_body extra_body={"top_k": xxx}. SDK Node.js ou chamadas HTTP: passe como parâmetro de nível superior. | |
repetition_penalty float (Opcional) O padrão é 1,0.Penalidade para repetição em sequências consecutivas. Valores mais altos reduzem a repetição. Um valor de 1,0 não aplica penalidade. Deve ser maior que 0, sem limite superior estrito.Parâmetro não padrão da OpenAI. SDK Python: coloque no objeto extra_body extra_body={"repetition_penalty": xxx}. SDK Node.js ou chamadas HTTP: passe como parâmetro de nível superior. | |
translation_options object (Obrigatório)Parâmetros de tradução.
Propriedades source_lang string (Obrigatório)Nome completo em inglês do idioma de origem. Para mais informações, consulte Idiomas suportados. Se você definir isso como auto, o modelo detectará automaticamente o idioma de entrada.target_lang string (Obrigatório)Nome completo em inglês do idioma de destino. Para mais informações, consulte Idiomas suportados.terms arrays (Opcional)Array de termos a serem definidos ao usar o recurso de Intervenção de termos.
Propriedades source string (Obrigatório)O termo no idioma de origem.target string (Obrigatório)O termo no idioma de destino.arrays (Opcional)Array de memórias de tradução a serem definidas ao usar o recurso de Memória de tradução.
Propriedades source string (Obrigatório)A frase no idioma de origem.target string (Obrigatório)A frase no idioma de destino.string (Opcional)Prompt de domínio a ser definido ao usar o recurso de Prompt de domínio.Os prompts de domínio devem estar em inglês. extra_body={"translation_options": xxx}. SDK Node.js ou chamadas HTTP: passe como parâmetro de nível superior. |
Objeto de resposta de chat (saída não streaming) | |
id stringID exclusivo da solicitação. | |
choices arrayArray de conteúdo gerado pelo modelo.
Propriedades finish_reason stringMotivo pelo qual o modelo parou de gerar conteúdo.Valores possíveis:
integerÍndice do objeto atual no array choices.message objectMensagem de saída do modelo.
Propriedades content stringResultado da tradução.refusal stringAtualmente fixo como null.role stringA função da mensagem. Fixo como assistant.audio objectAtualmente fixo como null.function_call objectAtualmente fixo como null.tool_calls arrayAtualmente fixo como null. | |
created integerTimestamp UNIX de criação da solicitação. | |
model stringModelo usado na solicitação. | |
object stringSempre é chat.completion. | |
service_tier stringAtualmente fixo como null. | |
system_fingerprint stringAtualmente fixo como null. | |
usage objectConsumo de tokens da solicitação.
Propriedades completion_tokens integerNúmero de tokens na saída do modelo.prompt_tokens integerNúmero de tokens na entrada.total_tokens integerTotal de tokens consumidos, igual a prompt_tokens + completion_tokens.completion_tokens_details objectAtualmente fixo como null.prompt_tokens_details objectAtualmente fixo como null. |
Objeto de parte de resposta de chat (saída em streaming) | |
id stringID exclusivo da chamada. Cada objeto de parte possui o mesmo ID. | |
choices arrayUm array de conteúdo gerado pelo modelo. Se include_usage estiver definido como true, este array estará vazio na última parte.
Propriedades delta objectConteúdo de saída retornado no modo streaming.
Propriedades content stringResultado da tradução. Os modelos qwen-mt-flash e qwen-mt-lite fornecem atualizações incrementais. Já os modelos qwen-mt-plus e qwen-mt-turbo fornecem atualizações não incrementais.function_call objectAtualmente fixo como null.refusal objectAtualmente fixo como null.role stringFunção do objeto de mensagem. Possui valor apenas na primeira parte.stringO modelo para de gerar por um destes três motivos:
integerÍndice da resposta atual no array choices. | |
created integerTimestamp UNIX de criação da solicitação. Cada parte possui o mesmo timestamp. | |
model stringModelo usado na solicitação. | |
object stringSempre é chat.completion.chunk. | |
service_tier stringAtualmente fixo como null. | |
system_fingerprint stringAtualmente fixo como null. | |
usage objectTokens consumidos pela solicitação. Retornado na última parte apenas quando include_usage é true.
Propriedades completion_tokens integerNúmero de tokens na saída do modelo.prompt_tokens integerNúmero de tokens de entrada.total_tokens integerNúmero total de tokens. Corresponde à soma de prompt_tokens e completion_tokens.completion_tokens_details objectAtualmente fixo como null.prompt_tokens_details objectAtualmente fixo como null. |
DashScope
- Singapore
- Virginia
- Beijing
Endpoint HTTP:
POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/text-generation/generationDefina base_url como:- Python code
- Java code
É obrigatório criar uma chave de API e exportar a chave de API como variável de ambiente . Se utilizar o DashScope SDK, instale o DashScope SDK .
Corpo da requisição |
|
model string (Obrigatório)Nome do modelo. Suportados: qwen-mt-plus, qwen-mt-flash, qwen-mt-lite, qwen-mt-turbo. | |
messages array (Obrigatório)Array de mensagens que fornecem contexto ao modelo. Apenas mensagens de usuário são suportadas.
Tipo de mensagem Mensagem do usuário object (Obrigatório)Uma mensagem do usuário contendo a frase a ser traduzida.
Propriedades content string (Obrigatório)Frase a ser traduzida.role string (Obrigatório)Função da mensagem do usuário. Deve ser definida como user. | |
max_tokens integer (Opcional)Número máximo de tokens a gerar. Se a saída exceder esse valor, a resposta será truncada.Os valores padrão e máximo correspondem ao comprimento máximo de saída do modelo. Para mais informações, consulte Seleção de modelo.No SDK Java, o parâmetro é maxTokens. Para chamadas HTTP, coloque max_tokens no objeto parameters. | |
seed integer (Opcional)Semente de número aleatório para resultados reproduzíveis. Usar o mesmo seed e os mesmos parâmetros gera uma saída consistente.Intervalo de valores: [0, 2 31 -1].Ao fazer uma chamada HTTP, coloque seed no objeto parameters. | |
temperature float (Opcional) O padrão é 0,65.Temperatura de amostragem que controla a diversidade do texto gerado.Valores mais altos produzem texto mais diversificado. Valores mais baixos resultam em texto mais determinístico.Intervalo de valores: [0, 2)Tanto temperature quanto top_p controlam a diversidade do texto. Defina apenas um deles.Ao fazer uma chamada HTTP, coloque temperature no objeto parameters. | |
top_p float (Opcional) O padrão é 0,8.Limiar de probabilidade para amostragem de núcleo que controla a diversidade do texto gerado.Valores mais altos produzem texto mais diversificado. Valores mais baixos resultam em texto mais determinístico.Intervalo de valores: (0, 1,0]Tanto temperature quanto top_p controlam a diversidade do texto. Defina apenas um deles.No SDK Java, o parâmetro é topPparameters object. | |
repetition_penalty float (Opcional) O padrão é 1,0.Penalidade para repetição em sequências consecutivas. Valores mais altos reduzem a repetição. Um valor de 1,0 não aplica penalidade. Deve ser maior que 0, sem limite superior estrito.No SDK Java, o parâmetro é repetitionPenalty. Para chamadas HTTP, adicione repetition_penalty ao objeto parameters. | |
top_k integer (Opcional) O padrão é 1.Tamanho do conjunto de candidatos para amostragem durante a geração. Por exemplo, definir isso como 50 significa que apenas os 50 principais tokens por pontuação formam o pool de amostragem. Valores maiores aumentam a aleatoriedade; valores menores aumentam o determinismo. Se o valor for None ou maior que 100, top_k é desativado e apenas top_p tem efeito.O valor deve ser maior ou igual a 0.No SDK Java, o parâmetro é topK. Ao fazer uma chamada HTTP, defina top_k no objeto parameters. | |
stream boolean (Opcional)Ativa o modo de saída em streaming.Valores válidos:
qwen-mt-flash e qwen-mt-lite retornam dados incrementalmente (cada parte contém apenas conteúdo novo). qwen-mt-plus e qwen-mt-turbo retornam dados de forma não incremental (cada parte contém toda a sequência até o momento). Esse comportamento não pode ser alterado. Exemplo:II didnI didn'tI didn't laughI didn't laugh after... Esse parâmetro é suportado apenas pelo SDK Python. Para implementar saída em streaming com o SDK Java, chame a interface | |
translation_options object (Obrigatório)Parâmetros de tradução.
Propriedades source_lang string (Obrigatório)O nome completo em inglês do idioma de origem. Para mais informações, consulte Idiomas suportados. Se você definir isso como auto, o modelo detectará automaticamente o idioma de entrada.target_lang string (Obrigatório)O nome completo em inglês do idioma de destino. Para mais informações, consulte Idiomas suportados.terms arrays (Opcional)O array de termos a ser definido quando você usa o recurso de Intervenção de termos.
Propriedades source string (Obrigatório)O termo no idioma de origem.target string (Obrigatório)O termo no idioma de destino.arrays (Opcional)O array de memórias de tradução a ser definido quando você usa o recurso de Memória de tradução.
Propriedades source string (Obrigatório)A declaração no idioma de origem.target string (Obrigatório)A declaração no idioma de destino.string (Opcional)O prompt de domínio a ser definido quando você usa o recurso de Prompting de domínio.Os prompts de domínio devem estar em inglês.
No SDK Java, o parâmetro é |
Objeto de resposta de chat (igual para saída em streaming e não streaming) | |
status_code stringCódigo de status da requisição. 200 indica sucesso; outros valores indicam falha.O SDK Java não retorna esse parâmetro. Se a chamada falhar, uma exceção será lançada. A mensagem da exceção contém o conteúdo de status_code e message. | |
request_id stringID único da requisição.No SDK Java, o parâmetro retornado é requestId. | |
code stringCódigo de erro. Vazio em caso de sucesso.Apenas o SDK Python retorna esse parâmetro. | |
output objectResultado da chamada.
Propriedades text stringAtualmente fixado como null.finish_reason stringMotivo pelo qual o modelo parou de gerar conteúdo. Valores válidos:
arraySaída do modelo.
Propriedades finish_reason stringValores válidos:
objectMensagem de saída do modelo.
Propriedades role stringFunção da mensagem de saída. Fixada como assistant.content stringResultado da tradução.stringModelo usado nesta requisição. | |
usage objectUso de tokens para a requisição.
Propriedades input_tokens integerNúmero de tokens de entrada.output_tokens integerNúmero de tokens de saída.total_tokens integerTotal de tokens, igual a input_tokens + output_tokens. |