Skip to main content
Geração de Texto

qwen-plus

O Qwen-Plus é uma versão aprimorada do modelo de linguagem ultra-grande Qwen, com suporte a múltiplos idiomas de entrada, como chinês e inglês. Em comparação com versões anteriores, apresenta melhorias significativas na geração de código em chinês e inglês, no raciocínio lógico e nas capacidades multilíngues. O estilo de resposta foi amplamente ajustado para se alinhar às preferências humanas, com avanços notáveis no nível de detalhe e na clareza das respostas. Também foram implementadas otimizações especializadas em escrita criativa, aderência à formatação JSON e habilidades de interpretação de papéis. Esta versão do modelo é funcionalmente equivalente ao modelo snapshot qwen-plus-2025-07-28.

Provedor de serviço de inferência

O provedor de serviço de inferência para qwen-plus é o Alibaba Cloud Model Studio.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Hong Kong (China)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Supported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

997952

Comprimento máximo de saída

32768

Janela de contexto

1000000

Comprimento máximo de entrada (Modo de Pensamento)

995904

Comprimento máximo de saída (Modo de Pensamento)

32768

Comprimento máximo da Cadeia de Pensamento

81920

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

0.115

Por 1M tokens

Saída

0.287

Por 1M tokens

Entrada (Pensamento)

0.115

Por 1M tokens

Saída (Pensamento)

1.147

Por 1M tokens

Entrada (Cache Implícito)

0.023

Por 1M tokens

Entrada (Cache Implícito de Pensamento)

0.023

Por 1M tokens

Saída de Pensamento (Arquivo em Lote)

0.573

Por 1M tokens

Entrada (Arquivo em Lote)

0.057

Por 1M tokens

Saída (Arquivo em Lote)

0.143

Por 1M tokens

Entrada (Arquivo em Lote com Pensamento)

0.057

Por 1M tokens

Criação de Cache Explícito

0.144

Por 1M tokens

Leitura de Cache Explícito

0.012

Por 1M tokens

Criação de Cache Explícito (Pensamento)

0.144

Por 1M tokens

Leitura de Cache Explícito (Pensamento)

0.012

Por 1M tokens

Entrada (Chat em Lote)

0.115

Por 1M tokens

Saída (Chat em Lote)

0.287

Por 1M tokens

Entrada (Chat em Lote no Modo de Pensamento)

0.115

Por 1M tokens

Saída (Chat em Lote no Modo de Pensamento)

1.147

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0.345

Por 1M tokens

Saída

2.868

Por 1M tokens

Entrada (Pensamento)

0.345

Por 1M tokens

Saída (Pensamento)

3.441

Por 1M tokens

Entrada (Cache Implícito)

0.069

Por 1M tokens

Entrada (Cache Implícito de Pensamento)

0.069

Por 1M tokens

Saída de Pensamento (Arquivo em Lote)

1.72

Por 1M tokens

Entrada (Arquivo em Lote)

0.172

Por 1M tokens

Saída (Arquivo em Lote)

1.434

Por 1M tokens

Entrada (Arquivo em Lote com Pensamento)

0.172

Por 1M tokens

Criação de Cache Explícito

0.431

Por 1M tokens

Leitura de Cache Explícito

0.035

Por 1M tokens

Criação de Cache Explícito (Pensamento)

0.431

Por 1M tokens

Leitura de Cache Explícito (Pensamento)

0.035

Por 1M tokens

Entrada (Chat em Lote)

0.345

Por 1M tokens

Saída (Chat em Lote)

2.868

Por 1M tokens

Entrada (Chat em Lote no Modo de Pensamento)

0.345

Por 1M tokens

Saída (Chat em Lote no Modo de Pensamento)

3.441

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0.689

Por 1M tokens

Saída

6.881

Por 1M tokens

Entrada (Pensamento)

0.689

Por 1M tokens

Saída (Pensamento)

9.175

Por 1M tokens

Entrada (Cache Implícito)

0.138

Por 1M tokens

Entrada (Cache Implícito de Pensamento)

0.138

Por 1M tokens

Saída de Pensamento (Arquivo em Lote)

4.587

Por 1M tokens

Entrada (Arquivo em Lote)

0.344

Por 1M tokens

Saída (Arquivo em Lote)

3.44

Por 1M tokens

Entrada (Arquivo em Lote com Pensamento)

0.344

Por 1M tokens

Criação de Cache Explícito

0.861

Por 1M tokens

Leitura de Cache Explícito

0.069

Por 1M tokens

Criação de Cache Explícito (Pensamento)

0.861

Por 1M tokens

Leitura de Cache Explícito (Pensamento)

0.069

Por 1M tokens

Entrada (Chat em Lote)

0.689

Por 1M tokens

Saída (Chat em Lote)

6.881

Por 1M tokens

Entrada (Chat em Lote no Modo de Pensamento)

0.689

Por 1M tokens

Saída (Chat em Lote no Modo de Pensamento)

9.175

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Requisições por Minuto)

30000

TPM (Tokens por Minuto)

5,000,000

Atualizações dinâmicas

qwen-plus-latest

O modelo da série Qwen foi otimizado para oferecer desempenho equilibrado. Ele proporciona eficiência de inferência intermediária entre o Qwen-Max e o Qwen-Turbo, sendo projetado para lidar eficazmente com tarefas de complexidade moderada. Esta versão recebe atualizações dinâmicas sem aviso prévio.

Provedor do service de inferência

O provedor do service de inferência para qwen-plus-latest é o Alibaba Cloud Model Studio.

Capacidades do modelo

  • China (Beijing)
  • Singapore

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Unsupported

Inferência em lote

Supported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

995904

Comprimento máximo de saída

32768

Janela de contexto

1000000

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore

Item de faturamento

Preço (USD)

Unidade

Input

0.115

Per 1M tokens

Output

0.287

Per 1M tokens

Input(Thinking)

0.115

Per 1M tokens

Output(Thinking)

1.147

Per 1M tokens

Thinking Output(Batch File)

0.573

Per 1M tokens

Input(Batch File)

0.057

Per 1M tokens

Output(Batch File)

0.143

Per 1M tokens

Input(Thinking Batch File)

0.057

Per 1M tokens

Item de faturamento

Preço (USD)

Unidade

Input

0.345

Per 1M tokens

Output

2.868

Per 1M tokens

Input(Thinking)

0.345

Per 1M tokens

Output(Thinking)

3.441

Per 1M tokens

Thinking Output(Batch File)

1.72

Per 1M tokens

Input(Batch File)

0.172

Per 1M tokens

Output(Batch File)

1.434

Per 1M tokens

Input(Thinking Batch File)

0.172

Per 1M tokens

Item de faturamento

Preço (USD)

Unidade

Input

0.689

Per 1M tokens

Output

6.881

Per 1M tokens

Input(Thinking)

0.689

Per 1M tokens

Output(Thinking)

9.175

Per 1M tokens

Thinking Output(Batch File)

4.587

Per 1M tokens

Input(Batch File)

0.344

Per 1M tokens

Output(Batch File)

3.44

Per 1M tokens

Input(Thinking Batch File)

0.344

Per 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore

Parâmetro

Valor

RPM (Requests Per Minute)

15000

TPM (Tokens Per Minute)

1,200,000

Versões snapshot

qwen-plus-2025-12-01

Esta versão é um snapshot de 1º de dezembro de 2025 e apresenta capacidades de raciocínio aprimoradas em relação ao snapshot de 28 de julho. As funcionalidades de agente e a invocação de ferramentas em múltiplas turnos foram melhoradas, além de uma melhoria significativa no desempenho em tarefas criativas subjetivas. O modelo suporta comprimento de contexto de até 1 milhão de tokens, com preços escalonados conforme o tamanho do contexto.

Provedor do service de inferência

O provedor do service de inferência para qwen-plus-2025-12-01 é o Alibaba Cloud Model Studio.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Hong Kong (China)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

997952

Comprimento máximo de saída

32768

Janela de contexto

1000000

Comprimento máximo de entrada (Modo Thinking)

995904

Comprimento máximo de saída (Modo Thinking)

32768

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Input

0.115

Per 1M tokens

Output

0.287

Per 1M tokens

Input(Thinking)

0.115

Per 1M tokens

Output(Thinking)

1.147

Per 1M tokens

Item de faturamento

Preço (USD)

Unidade

Input

0.345

Per 1M tokens

Output

2.868

Per 1M tokens

Input(Thinking)

0.345

Per 1M tokens

Output(Thinking)

3.441

Per 1M tokens

Item de faturamento

Preço (USD)

Unidade

Input

0.689

Per 1M tokens

Output

6.881

Per 1M tokens

Input(Thinking)

0.689

Per 1M tokens

Output(Thinking)

9.175

Per 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Requests Per Minute)

120

TPM (Tokens Per Minute)

1,000,000

qwen-plus-2025-09-11

No snapshot de 11 de setembro de 2025, esta versão apresenta melhorias no seguimento de instruções e respostas de resumo mais concisas no modo de pensamento. O modo sem pensamento oferece compreensão superior de texto em chinês e capacidades aprimoradas de raciocínio lógico. O modelo suporta comprimento de contexto de 1M com preços escalonados.

Provedor de service de inferência

O provedor de service de inferência para qwen-plus-2025-09-11 é o Alibaba Cloud Model Studio.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Unsupported

Function Calling

Unsupported

Saídas estruturadas

Unsupported

Pesquisa na web

Unsupported

Conclusão de prefixo

Unsupported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

995904

Comprimento máximo de saída

32768

Janela de contexto

1000000

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Item de faturamento

Preço (USD)

Unidade

Input

0.115

Por 1M tokens

Output

0.287

Por 1M tokens

Input(Thinking)

0.115

Por 1M tokens

Output(Thinking)

1.147

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Input

0.345

Por 1M tokens

Output

2.868

Por 1M tokens

Input(Thinking)

0.345

Por 1M tokens

Output(Thinking)

3.441

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Input

0.689

Por 1M tokens

Output

6.881

Por 1M tokens

Input(Thinking)

0.689

Por 1M tokens

Output(Thinking)

9.175

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Parâmetro

Valor

RPM (Requests Per Minute)

60

TPM (Tokens Per Minute)

1,000,000

qwen-plus-2025-07-28

Modelo Plus da série Qwen3 que integra modos de pensamento e sem pensamento, permitindo alternar entre eles durante o diálogo. Em comparação à versão anterior, inclui melhorias dedicadas para capacidades em chinês e inglês, além de chamadas de ferramentas. Este snapshot de 28 de julho de 2025 é o primeiro a suportar comprimento de contexto de 1M e utiliza preços escalonados.

Provedor de service de inferência

O provedor de service de inferência para qwen-plus-2025-07-28 é o Alibaba Cloud Model Studio.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

995904

Comprimento máximo de saída

32768

Janela de contexto

1000000

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Item de faturamento

Preço (USD)

Unidade

Input

0.115

Por 1M tokens

Output

0.287

Por 1M tokens

Input(Thinking)

0.115

Por 1M tokens

Output(Thinking)

1.147

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Input

0.345

Por 1M tokens

Output

2.868

Por 1M tokens

Input(Thinking)

0.345

Por 1M tokens

Output(Thinking)

3.441

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Input

0.689

Por 1M tokens

Output

6.881

Por 1M tokens

Input(Thinking)

0.689

Por 1M tokens

Output(Thinking)

9.175

Por 1M tokens

Limites de Taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Parâmetro

Valor

RPM (Requisições Por Minuto)

60

TPM (Tokens Por Minuto)

1.000.000

qwen-plus-2025-07-14

O modelo Plus da Série Qwen3 integra eficazmente os modos de pensamento e não-pensamento, permitindo a alternância entre eles durante as conversas. Esta versão é um snapshot de 14 de julho de 2025. Em comparação à versão anterior, houve melhorias significativas nas capacidades em chinês e inglês no modo de não-pensamento, além de habilidades aprimoradas para chamada de ferramentas.

Provedor de Serviço de Inferência

O provedor de serviço de inferência para qwen-plus-2025-07-14 é o Alibaba Cloud Model Studio.

Capacidades do Modelo

  • China (Beijing)
  • Singapore

Capacidade

Suporte

Capacidade

Suporte

Modalidade de Entrada

Text

Modalidade de Saída

Text

Experiência do Modelo

Supported

Function Calling

Supported

Saídas Estruturadas

Supported

Busca na Web

Supported

Conclusão de Prefixo

Supported

Cache de Contexto

Unsupported

Inferência em Lote

Unsupported

Fine-tuning

Unsupported

Limites de Contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento Máximo de Entrada

98304

Comprimento Máximo de Saída

16384

Janela de Contexto

131072

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para conferir ofertas promocionais.
  • China (Beijing)
  • Singapore

Item de Faturamento

Preço (USD)

Unidade

Entrada

0,115

Por 1M tokens

Saída

0,287

Por 1M tokens

Entrada (Pensamento)

0,115

Por 1M tokens

Saída (Pensamento)

1,147

Por 1M tokens

Limites de Taxa

  • China (Beijing)
  • Singapore

Parâmetro

Valor

RPM (Requisições Por Minuto)

60

TPM (Tokens Por Minuto)

100.000

qwen-plus-2025-04-28

O modelo Plus da série Qwen3 integra eficazmente os modos de pensamento e não-pensamento, permitindo alternar entre eles durante as conversas. Suas capacidades de raciocínio superam significativamente as do QwQ, e suas capacidades gerais excedem notavelmente as do Qwen2.5-Plus, atingindo o nível SOTA na mesma escala dentro da indústria. Este modelo corresponde ao snapshot de 28 de abril de 2025.

Provedor de Serviço de Inferência

O provedor de serviço de inferência para qwen-plus-2025-04-28 é o Alibaba Cloud Model Studio.

Capacidades do Modelo

  • China (Beijing)
  • Singapore

Capacidade

Suporte

Capacidade

Suporte

Modalidade de Entrada

Text

Modalidade de Saída

Text

Experiência do Modelo

Supported

Function Calling

Supported

Saídas Estruturadas

Supported

Busca na Web

Unsupported

Conclusão de Prefixo

Supported

Cache de Contexto

Unsupported

Inferência em Lote

Unsupported

Fine-tuning

Unsupported

Limites de Contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento Máximo de Entrada

98304

Comprimento Máximo de Saída

16384

Janela de Contexto

131072

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para conferir ofertas promocionais.
  • China (Beijing)
  • Singapore

Item de Faturamento

Preço (USD)

Unidade

Entrada

0,115

Por 1M tokens

Saída

0,287

Por 1M tokens

Entrada (Pensamento)

0,115

Por 1M tokens

Saída (Pensamento)

1,147

Por 1M tokens

Limites de Taxa

  • China (Beijing)
  • Singapore

Parâmetro

Valor

RPM (Requisições Por Minuto)

60

TPM (Tokens Por Minuto)

1.000.000

qwen-plus-2025-01-25

Os modelos da série Qwen apresentam capacidades equilibradas, oferecendo desempenho e velocidade de raciocínio intermediários entre o Qwen-Max e o Qwen-Turbo, sendo adequados para tarefas de complexidade moderada. Em relação às versões anteriores, há melhorias significativas na geração de código em chinês e inglês, no raciocínio lógico e nas habilidades multilíngues. O estilo de resposta foi amplamente ajustado para alinhar-se às preferências humanas, com aprimoramentos notáveis no nível de detalhe e na clareza das respostas. Também foram implementadas melhorias especializadas em escrita criativa, adesão à formatação JSON e capacidades de interpretação de papéis.

Provedor de Serviço de Inferência

O provedor de serviço de inferência para qwen-plus-2025-01-25 é o Alibaba Cloud Model Studio.

Capacidades do Modelo

  • China (Beijing)
  • Singapore

Capacidade

Suporte

Capacidade

Suporte

Modalidade de Entrada

Text

Modalidade de Saída

Text

Experiência do Modelo

Supported

Function Calling

Supported

Saídas Estruturadas

Supported

Busca na Web

Unsupported

Conclusão de Prefixo

Supported

Cache de Contexto

Unsupported

Inferência em Lote

Unsupported

Fine-tuning

Unsupported

Limites de Contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento Máximo de Entrada

129024

Comprimento Máximo de Saída

8192

Janela de Contexto

131072

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para conferir ofertas promocionais.
  • China (Beijing)
  • Singapore

Item de Faturamento

Preço (USD)

Unidade

Entrada

0,115

Por 1M tokens

Saída

0,287

Por 1M tokens

Limites de Taxa

  • China (Beijing)
  • Singapore

Parâmetro

Valor

RPM (Requisições Por Minuto)

60

TPM (Tokens Por Minuto)

150.000

qwen-plus-0112

, -Max-Turbo, .-Plus-2024-1220, , , , codeswtich, .

Provedor de Serviço de Inferência

O provedor de serviço de inferência para qwen-plus-0112 é o Alibaba Cloud Model Studio.

Capacidades do Modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de Entrada

Text

Modalidade de Saída

Text

Experiência do Modelo

Supported

Function Calling

Unsupported

Saídas Estruturadas

Unsupported

Busca na Web

Unsupported

Conclusão de Prefixo

Unsupported

Cache de Contexto

Unsupported

Inferência em Lote

Unsupported

Fine-tuning

Unsupported

Limites de Contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento Máximo de Entrada

129024

Comprimento Máximo de Saída

8192

Janela de Contexto

131072

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para conferir ofertas promocionais.
  • China (Beijing)

Item de Faturamento

Preço (USD)

Unidade

Entrada

0,115

Por 1M tokens

Saída

0,287

Por 1M tokens

Limites de Taxa

  • China (Beijing)

Parâmetro

Valor

RPM (Requisições Por Minuto)

60

TPM (Tokens Por Minuto)

150.000

qwen-plus-1220

, -Max-Turbo, .-Plus-1125, , , , codeswtich, .

Provedor de Serviço de Inferência

O provedor de serviço de inferência para qwen-plus-1220 é o Alibaba Cloud Model Studio.

Capacidades do Modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de Entrada

Text

Modalidade de Saída

Text

Experiência do Modelo

Supported

Function Calling

Unsupported

Saídas Estruturadas

Unsupported

Busca na Web

Unsupported

Conclusão de Prefixo

Unsupported

Cache de Contexto

Unsupported

Inferência em Lote

Unsupported

Fine-tuning

Unsupported

Limites de Contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento Máximo de Entrada

129024

Comprimento Máximo de Saída

8192

Janela de Contexto

131072

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para conferir ofertas promocionais.
  • China (Beijing)

Item de Faturamento

Preço (USD)

Unidade

Entrada

0,115

Por 1M tokens

Saída

0,287

Por 1M tokens

Limites de Taxa

  • China (Beijing)

Parâmetro

Valor

RPM (Requisições Por Minuto)

60

TPM (Tokens Por Minuto)

150.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento