Fornecido diretamente pela Zhipu AI, este é o mais recente modelo principal da empresa. O GLM-5.3 é o modelo open-source mais avançado já lançado pela Zhipu AI. Ele oferece suporte a um contexto de 1M tokens verdadeiramente utilizável e mantém a liderança em tarefas de longo horizonte.
Provedor de service de Inferência
O provedor de service de inferência para ZHIPU/GLM-5.3 é Z.AI.
Capacidades do Modelo
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de Entrada | Text | Modalidade de Saída | Text |
Experiência do Modelo | Unsupported | Function Calling | Supported |
Saídas Estruturadas | Supported | Busca na Web | Unsupported |
Conclusão de Prefixo | Supported | Cache de Contexto | Supported |
Inferência em Lote | Unsupported | Fine-tuning | Unsupported |
Limites de Contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento Máximo de Entrada | 1.048.576 | Comprimento Máximo de Saída | 131.072 |
Janela de Contexto | 1.048.576 | Comprimento Máximo de Entrada (Modo de Pensamento) | 1.048.576 |
Comprimento Máximo de Saída (Modo de Pensamento) | 131.072 | Comprimento Máximo da Cadeia de Pensamento | 131.072 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
- Singapore
Item de Faturamento | Preço (USD) | Unidade |
Entrada | 1,4 | Por 1M tokens |
Saída | 4,4 | Por 1M tokens |
Entrada (Cache Implícito) | 0,26 | Por 1M tokens |
Limites de Taxa
- Singapore
Parâmetro | Valor |
RPM (Requisições Por Minuto) | 200 |
TPM (Tokens Por Minuto) | 3.000.000 |