Skip to main content
Geração de Texto

glm-5.2

O GLM-5.2 é o modelo principal mais recente da Zhipu AI, desenvolvido para tarefas de longo horizonte com suporte a uma janela de contexto ultralonga de 1M. Oferece recursos avançados de raciocínio lógico, compreensão de textos longos e geração de código, equilibrando desempenho e eficiência de inferência. O modelo apresenta excelente desempenho em benchmarks multitarefa e é ideal para cenários de interação inteligente, aplicações empresariais e assistência ao desenvolvimento.

Provedor do service de inferência

O provedor do service de inferência para glm-5.2 é o Alibaba Cloud Model Studio.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Unsupported

Conclusão de prefixo

Unsupported

Cache de contexto

Supported

Inferência em lote

Unsupported

Ajuste fino

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

1.048.576

Comprimento máximo de saída

131.072

Janela de contexto

1.048.576

Comprimento máximo de entrada (Modo de Pensamento)

1.048.576

Comprimento máximo de saída (Modo de Pensamento)

131.072

Comprimento máximo da cadeia de pensamento

131.072

Preços

Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

1,1

Por 1M tokens

Saída

3,851

Por 1M tokens

Entrada (Cache Implícito)

0,275

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Solicitações por Minuto)

500

TPM (Tokens por Minuto)

2.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento