2026
Agosto
- Alibaba Cloud Model Studio - Aviso de alteração na cota gratuita
- Aviso de upgrade de benefícios para usuários do Plano de Token Pessoal do Alibaba Cloud Model Studio
Julho
- Aviso de redução de preço do modo Fast do GLM-5.2
- Aviso de descontinuação de modelos legados selecionados
- Cronograma estendido de descontinuação para modelos legados selecionados
Junho
- Aviso de alteração do nome do produto Model Studio
- Descontinuação de modelos snapshot legados selecionados
- Descontinuação de modelos main-branch legados selecionados
- Armazenamento criptografado de API Key e upgrade do domínio da API de inferência específica do workspace
- Upgrade de capacidade do PTU (Provisioned Throughput) do Model Studio
Maio
Abril
- Aumento de preço do serviço PTU do modelo glm-5.1
- Ajuste de preço do cache implícito do modelo DeepSeek-V4-Pro
- Desativação do modelo GTE-RERANK
- Aumento de preço para serviços de unidades de modelo selecionadas
- Desativação de modelos mainline legados selecionados
- Desativação de snapshots de modelos legados selecionados
- Pacote básico Coding Plan Lite: renovações e upgrades descontinuados
- Alterações de campos em modelos selecionados
- Alterações de campos em modelos selecionados
Março
- Lançamento do serviço em Germany (Frankfurt)
- Pacote básico Coding Plan Lite: novas compras descontinuadas
- Lançamento do serviço em Hong Kong
- Atualização do modelo Qwen3-VL-Flash
- Atualização dos modelos Qwen3-asr-flash e Qwen3-asr-flash-realtime
- Alibaba Cloud Coding Plan: oferta de primeira compra ajustada
- Redução de preços para modelos globais selecionados e lançamento do Qwen 3.5
Fevereiro
- Redução de preço do Qwen3.5-Plus e seus snapshots
- Atualização do modelo Qwen3-Max
- Atualização do modelo Qwen-VL-OCR
Janeiro
2025
Dezembro
- Atualização dos modelos Qwen3-TTS-Flash e Qwen3-TTS-Flash-Realtime
- Atualização dos modelos Qwen3-Omni-Flash e Qwen3-Omni-Flash-Realtime
- Atualização da interface de detalhes de faturamento
Novembro
- Faturamento em lote introduzido para modelos selecionados
- Atualização do modelo Qwen3-Coder-Plus
- Atualização do modelo Qwen-VL-OCR
- Atualização da série de modelos Fun-ASR
- Redução de preço do modelo Qwen3-Max
- Redução de preço para modelos open-source selecionados
Outubro
Setembro
- Atualização do modelo Qwen3-Coder-Plus
- Atualização da série de modelos Qwen-MT
- Lançamento do Savings Plan para modelos de linguagem grande
- Qwen-VL-Plus e Max: suporte a cache implícito em Singapore
- Cache explícito agora disponível para o Qwen3-Coder-Plus
- Melhorias na experiência de faturamento de inferência de modelos
- Atualização dos modelos Qwen-VL-Max e Qwen-VL-Plus
- Atualização do modelo Qwen-Plus
Agosto
- Redução de preço de cache de contexto para determinados modelos
- Upgrade da observabilidade de modelos
- Redução de preço para caches de contexto selecionados do Model Studio
- Model Studio: validade da cota gratuita para novos usuários ajustada
- Atualização do modelo Qwen-Plus-latest com introdução de preços escalonados
Julho
- Oferta por tempo limitado para o Qwen3-Coder-Plus
- Modelo gratuito Qwen2.5-Omni-7b comercializado
- Preço de saída 'thinking' reduzido em 50% para Qwen-Plus e Qwen-Turbo
- URL do console do Model Studio atualizada
- Modelo gratuito QVQ-Max comercializado
Junho
- Funcionalidade da API de modelo atualizada
- 30 de junho: atualização dos modelos Qwen-Plus/Turbo
- 30 de junho: atualização do modelo Qwen-VL-Plus
- 4 de junho: atualização do modelo Qwen-VL-Max
- 4 de junho: atualização do modelo Qwen-VL-Plus