Skip to main content
Registro de alterações

Ciclo de vida e atualizações de modelos

As tabelas a seguir listam os lançamentos de modelos . Para consultar as regras e listas de descontinuação de modelos , veja Model decommissioning policy .

  • US (Virginia)
  • China (Beijing)
  • Hong Kong (China)
  • Germany (Frankfurt)
  • Japan (Tokyo)

Tipo de modelo

Data

Escopo do service

ID do modelo

Descrição

Geração de texto, Raciocínio, Compreensão visual

02/09/2026

Global

qwen3.8-max-0902

Qwen3.8-Max-0902 (alias qwen3.8-max-2026-09-02) is an upgraded snapshot of qwen3.8-max. Coding capability breaks new ground, handling more complex engineering-scale projects and long-horizon autonomous development. Collaborative agent performance is significantly enhanced, with greater composure in multi-tool orchestration and end-to-end task delivery. Native vision understanding is refined across chart reasoning, document parsing, and multimodal perception — sharper and more reliable. Retains the 1M context window, thinking mode, and full tool ecosystem, evolving at a higher level of intelligence.

Interpretação de papéis

30/08/2026

Global

qwen-flash-character

A Série de Modelos de Role-Playing Qwen é otimizada especificamente para cenários de interação antropomórfica multilíngue. Demonstra capacidades avançadas na manutenção da consistência do personagem, progressão de diálogos cientes do contexto e engajamento empático, permitindo uma personificação personalizada e precisa. Esta versão melhora significativamente a localização linguística japonesa (incluindo dialetos e honoríficos), a autenticidade humana no role-playing, o controle de coerência narrativa e a inteligência cognitiva baseada em cenários.

Geração de texto, Pensamento profundo, Compreensão visual

26/08/2026

Global

qwen3.8-flash

O Qwen3.8-Flash é o modelo flagship leve da série Qwen3.8, com janela de contexto de 1 milhão de tokens, saída máxima de 128k e orçamento de pensamento de 256k. Suporta raciocínio profundo, Function Calling, saída estruturada, ferramentas integradas e compreensão visual nativa, alcançando o equilíbrio ideal entre desempenho e custo. Adequado para uma ampla gama de tarefas, desde geração de texto cotidiana até cenários de agentes.

Geração de vídeo

20/08/2026

Global

wan3.0-video-prime

O Wan3.0-Video-Prime é a versão de alta velocidade do modelo de geração de vídeo Wan3.0, com capacidades alinhadas à versão padrão Wan3.0-Video. Ele aceita entrada de referência completa em quatro modalidades e gera vídeos de até 30 segundos, proporcionando uma experiência audiovisual imersiva com melhoria significativa na velocidade de ponta a ponta.

Geração de texto, Raciocínio

19/08/2026

US

deepseek-v4-flash-0731-us

Modelo MoE leve e altamente eficiente, com 284 bilhões de parâmetros no total e 13 bilhões de parâmetros ativados, que suporta nativamente janelas de contexto de até um milhão de tokens. Oferece velocidade rápida de inferência, baixa latência e invocação econômica, entregando desempenho geral equilibrado. Projetado para workloads leves e de alta concorrência, é ideal para casos de uso comuns e essenciais, como diálogos cotidianos, criação de conteúdo, aplicações básicas de RAG e processamento de texto em lote.

Geração de texto, Raciocínio

14/08/2026

Global

deepseek-v4-pro-0813

Grande modelo de linguagem Mixture-of-Experts (MoE) principal, com 1,6 trilhão de parâmetros no total e 49 bilhões de parâmetros ativados. Suporta nativamente janelas de contexto de até 1 milhão de tokens. Treinado com dados extensos e de alta qualidade, o modelo apresenta forte desempenho em raciocínio matemático e lógico, raciocínio complexo, geração de código profissional e análise profunda de documentos longos. É adequado para cenários exigentes, como pesquisa científica avançada, workflows empresariais complexos e aplicações sofisticadas baseadas em agentes.

Geração de vídeo

06/08/2026

Global

wan3.0-video

O Wan3.0 é um modelo completo de geração de vídeo que suporta uniformemente múltiplas funções criativas, incluindo referência, edição, replicação e condução. Aceita entrada de referência completa em quatro modalidades, gera vídeos de até 30 segundos e consegue analisar arquivos, páginas da web e imagens complexas. Com consistência de personagens de nível de produção e áudio e visuais realistas, proporciona um impacto audiovisual imersivo.

Geração de texto, Raciocínio, Compreensão visual

02/08/2026

Global

qwen3.8-max

Modelo principal MoE com 2,4 trilhões de parâmetros, que apresenta um salto abrangente nas capacidades de codificação e produtividade, capaz de programar autonomamente por dias para entregar projetos completos. Executa centenas de tarefas profissionais, como trabalhos jurídicos, financeiros e de design, entregando resultados de nível de produção de ponta a ponta em uma única conversa. A compreensão visual nativa percorre todo o pipeline de planejamento, execução e verificação, suportando análise semântica profunda de documentos ultralongos e vídeos longos. Realiza planejamento autônomo e iteração em ciclo fechado em tarefas de longo horizonte, evoluindo continuamente.

Geração de texto, Raciocínio

01/08/2026

Global

deepseek-v4-flash-0731

Modelo MoE leve e altamente eficiente, com 284 bilhões de parâmetros no total e 13 bilhões de parâmetros ativados, que suporta nativamente janelas de contexto de até um milhão de tokens. Oferece velocidade rápida de inferência, baixa latência e invocação econômica, entregando desempenho geral equilibrado. Projetado para workloads leves e de alta concorrência, é ideal para casos de uso comuns e essenciais, como diálogos cotidianos, criação de conteúdo, aplicações básicas de RAG e processamento de texto em lote.

Geração de texto, Raciocínio, Compreensão visual

21/07/2026

Global

qwen3.7-flash

qwen3.7-flash-2026-07-15

Os modelos Flash da série nativa de visão-linguagem Qwen3.7 aprimoram de forma abrangente a compreensão multimodal e as capacidades de execução de Agentes em comparação ao 3.6-Flash. As principais melhorias incluem habilidades multimodais fundamentais fortalecidas, reconhecimento de objetos aprimorado e percepção do mundo real e inteligência espacial melhoradas. Cenários de Agentes multimodais, como Search Agent e CI Agent, receberam atualizações significativas, com execução de tarefas de ponta a ponta mais estável. As capacidades de codificação multimodal foram otimizadas, proporcionando uma experiência de vibe coding mais fluida.

Geração de texto, Raciocínio

07/07/2026

US

glm-5.2-us

O GLM-5.2 é o mais recente modelo principal da Zhipu AI, projetado para tarefas de longo horizonte com suporte a uma janela de contexto ultralonga de 1M. Apresenta capacidades poderosas de raciocínio lógico, compreensão de textos longos e geração de código, equilibrando desempenho e eficiência de inferência. Destaca-se em benchmarks multitarefa e é adequado para cenários de interação inteligente, aplicações empresariais e assistência ao desenvolvimento.

Geração de texto, Raciocínio, Compreensão visual

03/07/2026

US

qwen3.6-flash-us

A série de modelos Flash nativos de visão-linguagem Qwen3.6 oferece um aumento significativo de desempenho em relação à versão 3.5-Flash. Este modelo se destaca especialmente nas capacidades de codificação baseada em agentes, superando substancialmente seu antecessor em múltiplos benchmarks de code-agent, além de raciocínio matemático e de código. Em termos de visão, apresenta inteligência espacial notavelmente aprimorada, com melhorias especialmente relevantes na localização e detecção de objetos.

Geração de texto

02/07/2026

Global

qwen-plus-character

Modelo de interpretação de papéis da série Qwen. Trata-se de uma versão atualizada dinamicamente, e notificações serão fornecidas antecipadamente para quaisquer atualizações do modelo. É adequado para interpretação de papéis antropomórficos e possui capacidades otimizadas para seguir instruções predefinidas de personagens, conduzir conversas e demonstrar escuta ativa e empatia. Além disso, suporta a restauração profunda de personagens personalizados.

Geração de texto, Raciocínio, Compreensão visual

26/06/2026

US

qwen3.7-plus-us

Na série Qwen3.7, o modelo Plus, com excelente custo-benefício, baseia-se em suas robustas capacidades de texto e entrega uma atualização abrangente em suas habilidades de visão-linguagem, preservando sua inteligência de nível de agente full-stack para codificação, uso de ferramentas e workflows de produtividade. Seu principal diferencial são as capacidades de agente híbrido interativo multimodal, permitindo perceber cenas do mundo real, ler telas e interagir com GUIs, gerar código com base em referências visuais e realizar navegação de ponta a ponta em aplicativos móveis.

Geração de texto, Raciocínio

26/06/2026

US

qwen3.7-max-us

O modelo Max, o maior e mais capaz da série Qwen3.7, oferece atualmente uma interface exclusivamente textual para experimentação pública. O Qwen3.7 é um modelo principal de próxima geração, projetado para a era centrada em agentes, cujos pontos fortes residem na amplitude e profundidade de suas capacidades de nível de agente: destaca-se em programação, tarefas de escritório e produtividade, e execução autônoma de longo prazo.

Geração de vídeo

16/06/2026

Global

happyhorse-1.1-t2v

O HappyHorse-1.1-T2V suporta geração de texto para vídeo com compreensão semântica aprimorada, controle cinematográfico de enquadramentos e renderização dinâmica de movimentos. Captura a intenção criativa com maior precisão, produzindo vídeos de alta qualidade com movimentos mais suaves, detalhes mais ricos, consistência visual mais forte e ações de personagens, atmosfera de cena e dinâmica física mais naturais.

Geração de vídeo

16/06/2026

Global

happyhorse-1.1-r2v

O HappyHorse-1.1-R2V suporta geração de referência para vídeo com estabilidade significativamente aprimorada em sujeito, estilo de cena e consistência visual. Com suporte a até 9 imagens de referência, compreende e preserva a intenção criativa com maior precisão, oferecendo maior controlabilidade e expressividade em personagens, cenas, estilos e movimentos cinematográficos.

Geração de vídeo

16/06/2026

Global

happyhorse-1.1-i2v

O HappyHorse-1.1-I2V suporta geração de imagem para vídeo com qualidade visual, desempenho dinâmico e consistência entre clipes aprimorados. Compreende a imagem de entrada e preserva a intenção criativa com maior precisão, entregando melhorias significativas no realismo da textura da pele, consistência de ID de personagem entre clipes, suavidade de movimento, estabilidade na renderização de texto e sincronização audiovisual, produzindo vídeos de alta qualidade com maior realismo, detalhes mais ricos e consistência geral mais forte.

Geração de texto, Raciocínio

16/06/2026

Global

glm-5.2

O GLM-5.2 é o mais recente modelo principal da Zhipu AI, projetado para tarefas de longo horizonte com suporte a uma janela de contexto ultralonga de 1M. Apresenta capacidades poderosas de raciocínio lógico, compreensão de textos longos e geração de código, equilibrando desempenho e eficiência de inferência. Destaca-se em benchmarks multitarefa e é adequado para cenários de interação inteligente, aplicações empresariais e assistência ao desenvolvimento.

Geração de texto, Raciocínio, Compreensão visual

15/06/2026

Global

kimi-k2.7-code

O kimi-k2.7-code é o modelo de codificação mais inteligente da Kimi até o momento. Segue instruções de forma mais confiável em contextos longos e conclui tarefas de programação com taxas de sucesso mais altas. Suporta entradas de texto, imagem e vídeo, além de modo de pensamento, conversas e tarefas de agentes.

Geração de texto, Raciocínio, Compreensão visual

09/06/2026

Global

qwen3.7-max-2026-06-08

O modelo Max, o maior e mais capaz da série Qwen3.7, adicionou compreensão da modalidade visual em comparação ao snapshot de 20 de maio, permitindo perceber cenas do mundo real e suportar capacidades de agente híbrido interativo multimodal. Esta versão é baseada em um snapshot obtido em 8 de junho de 2026.

Geração de texto, Raciocínio, Compreensão visual

01/06/2026

Global

qwen3.7-plus

qwen3.7-plus-2026-05-26

Na série Qwen3.7, o modelo Plus, com excelente custo-benefício, baseia-se em suas robustas capacidades de texto e entrega uma atualização abrangente em suas habilidades de visão-linguagem, preservando sua inteligência de nível de agente full-stack para codificação, uso de ferramentas e workflows de produtividade. Seu principal diferencial são as capacidades de agente híbrido interativo multimodal, permitindo perceber cenas do mundo real, ler telas e interagir com GUIs, gerar código com base em referências visuais e realizar navegação de ponta a ponta em aplicativos móveis.

Geração de texto, Raciocínio

20/05/2026

Global

qwen3.7-max

qwen3.7-max-2026-05-20

O modelo Max, o maior e mais capaz da série Qwen3.7, oferece atualmente uma interface exclusivamente textual para experimentação pública. O Qwen3.7 é um modelo principal de próxima geração, projetado para a era centrada em agentes, cujos pontos fortes residem na amplitude e profundidade de suas capacidades de nível de agente: destaca-se em programação, tarefas de escritório e produtividade, e execução autônoma de longo prazo.

Geração de texto, Raciocínio

11/05/2026

US

deepseek-v4-pro-us

Grande modelo MoE principal com 1,6 trilhão de parâmetros e 49 bilhões de parâmetros ativados, que suporta nativamente comprimentos de contexto de até um milhão de tokens. Treinado em um vasto corpus de dados de alta qualidade, destaca-se em raciocínio matemático avançado, inferência lógica complexa, codificação especializada e análise profunda de textos longos, sendo adequado para aplicações exigentes, como pesquisa de ponta, workflows sofisticados de escritório e agentes de IA avançados.

Geração de texto, Raciocínio

11/05/2026

US

deepseek-v4-flash-us

Modelo MoE leve e altamente eficiente, com 284 bilhões de parâmetros no total e 13 bilhões de parâmetros ativados, que suporta nativamente janelas de contexto de até um milhão de tokens. Oferece velocidade rápida de inferência, baixa latência e invocação econômica, entregando desempenho geral equilibrado. Projetado para workloads leves e de alta concorrência, é ideal para casos de uso comuns e essenciais, como diálogos cotidianos, criação de conteúdo, aplicações básicas de RAG e processamento de texto em lote.

Geração de texto, Raciocínio, Compreensão visual

29/04/2026

Global

kimi-k2.5

O Kimi-k2.5 é o modelo mais versátil da Moonshot AI, com arquitetura multimodal nativa, suportando entradas visuais/textuais, modos de pensamento e não-pensamento, além de tarefas de diálogo e de agentes.

Geração de vídeo

26/04/2026

Global

happyhorse-1.0-video-edit

O HappyHorse-1.0-V2V suporta edição avançada de vídeo por meio de instruções em linguagem natural. Permite edição local ou global de elementos de vídeo usando até 5 imagens de referência, preservando com precisão a dinâmica original de movimento para alcançar expressividade superior.

Geração de vídeo

26/04/2026

Global

happyhorse-1.0-r2v

O HappyHorse-1.0-R2V suporta geração de referência para vídeo, oferecendo estabilidade aprimorada na referência de sujeitos e cenas. Capaz de processar até 9 imagens de referência, preserva com precisão a intenção criativa para entregar desempenho superior.

Geração de texto, Raciocínio

24/04/2026

Global

deepseek-v4-pro

Grande modelo MoE principal com 1,6 trilhão de parâmetros e 49 bilhões de parâmetros ativados, que suporta nativamente comprimentos de contexto de até um milhão de tokens. Treinado em um vasto corpus de dados de alta qualidade, destaca-se em raciocínio matemático avançado, inferência lógica complexa, codificação especializada e análise profunda de textos longos, sendo adequado para aplicações exigentes, como pesquisa de ponta, workflows sofisticados de escritório e agentes de IA avançados.

Geração de texto, Raciocínio

24/04/2026

Global

deepseek-v4-flash

Modelo MoE leve e altamente eficiente, com 284 bilhões de parâmetros no total e 13 bilhões de parâmetros ativados, que suporta nativamente janelas de contexto de até um milhão de tokens. Oferece velocidade rápida de inferência, baixa latência e invocação econômica, entregando desempenho geral equilibrado. Projetado para workloads leves e de alta concorrência, é ideal para casos de uso comuns e essenciais, como diálogos cotidianos, criação de conteúdo, aplicações básicas de RAG e processamento de texto em lote.

Geração de vídeo

22/04/2026

Global

happyhorse-1.0-t2v

O HappyHorse-1.0-T2V suporta geração de texto para vídeo, com renderização dinâmica altamente realista. Compreende com precisão a semântica do texto para produzir vídeos de alta qualidade, fluidos, naturais e ricos em detalhes.

Geração de vídeo

22/04/2026

Global

happyhorse-1.0-i2v

O HappyHorse-1.0-I2V permite geração de imagem para vídeo, com renderização dinâmica altamente realista. Compreende com precisão a semântica tanto do texto quanto da imagem para produzir vídeos de alta qualidade, fluidos, naturais e ricos em detalhes.

Geração de texto, Raciocínio, Compreensão visual

17/04/2026

Global

qwen3.6-flash

qwen3.6-flash-2026-04-16

A série de modelos Flash nativos de visão-linguagem Qwen3.6 oferece um aumento significativo de desempenho em relação à versão 3.5-Flash. Este modelo se destaca especialmente nas capacidades de codificação baseada em agentes, superando substancialmente seu antecessor em múltiplos benchmarks de code-agent, além de raciocínio matemático e de código. Em termos de visão, apresenta inteligência espacial notavelmente aprimorada, com melhorias especialmente relevantes na localização e detecção de objetos.

Geração de texto, Raciocínio, Compreensão visual

17/04/2026

Global

qwen3.6-35b-a3b

O modelo nativo de visão-linguagem Qwen3.6 35B-A3B é construído sobre uma arquitetura híbrida que integra mecanismos de atenção linear com um framework esparso de mixture-of-experts, alcançando maior eficiência de inferência. Em comparação com o 3.5-35B-A3B, este modelo demonstra capacidades de codificação baseada em agentes, habilidades de raciocínio matemático e de código, inteligência espacial, bem como desempenho de localização e detecção de objetos significativamente aprimorados.

Geração de texto, Raciocínio

14/04/2026

Global

glm-5.1

O GLM-5.1 é um modelo desenvolvido pela Zhipu AI, projetado especificamente para tarefas de longo horizonte. Possui 744 bilhões de parâmetros, suporta um contexto ultralongo de 200 mil tokens e pode gerar até 128 mil tokens em uma única resposta. O GLM-5.1 destaca-se em raciocínio lógico, compreensão de textos longos e geração de código, equilibrando desempenho e eficiência de inferência. Entrega resultados excepcionais em múltiplos benchmarks multitarefa e é adequado para aplicações como interação homem-computador inteligente, soluções empresariais e assistência ao desenvolvedor.

Geração de texto, Raciocínio, Compreensão visual

01/04/2026

Global

qwen3.6-plus

qwen3.6-plus-2026-04-02

Os modelos da série Plus nativos de visão-linguagem Qwen3.6 demonstram desempenho excepcional, equivalente aos modelos state-of-the-art atuais, com uma melhoria significativa nos resultados gerais em comparação à série 3.5. Os modelos foram notavelmente aprimorados em capacidades relacionadas a código, como codificação baseada em agentes, programação front-end e Vibe coding, além de reconhecimento geral de objetos multimodal, OCR e localização de objetos.

Geração de texto

30/03/2026

US

qwen-mt-lite-us

O Qwen-MT-Lite é um grande modelo de linguagem da série Qwen especializado em tradução multilíngue. Fornece services de tradução rápidos e de alta qualidade em 32 idiomas a um preço econômico. Oferece recursos como intervenção de terminologia, preservação de formatação e tradução específica por domínio para atender às diversas necessidades de várias aplicações, garantindo eficiência e desempenho.

Compreensão visual

14/03/2026

US

qwen3-vl-flash-2026-01-22-us

A série Qwen3 de modelos de compreensão visual de pequeno porte integra efetivamente os modos de pensamento e não-pensamento. Em comparação com o snapshot de 15 de outubro de 2025, o desempenho geral do modelo melhorou significativamente: oferece capacidades aprimoradas de reconhecimento e raciocínio visual geral, e apresenta melhorias marcantes na precisão de reconhecimento em diversos cenários de negócios, como segurança, inspeções em lojas, monitoramento de equipamentos e resolução de problemas baseada em fotos. Esta versão é um snapshot de 22 de janeiro de 2026.

Geração de texto, Raciocínio, Compreensão visual

23/02/2026

Global

qwen3.5-flash

qwen3.5-flash-2026-02-23

Os modelos Flash nativos de visão-linguagem Qwen3.5 são construídos sobre uma arquitetura híbrida que integra um mecanismo de atenção linear com um modelo esparso de mixture-of-experts, alcançando maior eficiência de inferência. Em comparação à série 3, esses modelos oferecem um salto de desempenho tanto em tarefas de texto puro quanto multimodais, proporcionando tempos de resposta rápidos enquanto equilibram velocidade de inferência e desempenho geral.

Geração de texto, Raciocínio, Compreensão visual

23/02/2026

Global

qwen3.5-35b-a3b

O Qwen3.5 Series 35B-A3B é um modelo nativo de visão-linguagem projetado com uma arquitetura híbrida que integra mecanismos de atenção linear e um modelo esparso de mixture-of-experts, alcançando maior eficiência de inferência. Seu desempenho geral é comparável ao do Qwen3.5-27B.

Geração de texto, Raciocínio, Compreensão visual

23/02/2026

Global

qwen3.5-27b

O modelo Dense nativo de visão-linguagem Qwen3.5 27B incorpora um mecanismo de atenção linear, proporcionando tempos de resposta rápidos enquanto equilibra velocidade de inferência e desempenho. Suas capacidades gerais são comparáveis às do Qwen3.5-122B-A10B.

Geração de texto, Raciocínio, Compreensão visual

23/02/2026

Global

qwen3.5-122b-a10b

O modelo nativo de visão-linguagem Qwen3.5 122B-A10B é construído sobre uma arquitetura híbrida que integra um mecanismo de atenção linear com um modelo esparso de mixture-of-experts, alcançando maior eficiência de inferência. Em termos de desempenho geral, este modelo é superado apenas pelo Qwen3.5-397B-A17B. Suas capacidades de texto superam significativamente as do Qwen3-235B-2507, e suas capacidades visuais ultrapassam as do Qwen3-VL-235B.

Geração de texto, Raciocínio, Compreensão visual

15/02/2026

Global

qwen3.5-plus

qwen3.5-plus-2026-02-15

Os modelos Plus da série nativa de visão-linguagem Qwen3.5 são construídos sobre uma arquitetura híbrida que integra mecanismos de atenção linear com modelos esparsos de mixture-of-experts, alcançando maior eficiência de inferência. Em diversas avaliações de tarefas, a série 3.5 demonstra consistentemente desempenho equivalente aos principais modelos state-of-the-art. Em comparação à série 3, esses modelos apresentam um salto tanto em capacidades de texto puro quanto multimodais.

Geração de texto, Raciocínio, Compreensão visual

15/02/2026

Global

qwen3.5-397b-a17b

O modelo nativo de visão-linguagem Qwen3.5 series 397B-A17B é construído sobre uma arquitetura híbrida que integra um mecanismo de atenção linear com um modelo esparso de mixture-of-experts, alcançando maior eficiência de inferência. Entrega desempenho state-of-the-art comparável aos modelos de ponta em uma ampla gama de tarefas, incluindo compreensão de linguagem, raciocínio lógico, geração de código, tarefas baseadas em agentes, compreensão de imagens, compreensão de vídeos e interações com interface gráfica de usuário (GUI). Com suas robustas capacidades de geração de código e de agente, o modelo exibe forte generalização em diversos agentes.

Geração de vídeo

16/12/2025

Global

wan2.6-r2v

O Wan2.6 referência para vídeo suporta o uso de uma pessoa específica ou qualquer objeto como referência, mantendo com precisão a consistência de aparência e voz, e permite referência de múltiplos personagens para atuações conjuntas.

Geração de imagem

15/12/2025

Global

wan2.6-t2i

Wan2.6 texto para imagem. Qualidade visual, estética e seguimento de instruções aprimorados proporcionam controle preciso de estilo, retratos realistas, compreensão de textos longos e ampla cobertura de IP histórico/cultural, permitindo geração visual de alta qualidade e altamente expressiva.

Geração de imagem

15/12/2025

Global

wan2.6-image

Wan2.6 Image. Um modelo completo de geração de imagens que suporta raciocínio conjunto texto-imagem, fusão criativa de múltiplas imagens, consistência de nível comercial, transferência de estilo estético e controle preciso de enquadramento e iluminação, aprimorando significativamente a consistência, a controlabilidade e a expressividade na geração de imagens.

Geração de vídeo

03/12/2025

US

wan2.6-t2v-us

Wan2.6 texto para vídeo. O agendamento inteligente de tomadas suporta narrativas com múltiplas tomadas, gerando vídeos narrativos com sujeitos, cenas e atmosfera consistentes, com duração máxima de 15 segundos. Oferece melhor seguimento de instruções e fidelidade visual aprimorada.

Geração de vídeo

03/12/2025

Global

wan2.6-t2v

Wan2.6 texto para vídeo. O agendamento inteligente de tomadas suporta narrativas com múltiplas tomadas, gerando vídeos narrativos com sujeitos, cenas e atmosfera consistentes, com duração máxima de 15 segundos. Oferece melhor seguimento de instruções e fidelidade visual aprimorada.

Geração de vídeo

03/12/2025

US

wan2.6-i2v-us

Wan2.6 imagem para vídeo. O agendamento inteligente de tomadas permite narrativas com múltiplas câmeras, oferece geração de voz de maior qualidade, suporta diálogos estáveis com múltiplos falantes com timbres vocais mais naturais e realistas, e permite a geração de clipes de até 15 segundos de duração.

Geração de vídeo

03/12/2025

Global

wan2.6-i2v

Wan2.6 imagem para vídeo. O agendamento inteligente de tomadas permite narrativas com múltiplas câmeras, oferece geração de voz de maior qualidade, suporta diálogos estáveis com múltiplos falantes com timbres vocais mais naturais e realistas, e permite a geração de clipes de até 15 segundos de duração.

Geração de texto, Raciocínio

01/12/2025

US

qwen-plus-2025-12-01-us

Esta versão é um snapshot de 1º de dezembro de 2025 e apresenta capacidades de raciocínio aprimoradas em comparação ao snapshot de 28 de julho. As capacidades de agente e de invocação de ferramentas em múltiplas turnos foram ainda mais reforçadas, e o desempenho em tarefas criativas subjetivas melhorou significativamente. Suporta comprimento de contexto de até 1 milhão de tokens, com preços escalonados com base no tamanho do contexto.

Geração de texto, Raciocínio

01/12/2025

Global

qwen-plus-2025-12-01

Esta versão é um snapshot de 1º de dezembro de 2025 e apresenta capacidades de raciocínio aprimoradas em comparação ao snapshot de 28 de julho. As capacidades de agente e de invocação de ferramentas em múltiplas turnos foram ainda mais reforçadas, e o desempenho em tarefas criativas subjetivas melhorou significativamente. Suporta comprimento de contexto de até 1 milhão de tokens, com preços escalonados com base no tamanho do contexto.

Compreensão visual

21/11/2025

Global

qwen-vl-ocr-2025-11-20

Este modelo é uma versão snapshot de 20 de novembro de 2025, baseada na mais recente arquitetura Qwen-VL3 com uma atualização abrangente. Apresenta melhorias significativas nas capacidades de análise de documentos e localização de texto, além de reduções substanciais na latência de ponta a ponta e em alucinações.

Geração de texto

19/11/2025

Global

qwen-mt-lite

O Qwen-MT-Lite é um grande modelo de linguagem da série Qwen especializado em tradução multilíngue. Fornece services de tradução rápidos e de alta qualidade em 32 idiomas a um preço econômico. Oferece recursos como intervenção de terminologia, preservação de formatação e tradução específica por domínio para atender às diversas necessidades de várias aplicações, garantindo eficiência e desempenho.

Geração de texto

11/11/2025

Global

qwen-mt-flash

O Qwen-MT-Flash, um grande modelo de linguagem da série Qwen, foi totalmente atualizado com a arquitetura Qwen 3 para desempenho e qualidade de tradução significativamente aprimorados. Fornece tradução rápida e econômica em 92 idiomas, suportando recursos avançados como intervenção de terminologia, preservação de formatação e adaptação específica por domínio. É a escolha ideal para aplicações que exigem um equilíbrio poderoso entre velocidade, qualidade e custo.

Raciocínio, Compreensão visual

21/10/2025

Global

qwen3-vl-32b-thinking

Maior modelo dense da série Qwen3-VL, sua versão de raciocínio possui capacidades de raciocínio multimodal superadas apenas pelo Qwen3-VL-235B-Thinking. Destaca-se na resolução de problemas de STEM e matemática, compreensão geral de imagens e vídeos, e alcança desempenho state-of-the-art em capacidades de agentes multimodais, sendo ideal para tarefas complexas de raciocínio multimodal.

Compreensão visual

21/10/2025

Global

qwen3-vl-32b-instruct

Maior modelo dense da série Qwen3-VL, em sua versão sem inferência, entrega desempenho geral superado apenas pelo Qwen3-VL-235B-Instruct. Destaca-se no reconhecimento e compreensão de documentos, demonstra forte consciência espacial e capacidades de identificação de objetos, e alcança desempenho state-of-the-art em detecção visual 2D e raciocínio espacial. É adequado para tarefas complexas de percepção em uma ampla variedade de cenários de uso geral.

Compreensão visual

15/10/2025

US

qwen3-vl-flash-us

qwen3-vl-flash-2025-10-15-us

A série Qwen3 de modelos de compreensão visual de pequena escala integra efetivamente os modos de pensamento e não-pensamento, entregando desempenho superior ao Qwen3-VL-30B-A3B open-source, mantendo velocidades de resposta rápidas. Apresenta uma atualização abrangente na compreensão de imagens/vídeos, suportando contextos ultralongos, como vídeos e documentos extensos, consciência espacial e reconhecimento de objetos em vários domínios. Equipado com capacidades de localização visual 2D/3D, é adequado para lidar com tarefas complexas do mundo real.

Raciocínio, Compreensão visual

15/10/2025

Global

qwen3-vl-flash

qwen3-vl-flash-2025-10-15

A série Qwen3 de modelos de compreensão visual de pequena escala integra efetivamente os modos de pensamento e não-pensamento, entregando desempenho superior ao Qwen3-VL-30B-A3B open-source, mantendo velocidades de resposta rápidas. Apresenta uma atualização abrangente na compreensão de imagens/vídeos, suportando contextos ultralongos, como vídeos e documentos extensos, consciência espacial e reconhecimento de objetos em vários domínios. Equipado com capacidades de localização visual 2D/3D, é adequado para lidar com tarefas complexas do mundo real.

Raciocínio, Compreensão visual

03/10/2025

Global

qwen3-vl-30b-a3b-thinking

A versão Thinking do segundo maior modelo MoE da série Qwen3-VL apresenta velocidades de resposta rápidas e capacidades aprimoradas de compreensão e raciocínio multimodal, agentes visuais e suporte a contextos extremamente longos, como vídeos e documentos extensos. Também possui compreensão de imagens/vídeos, consciência espacial e habilidades de reconhecimento de objetos totalmente atualizadas, sendo adequado para tarefas complexas do mundo real.

Compreensão visual

03/10/2025

Global

qwen3-vl-30b-a3b-instruct

A versão Instruct do segundo maior modelo MoE da série Qwen3-VL oferece velocidades de resposta rápidas e suporta contextos extremamente longos, como vídeos e documentos extensos. Inclui compreensão de imagens/vídeos, consciência espacial e capacidades de reconhecimento de objetos totalmente atualizadas, além de localização visual 2D/3D, permitindo lidar com desafios intricados do mundo real.

Raciocínio, Compreensão visual

30/09/2025

Global

qwen3-vl-8b-thinking

A versão Thinking do modelo Dense 8B da série Qwen3-VL consome menos memória GPU e é capaz de realizar compreensão e raciocínio multimodal. Suporta contextos extremamente longos, como vídeos e documentos extensos, localização visual 2D/3D, e apresenta capacidades de compreensão de imagens/vídeos, consciência espacial e reconhecimento de objetos totalmente atualizadas.

Compreensão visual

30/09/2025

Global

qwen3-vl-8b-instruct

A versão Instruct do modelo Dense 8B da série Qwen3-VL requer menos memória GPU e fornece compreensão de imagens/vídeos totalmente atualizada, suporte a contextos extremamente longos, como vídeos e documentos extensos, consciência espacial e capacidades de reconhecimento de objetos, sendo adequada para lidar com tarefas complexas do mundo real.

Geração de texto, Raciocínio

24/09/2025

Global

qwen3-max

qwen3-max-2025-09-23

O modelo Max da série Qwen 3 passou por atualizações especializadas em programação de agentes e invocação de ferramentas em comparação à versão preview. O modelo lançado oficialmente desta vez alcançou desempenho state-of-the-art (SOTA) em sua área e é mais adequado para atender às demandas de agentes operando em cenários mais complexos.

Compreensão visual

23/09/2025

Global

qwen3-vl-plus

qwen3-vl-plus-2025-09-23

Os modelos VL da série Qwen3 integram efetivamente os modos de pensamento e não-pensamento, alcançando desempenho líder mundial em capacidades de agentes visuais em datasets de benchmark públicos, como o OS World. Esta versão apresenta atualizações abrangentes em áreas como codificação visual, percepção espacial e raciocínio multimodal, aprimorando significativamente as habilidades de percepção e reconhecimento visual, e suportando a compreensão de vídeos ultralongos.

Raciocínio, Compreensão visual

23/09/2025

Global

qwen3-vl-235b-a22b-thinking

Os modelos VL da série Qwen3 apresentam capacidades de raciocínio multimodal significativamente aprimoradas, com foco especial na otimização do modelo para raciocínio STEM e matemático. As habilidades de percepção e reconhecimento visual foram amplamente melhoradas, e as capacidades de OCR passaram por uma grande atualização.

Compreensão visual

23/09/2025

Global

qwen3-vl-235b-a22b-instruct

Os modelos VL da série Qwen3 foram totalmente atualizados em áreas como codificação visual e percepção espacial. Suas capacidades de percepção e reconhecimento visual melhoraram significativamente, suportando a compreensão de vídeos ultralongos, e sua funcionalidade de OCR passou por um grande aprimoramento.

Geração de texto

23/09/2025

Global

qwen3-coder-plus-2025-09-23

Modelo de geração de código baseado no Qwen3 com forte poder de agente de codificação, destaca-se na chamada de ferramentas e interação com o ambiente, capaz de programação autônoma com excelente capacidade de código, mantendo a habilidade geral. Este é um snapshot de 23 de setembro de 2025. Em comparação à versão anterior (snapshot de 22 de julho), demonstra robustez aprimorada no desempenho de tarefas downstream e na invocação de ferramentas, além de maior segurança de código.

Reconhecimento de fala

16/09/2025

US

qwen3-asr-flash-us

qwen3-asr-flash-2025-09-08-us

O Qwen3-ASR-Flash é um modelo de reconhecimento de fala multilíngue altamente preciso, inteligente e robusto, baseado em um grande modelo de linguagem. Aproveitando um modelo fundamental poderoso, grandes volumes de dados textuais e multimodais, e dezenas de milhões de horas de dados de áudio, o Qwen3-ASR-Flash alcança reconhecimento de fala de alta precisão. Pode determinar automaticamente o idioma e reconhecer com precisão a fala em 11 idiomas, garantindo transcrição precisa mesmo em ambientes de áudio complexos.

Geração de texto, Raciocínio

16/09/2025

US

qwen-plus-us

O Qwen-Plus é uma versão aprimorada do modelo de linguagem ultra-grande Qwen que suporta múltiplos idiomas de entrada, como chinês e inglês. Em comparação às versões anteriores, apresenta melhorias significativas na geração de código em chinês e inglês, raciocínio lógico e habilidades multilíngues. O estilo de resposta foi amplamente ajustado para se alinhar às preferências humanas, com melhorias notáveis no nível de detalhe e clareza das respostas. Melhorias especializadas foram feitas em escrita criativa, adesão à formatação JSON e habilidades de interpretação de papéis.

Geração de texto, Raciocínio

16/09/2025

Global

qwen-plus

O Qwen-Plus é uma versão aprimorada do modelo de linguagem ultra-grande Qwen que suporta múltiplos idiomas de entrada, como chinês e inglês. Em comparação às versões anteriores, apresenta melhorias significativas na geração de código em chinês e inglês, raciocínio lógico e habilidades multilíngues. O estilo de resposta foi amplamente ajustado para se alinhar às preferências humanas, com melhorias notáveis no nível de detalhe e clareza das respostas. Melhorias especializadas foram feitas em escrita criativa, adesão à formatação JSON e habilidades de interpretação de papéis.

Geração de texto, Raciocínio

11/09/2025

Global

qwen3-next-80b-a3b-thinking

Nova geração de modelos de modo de pensamento open-source baseados no Qwen3. Esta versão oferece melhor seguimento de instruções e respostas de resumo mais diretas em relação à iteração anterior (Qwen3-235B-A22B-Thinking-2507).

Geração de texto

11/09/2025

Global

qwen3-next-80b-a3b-instruct

Nova geração de modelo open-source de modo não-pensamento impulsionado pelo Qwen3. Esta versão demonstra compreensão superior de texto em chinês, raciocínio lógico aumentado e capacidades aprimoradas em tarefas de geração de texto em relação à iteração anterior (Qwen3-235B-A22B-Instruct-2507).

Geração de texto, Raciocínio

11/09/2025

Global

qwen-plus-2025-09-11

No snapshot de 11 de setembro de 2025, esta versão apresenta seguimento de instruções aprimorado e respostas de resumo mais diretas no modo de pensamento. O modo não-pensamento fornece compreensão superior de texto em chinês e capacidades de raciocínio lógico aumentadas. O modelo suporta comprimento de contexto de 1M com preços escalonados.

Geração de texto, Raciocínio

05/09/2025

Global

qwen3-max-preview

Versão preview do modelo Max na série Qwen 3, alcançando uma integração efetiva dos modos de pensamento e não-pensamento. No modo de pensamento, há um aprimoramento significativo em capacidades como programação de agentes inteligentes, raciocínio de senso comum e raciocínio em matemática, ciências e domínios gerais.

Geração de texto, Raciocínio

01/08/2025

US

qwen-flash-us

qwen-flash-2025-07-28-us

O modelo Qwen3 Flash oferece uma fusão poderosa dos modos de pensamento e não-pensamento com alternância dinâmica durante a conversa, destacando-se em raciocínio complexo e apresentando ganhos significativos no seguimento de instruções e compreensão de texto. Suporta comprimento de contexto de 1M e é faturado em um modelo escalonado correspondente ao uso do contexto.

Geração de texto, Raciocínio

01/08/2025

Global

qwen-flash

qwen-flash-2025-07-28

O modelo Qwen3 Flash oferece uma fusão poderosa dos modos de pensamento e não-pensamento com alternância dinâmica durante a conversa, destacando-se em raciocínio complexo e apresentando ganhos significativos no seguimento de instruções e compreensão de texto. Suporta comprimento de contexto de 1M e é faturado em um modelo escalonado correspondente ao uso do contexto.

Geração de texto

31/07/2025

Global

qwen3-coder-30b-a3b-instruct

Modelo de geração de código baseado no Qwen3 que herda a capacidade de agente de codificação do Qwen3-Coder-480B-A35B-Instruct; a capacidade de código atinge SOTA na mesma escala.

Geração de texto, Raciocínio

30/07/2025

Global

qwen3-30b-a3b-thinking-2507

Modelo de pensamento Qwen3 open-source; em comparação à versão anterior (Qwen3-30B-A3B), destaca-se em tarefas complexas de pensamento, incluindo lógica, matemática, ciências, código e outros cenários desafiadores; o seguimento de instruções, a compreensão de texto e as capacidades de tradução multilíngue foram significativamente aprimorados.

Geração de texto

29/07/2025

Global

qwen3-coder-flash

qwen3-coder-flash-2025-07-28

Baseado no Qwen3, este modelo de geração de código herda as capacidades de agente de codificação do Qwen3-Coder-Plus e suporta interação de ferramentas em múltiplas turnos. Apresenta otimizações focadas na compreensão no nível de repositório e maior estabilidade na chamada de ferramentas.

Geração de texto

29/07/2025

Global

qwen3-30b-a3b-instruct-2507

Modelo não-pensamento Qwen3 open-source; em comparação à versão anterior (Qwen3-30B-A3B), apresenta grandes melhorias nas capacidades gerais em chinês, inglês e multilíngues. Otimizado para tarefas subjetivas abertas, entregando respostas significativamente mais alinhadas às preferências do usuário e mais úteis.

Geração de texto, Raciocínio

29/07/2025

Global

qwen-plus-2025-07-28

Modelo Plus da série Qwen3, integra os modos de pensamento e não-pensamento e pode alternar entre eles durante o diálogo. Em comparação à versão anterior, adiciona aprimoramentos dedicados para capacidades em chinês e inglês e chamada de ferramentas. Este é um snapshot de 28 de julho de 2025; o primeiro a suportar comprimento de contexto de 1M, utilizando preços escalonados.

Geração de texto, Raciocínio

25/07/2025

Global

qwen3-235b-a22b-thinking-2507

Modelo de pensamento Qwen3 open-source; em comparação à versão anterior (Qwen3-235B-A22B), apresenta grandes melhorias em capacidade lógica, capacidades gerais, aprimoramento de conhecimento e criatividade, adequado para cenários de alta dificuldade e pensamento forte.

Geração de texto

24/07/2025

Global

qwen-mt-plus

O Qwen-MT-Plus, o modelo de tradução principal da nossa série Qwen, foi totalmente atualizado com a arquitetura Qwen3. Suporta 92 idiomas e entrega traduções excepcionalmente precisas e naturais. Suas capacidades avançadas de compreensão contextual, controle de terminologia e preservação de formatação o tornam uma escolha superior aos modelos tradicionais, especialmente para domínios especializados.

Geração de texto

23/07/2025

Global

qwen3-coder-plus

qwen3-coder-plus-2025-07-22

Modelo de geração de código baseado no Qwen3 com forte poder de agente de codificação, destaca-se na chamada de ferramentas e interação com o ambiente, capaz de programação autônoma com excelente capacidade de código, mantendo a habilidade geral.

Geração de texto

23/07/2025

Global

qwen3-coder-480b-a35b-instruct

Modelo de geração de código baseado no Qwen3 com forte poder de agente de codificação; a capacidade de código atinge SOTA open-source.

Geração de texto

23/07/2025

Global

qwen3-235b-a22b-instruct-2507

Modelo não-pensamento Qwen3 open-source; em comparação à versão anterior (Qwen3-235B-A22B), apresenta ligeiras melhorias em criatividade subjetiva e segurança do modelo.

Compreensão visual

07/07/2025

Global

qwen-vl-ocr

O Qwen-VL_OCR é um modelo de OCR treinado com base no Qwen-VL. Agrega várias tarefas de reconhecimento, análise e processamento de imagem-texto por meio de uma abordagem de modelo unificado, oferecendo poderosas capacidades de reconhecimento de imagem-texto.

Geração de texto, Raciocínio

12/05/2025

Global

qwen3-8b

Alcança integração efetiva dos modos de pensamento e não-pensamento, permitindo alternância de modo durante as conversas. Sua capacidade de raciocínio atinge o nível SOTA na indústria de mesma escala, e sua capacidade geral supera significativamente o Qwen2.5-7B.

Geração de texto, Raciocínio

12/05/2025

Global

qwen3-32b

Alcança integração efetiva dos modos de pensamento e não-pensamento, permitindo alternância de modo durante as conversas. Sua capacidade de raciocínio supera significativamente o QwQ, e sua capacidade geral excede marcadamente o Qwen2.5-32B-Instruct, atingindo o nível SOTA na indústria de mesma escala.

Geração de texto, Raciocínio

12/05/2025

Global

qwen3-30b-a3b

Alcança integração efetiva dos modos de pensamento e não-pensamento, permitindo alternância de modo durante as conversas. Sua capacidade de raciocínio rivaliza com o QwQ-32B com um tamanho de parâmetro menor, e sua capacidade geral supera significativamente o Qwen2.5-14B, atingindo o nível SOTA na indústria de mesma escala.

Geração de texto, Raciocínio

12/05/2025

Global

qwen3-235b-a22b

Alcança integração efetiva dos modos de pensamento e não-pensamento, permitindo alternância de modo durante as conversas. Sua capacidade de raciocínio supera significativamente o QwQ, e sua capacidade geral excede marcadamente o Qwen2.5-72B-Instruct, atingindo o nível SOTA na indústria de mesma escala.

Geração de texto, Raciocínio

12/05/2025

Global

qwen3-14b

Alcança integração efetiva dos modos de pensamento e não-pensamento, permitindo alternância de modo durante as conversas. Sua capacidade de raciocínio atinge o nível SOTA na indústria de mesma escala, e sua capacidade geral supera significativamente o Qwen2.5-14B.

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento
Suporte