As tabelas a seguir listam os lançamentos de modelos . Para consultar as regras e listas de descontinuação de modelos , veja Model decommissioning policy .
- US (Virginia)
- China (Beijing)
- Hong Kong (China)
- Germany (Frankfurt)
- Japan (Tokyo)
Tipo de modelo | Data | Escopo do service | ID do modelo | Descrição |
|---|---|---|---|---|
Geração de texto, Raciocínio, Compreensão visual | 02/09/2026 | Global |
| Qwen3.8-Max-0902 (alias qwen3.8-max-2026-09-02) is an upgraded snapshot of qwen3.8-max. Coding capability breaks new ground, handling more complex engineering-scale projects and long-horizon autonomous development. Collaborative agent performance is significantly enhanced, with greater composure in multi-tool orchestration and end-to-end task delivery. Native vision understanding is refined across chart reasoning, document parsing, and multimodal perception — sharper and more reliable. Retains the 1M context window, thinking mode, and full tool ecosystem, evolving at a higher level of intelligence. |
Interpretação de papéis | 30/08/2026 | Global |
| A Série de Modelos de Role-Playing Qwen é otimizada especificamente para cenários de interação antropomórfica multilíngue. Demonstra capacidades avançadas na manutenção da consistência do personagem, progressão de diálogos cientes do contexto e engajamento empático, permitindo uma personificação personalizada e precisa. Esta versão melhora significativamente a localização linguística japonesa (incluindo dialetos e honoríficos), a autenticidade humana no role-playing, o controle de coerência narrativa e a inteligência cognitiva baseada em cenários. |
Geração de texto, Pensamento profundo, Compreensão visual | 26/08/2026 | Global |
| O Qwen3.8-Flash é o modelo flagship leve da série Qwen3.8, com janela de contexto de 1 milhão de tokens, saída máxima de 128k e orçamento de pensamento de 256k. Suporta raciocínio profundo, Function Calling, saída estruturada, ferramentas integradas e compreensão visual nativa, alcançando o equilíbrio ideal entre desempenho e custo. Adequado para uma ampla gama de tarefas, desde geração de texto cotidiana até cenários de agentes. |
Geração de vídeo | 20/08/2026 | Global |
| O Wan3.0-Video-Prime é a versão de alta velocidade do modelo de geração de vídeo Wan3.0, com capacidades alinhadas à versão padrão Wan3.0-Video. Ele aceita entrada de referência completa em quatro modalidades e gera vídeos de até 30 segundos, proporcionando uma experiência audiovisual imersiva com melhoria significativa na velocidade de ponta a ponta. |
Geração de texto, Raciocínio | 19/08/2026 | US |
| Modelo MoE leve e altamente eficiente, com 284 bilhões de parâmetros no total e 13 bilhões de parâmetros ativados, que suporta nativamente janelas de contexto de até um milhão de tokens. Oferece velocidade rápida de inferência, baixa latência e invocação econômica, entregando desempenho geral equilibrado. Projetado para workloads leves e de alta concorrência, é ideal para casos de uso comuns e essenciais, como diálogos cotidianos, criação de conteúdo, aplicações básicas de RAG e processamento de texto em lote. |
Geração de texto, Raciocínio | 14/08/2026 | Global |
| Grande modelo de linguagem Mixture-of-Experts (MoE) principal, com 1,6 trilhão de parâmetros no total e 49 bilhões de parâmetros ativados. Suporta nativamente janelas de contexto de até 1 milhão de tokens. Treinado com dados extensos e de alta qualidade, o modelo apresenta forte desempenho em raciocínio matemático e lógico, raciocínio complexo, geração de código profissional e análise profunda de documentos longos. É adequado para cenários exigentes, como pesquisa científica avançada, workflows empresariais complexos e aplicações sofisticadas baseadas em agentes. |
Geração de vídeo | 06/08/2026 | Global |
| O Wan3.0 é um modelo completo de geração de vídeo que suporta uniformemente múltiplas funções criativas, incluindo referência, edição, replicação e condução. Aceita entrada de referência completa em quatro modalidades, gera vídeos de até 30 segundos e consegue analisar arquivos, páginas da web e imagens complexas. Com consistência de personagens de nível de produção e áudio e visuais realistas, proporciona um impacto audiovisual imersivo. |
Geração de texto, Raciocínio, Compreensão visual | 02/08/2026 | Global |
| Modelo principal MoE com 2,4 trilhões de parâmetros, que apresenta um salto abrangente nas capacidades de codificação e produtividade, capaz de programar autonomamente por dias para entregar projetos completos. Executa centenas de tarefas profissionais, como trabalhos jurídicos, financeiros e de design, entregando resultados de nível de produção de ponta a ponta em uma única conversa. A compreensão visual nativa percorre todo o pipeline de planejamento, execução e verificação, suportando análise semântica profunda de documentos ultralongos e vídeos longos. Realiza planejamento autônomo e iteração em ciclo fechado em tarefas de longo horizonte, evoluindo continuamente. |
Geração de texto, Raciocínio | 01/08/2026 | Global |
| Modelo MoE leve e altamente eficiente, com 284 bilhões de parâmetros no total e 13 bilhões de parâmetros ativados, que suporta nativamente janelas de contexto de até um milhão de tokens. Oferece velocidade rápida de inferência, baixa latência e invocação econômica, entregando desempenho geral equilibrado. Projetado para workloads leves e de alta concorrência, é ideal para casos de uso comuns e essenciais, como diálogos cotidianos, criação de conteúdo, aplicações básicas de RAG e processamento de texto em lote. |
Geração de texto, Raciocínio, Compreensão visual | 21/07/2026 | Global |
| Os modelos Flash da série nativa de visão-linguagem Qwen3.7 aprimoram de forma abrangente a compreensão multimodal e as capacidades de execução de Agentes em comparação ao 3.6-Flash. As principais melhorias incluem habilidades multimodais fundamentais fortalecidas, reconhecimento de objetos aprimorado e percepção do mundo real e inteligência espacial melhoradas. Cenários de Agentes multimodais, como Search Agent e CI Agent, receberam atualizações significativas, com execução de tarefas de ponta a ponta mais estável. As capacidades de codificação multimodal foram otimizadas, proporcionando uma experiência de vibe coding mais fluida. |
Geração de texto, Raciocínio | 07/07/2026 | US |
| O GLM-5.2 é o mais recente modelo principal da Zhipu AI, projetado para tarefas de longo horizonte com suporte a uma janela de contexto ultralonga de 1M. Apresenta capacidades poderosas de raciocínio lógico, compreensão de textos longos e geração de código, equilibrando desempenho e eficiência de inferência. Destaca-se em benchmarks multitarefa e é adequado para cenários de interação inteligente, aplicações empresariais e assistência ao desenvolvimento. |
Geração de texto, Raciocínio, Compreensão visual | 03/07/2026 | US |
| A série de modelos Flash nativos de visão-linguagem Qwen3.6 oferece um aumento significativo de desempenho em relação à versão 3.5-Flash. Este modelo se destaca especialmente nas capacidades de codificação baseada em agentes, superando substancialmente seu antecessor em múltiplos benchmarks de code-agent, além de raciocínio matemático e de código. Em termos de visão, apresenta inteligência espacial notavelmente aprimorada, com melhorias especialmente relevantes na localização e detecção de objetos. |
Geração de texto | 02/07/2026 | Global |
| Modelo de interpretação de papéis da série Qwen. Trata-se de uma versão atualizada dinamicamente, e notificações serão fornecidas antecipadamente para quaisquer atualizações do modelo. É adequado para interpretação de papéis antropomórficos e possui capacidades otimizadas para seguir instruções predefinidas de personagens, conduzir conversas e demonstrar escuta ativa e empatia. Além disso, suporta a restauração profunda de personagens personalizados. |
Geração de texto, Raciocínio, Compreensão visual | 26/06/2026 | US |
| Na série Qwen3.7, o modelo Plus, com excelente custo-benefício, baseia-se em suas robustas capacidades de texto e entrega uma atualização abrangente em suas habilidades de visão-linguagem, preservando sua inteligência de nível de agente full-stack para codificação, uso de ferramentas e workflows de produtividade. Seu principal diferencial são as capacidades de agente híbrido interativo multimodal, permitindo perceber cenas do mundo real, ler telas e interagir com GUIs, gerar código com base em referências visuais e realizar navegação de ponta a ponta em aplicativos móveis. |
Geração de texto, Raciocínio | 26/06/2026 | US |
| O modelo Max, o maior e mais capaz da série Qwen3.7, oferece atualmente uma interface exclusivamente textual para experimentação pública. O Qwen3.7 é um modelo principal de próxima geração, projetado para a era centrada em agentes, cujos pontos fortes residem na amplitude e profundidade de suas capacidades de nível de agente: destaca-se em programação, tarefas de escritório e produtividade, e execução autônoma de longo prazo. |
Geração de vídeo | 16/06/2026 | Global |
| O HappyHorse-1.1-T2V suporta geração de texto para vídeo com compreensão semântica aprimorada, controle cinematográfico de enquadramentos e renderização dinâmica de movimentos. Captura a intenção criativa com maior precisão, produzindo vídeos de alta qualidade com movimentos mais suaves, detalhes mais ricos, consistência visual mais forte e ações de personagens, atmosfera de cena e dinâmica física mais naturais. |
Geração de vídeo | 16/06/2026 | Global |
| O HappyHorse-1.1-R2V suporta geração de referência para vídeo com estabilidade significativamente aprimorada em sujeito, estilo de cena e consistência visual. Com suporte a até 9 imagens de referência, compreende e preserva a intenção criativa com maior precisão, oferecendo maior controlabilidade e expressividade em personagens, cenas, estilos e movimentos cinematográficos. |
Geração de vídeo | 16/06/2026 | Global |
| O HappyHorse-1.1-I2V suporta geração de imagem para vídeo com qualidade visual, desempenho dinâmico e consistência entre clipes aprimorados. Compreende a imagem de entrada e preserva a intenção criativa com maior precisão, entregando melhorias significativas no realismo da textura da pele, consistência de ID de personagem entre clipes, suavidade de movimento, estabilidade na renderização de texto e sincronização audiovisual, produzindo vídeos de alta qualidade com maior realismo, detalhes mais ricos e consistência geral mais forte. |
Geração de texto, Raciocínio | 16/06/2026 | Global |
| O GLM-5.2 é o mais recente modelo principal da Zhipu AI, projetado para tarefas de longo horizonte com suporte a uma janela de contexto ultralonga de 1M. Apresenta capacidades poderosas de raciocínio lógico, compreensão de textos longos e geração de código, equilibrando desempenho e eficiência de inferência. Destaca-se em benchmarks multitarefa e é adequado para cenários de interação inteligente, aplicações empresariais e assistência ao desenvolvimento. |
Geração de texto, Raciocínio, Compreensão visual | 15/06/2026 | Global |
| O kimi-k2.7-code é o modelo de codificação mais inteligente da Kimi até o momento. Segue instruções de forma mais confiável em contextos longos e conclui tarefas de programação com taxas de sucesso mais altas. Suporta entradas de texto, imagem e vídeo, além de modo de pensamento, conversas e tarefas de agentes. |
Geração de texto, Raciocínio, Compreensão visual | 09/06/2026 | Global |
| O modelo Max, o maior e mais capaz da série Qwen3.7, adicionou compreensão da modalidade visual em comparação ao snapshot de 20 de maio, permitindo perceber cenas do mundo real e suportar capacidades de agente híbrido interativo multimodal. Esta versão é baseada em um snapshot obtido em 8 de junho de 2026. |
Geração de texto, Raciocínio, Compreensão visual | 01/06/2026 | Global |
| Na série Qwen3.7, o modelo Plus, com excelente custo-benefício, baseia-se em suas robustas capacidades de texto e entrega uma atualização abrangente em suas habilidades de visão-linguagem, preservando sua inteligência de nível de agente full-stack para codificação, uso de ferramentas e workflows de produtividade. Seu principal diferencial são as capacidades de agente híbrido interativo multimodal, permitindo perceber cenas do mundo real, ler telas e interagir com GUIs, gerar código com base em referências visuais e realizar navegação de ponta a ponta em aplicativos móveis. |
Geração de texto, Raciocínio | 20/05/2026 | Global |
| O modelo Max, o maior e mais capaz da série Qwen3.7, oferece atualmente uma interface exclusivamente textual para experimentação pública. O Qwen3.7 é um modelo principal de próxima geração, projetado para a era centrada em agentes, cujos pontos fortes residem na amplitude e profundidade de suas capacidades de nível de agente: destaca-se em programação, tarefas de escritório e produtividade, e execução autônoma de longo prazo. |
Geração de texto, Raciocínio | 11/05/2026 | US |
| Grande modelo MoE principal com 1,6 trilhão de parâmetros e 49 bilhões de parâmetros ativados, que suporta nativamente comprimentos de contexto de até um milhão de tokens. Treinado em um vasto corpus de dados de alta qualidade, destaca-se em raciocínio matemático avançado, inferência lógica complexa, codificação especializada e análise profunda de textos longos, sendo adequado para aplicações exigentes, como pesquisa de ponta, workflows sofisticados de escritório e agentes de IA avançados. |
Geração de texto, Raciocínio | 11/05/2026 | US |
| Modelo MoE leve e altamente eficiente, com 284 bilhões de parâmetros no total e 13 bilhões de parâmetros ativados, que suporta nativamente janelas de contexto de até um milhão de tokens. Oferece velocidade rápida de inferência, baixa latência e invocação econômica, entregando desempenho geral equilibrado. Projetado para workloads leves e de alta concorrência, é ideal para casos de uso comuns e essenciais, como diálogos cotidianos, criação de conteúdo, aplicações básicas de RAG e processamento de texto em lote. |
Geração de texto, Raciocínio, Compreensão visual | 29/04/2026 | Global |
| O Kimi-k2.5 é o modelo mais versátil da Moonshot AI, com arquitetura multimodal nativa, suportando entradas visuais/textuais, modos de pensamento e não-pensamento, além de tarefas de diálogo e de agentes. |
Geração de vídeo | 26/04/2026 | Global |
| O HappyHorse-1.0-V2V suporta edição avançada de vídeo por meio de instruções em linguagem natural. Permite edição local ou global de elementos de vídeo usando até 5 imagens de referência, preservando com precisão a dinâmica original de movimento para alcançar expressividade superior. |
Geração de vídeo | 26/04/2026 | Global |
| O HappyHorse-1.0-R2V suporta geração de referência para vídeo, oferecendo estabilidade aprimorada na referência de sujeitos e cenas. Capaz de processar até 9 imagens de referência, preserva com precisão a intenção criativa para entregar desempenho superior. |
Geração de texto, Raciocínio | 24/04/2026 | Global |
| Grande modelo MoE principal com 1,6 trilhão de parâmetros e 49 bilhões de parâmetros ativados, que suporta nativamente comprimentos de contexto de até um milhão de tokens. Treinado em um vasto corpus de dados de alta qualidade, destaca-se em raciocínio matemático avançado, inferência lógica complexa, codificação especializada e análise profunda de textos longos, sendo adequado para aplicações exigentes, como pesquisa de ponta, workflows sofisticados de escritório e agentes de IA avançados. |
Geração de texto, Raciocínio | 24/04/2026 | Global |
| Modelo MoE leve e altamente eficiente, com 284 bilhões de parâmetros no total e 13 bilhões de parâmetros ativados, que suporta nativamente janelas de contexto de até um milhão de tokens. Oferece velocidade rápida de inferência, baixa latência e invocação econômica, entregando desempenho geral equilibrado. Projetado para workloads leves e de alta concorrência, é ideal para casos de uso comuns e essenciais, como diálogos cotidianos, criação de conteúdo, aplicações básicas de RAG e processamento de texto em lote. |
Geração de vídeo | 22/04/2026 | Global |
| O HappyHorse-1.0-T2V suporta geração de texto para vídeo, com renderização dinâmica altamente realista. Compreende com precisão a semântica do texto para produzir vídeos de alta qualidade, fluidos, naturais e ricos em detalhes. |
Geração de vídeo | 22/04/2026 | Global |
| O HappyHorse-1.0-I2V permite geração de imagem para vídeo, com renderização dinâmica altamente realista. Compreende com precisão a semântica tanto do texto quanto da imagem para produzir vídeos de alta qualidade, fluidos, naturais e ricos em detalhes. |
Geração de texto, Raciocínio, Compreensão visual | 17/04/2026 | Global |
| A série de modelos Flash nativos de visão-linguagem Qwen3.6 oferece um aumento significativo de desempenho em relação à versão 3.5-Flash. Este modelo se destaca especialmente nas capacidades de codificação baseada em agentes, superando substancialmente seu antecessor em múltiplos benchmarks de code-agent, além de raciocínio matemático e de código. Em termos de visão, apresenta inteligência espacial notavelmente aprimorada, com melhorias especialmente relevantes na localização e detecção de objetos. |
Geração de texto, Raciocínio, Compreensão visual | 17/04/2026 | Global |
| O modelo nativo de visão-linguagem Qwen3.6 35B-A3B é construído sobre uma arquitetura híbrida que integra mecanismos de atenção linear com um framework esparso de mixture-of-experts, alcançando maior eficiência de inferência. Em comparação com o 3.5-35B-A3B, este modelo demonstra capacidades de codificação baseada em agentes, habilidades de raciocínio matemático e de código, inteligência espacial, bem como desempenho de localização e detecção de objetos significativamente aprimorados. |
Geração de texto, Raciocínio | 14/04/2026 | Global |
| O GLM-5.1 é um modelo desenvolvido pela Zhipu AI, projetado especificamente para tarefas de longo horizonte. Possui 744 bilhões de parâmetros, suporta um contexto ultralongo de 200 mil tokens e pode gerar até 128 mil tokens em uma única resposta. O GLM-5.1 destaca-se em raciocínio lógico, compreensão de textos longos e geração de código, equilibrando desempenho e eficiência de inferência. Entrega resultados excepcionais em múltiplos benchmarks multitarefa e é adequado para aplicações como interação homem-computador inteligente, soluções empresariais e assistência ao desenvolvedor. |
Geração de texto, Raciocínio, Compreensão visual | 01/04/2026 | Global |
| Os modelos da série Plus nativos de visão-linguagem Qwen3.6 demonstram desempenho excepcional, equivalente aos modelos state-of-the-art atuais, com uma melhoria significativa nos resultados gerais em comparação à série 3.5. Os modelos foram notavelmente aprimorados em capacidades relacionadas a código, como codificação baseada em agentes, programação front-end e Vibe coding, além de reconhecimento geral de objetos multimodal, OCR e localização de objetos. |
Geração de texto | 30/03/2026 | US |
| O Qwen-MT-Lite é um grande modelo de linguagem da série Qwen especializado em tradução multilíngue. Fornece services de tradução rápidos e de alta qualidade em 32 idiomas a um preço econômico. Oferece recursos como intervenção de terminologia, preservação de formatação e tradução específica por domínio para atender às diversas necessidades de várias aplicações, garantindo eficiência e desempenho. |
Compreensão visual | 14/03/2026 | US |
| A série Qwen3 de modelos de compreensão visual de pequeno porte integra efetivamente os modos de pensamento e não-pensamento. Em comparação com o snapshot de 15 de outubro de 2025, o desempenho geral do modelo melhorou significativamente: oferece capacidades aprimoradas de reconhecimento e raciocínio visual geral, e apresenta melhorias marcantes na precisão de reconhecimento em diversos cenários de negócios, como segurança, inspeções em lojas, monitoramento de equipamentos e resolução de problemas baseada em fotos. Esta versão é um snapshot de 22 de janeiro de 2026. |
Geração de texto, Raciocínio, Compreensão visual | 23/02/2026 | Global |
| Os modelos Flash nativos de visão-linguagem Qwen3.5 são construídos sobre uma arquitetura híbrida que integra um mecanismo de atenção linear com um modelo esparso de mixture-of-experts, alcançando maior eficiência de inferência. Em comparação à série 3, esses modelos oferecem um salto de desempenho tanto em tarefas de texto puro quanto multimodais, proporcionando tempos de resposta rápidos enquanto equilibram velocidade de inferência e desempenho geral. |
Geração de texto, Raciocínio, Compreensão visual | 23/02/2026 | Global |
| O Qwen3.5 Series 35B-A3B é um modelo nativo de visão-linguagem projetado com uma arquitetura híbrida que integra mecanismos de atenção linear e um modelo esparso de mixture-of-experts, alcançando maior eficiência de inferência. Seu desempenho geral é comparável ao do Qwen3.5-27B. |
Geração de texto, Raciocínio, Compreensão visual | 23/02/2026 | Global |
| O modelo Dense nativo de visão-linguagem Qwen3.5 27B incorpora um mecanismo de atenção linear, proporcionando tempos de resposta rápidos enquanto equilibra velocidade de inferência e desempenho. Suas capacidades gerais são comparáveis às do Qwen3.5-122B-A10B. |
Geração de texto, Raciocínio, Compreensão visual | 23/02/2026 | Global |
| O modelo nativo de visão-linguagem Qwen3.5 122B-A10B é construído sobre uma arquitetura híbrida que integra um mecanismo de atenção linear com um modelo esparso de mixture-of-experts, alcançando maior eficiência de inferência. Em termos de desempenho geral, este modelo é superado apenas pelo Qwen3.5-397B-A17B. Suas capacidades de texto superam significativamente as do Qwen3-235B-2507, e suas capacidades visuais ultrapassam as do Qwen3-VL-235B. |
Geração de texto, Raciocínio, Compreensão visual | 15/02/2026 | Global |
| Os modelos Plus da série nativa de visão-linguagem Qwen3.5 são construídos sobre uma arquitetura híbrida que integra mecanismos de atenção linear com modelos esparsos de mixture-of-experts, alcançando maior eficiência de inferência. Em diversas avaliações de tarefas, a série 3.5 demonstra consistentemente desempenho equivalente aos principais modelos state-of-the-art. Em comparação à série 3, esses modelos apresentam um salto tanto em capacidades de texto puro quanto multimodais. |
Geração de texto, Raciocínio, Compreensão visual | 15/02/2026 | Global |
| O modelo nativo de visão-linguagem Qwen3.5 series 397B-A17B é construído sobre uma arquitetura híbrida que integra um mecanismo de atenção linear com um modelo esparso de mixture-of-experts, alcançando maior eficiência de inferência. Entrega desempenho state-of-the-art comparável aos modelos de ponta em uma ampla gama de tarefas, incluindo compreensão de linguagem, raciocínio lógico, geração de código, tarefas baseadas em agentes, compreensão de imagens, compreensão de vídeos e interações com interface gráfica de usuário (GUI). Com suas robustas capacidades de geração de código e de agente, o modelo exibe forte generalização em diversos agentes. |
Geração de vídeo | 16/12/2025 | Global |
| O Wan2.6 referência para vídeo suporta o uso de uma pessoa específica ou qualquer objeto como referência, mantendo com precisão a consistência de aparência e voz, e permite referência de múltiplos personagens para atuações conjuntas. |
Geração de imagem | 15/12/2025 | Global |
| Wan2.6 texto para imagem. Qualidade visual, estética e seguimento de instruções aprimorados proporcionam controle preciso de estilo, retratos realistas, compreensão de textos longos e ampla cobertura de IP histórico/cultural, permitindo geração visual de alta qualidade e altamente expressiva. |
Geração de imagem | 15/12/2025 | Global |
| Wan2.6 Image. Um modelo completo de geração de imagens que suporta raciocínio conjunto texto-imagem, fusão criativa de múltiplas imagens, consistência de nível comercial, transferência de estilo estético e controle preciso de enquadramento e iluminação, aprimorando significativamente a consistência, a controlabilidade e a expressividade na geração de imagens. |
Geração de vídeo | 03/12/2025 | US |
| Wan2.6 texto para vídeo. O agendamento inteligente de tomadas suporta narrativas com múltiplas tomadas, gerando vídeos narrativos com sujeitos, cenas e atmosfera consistentes, com duração máxima de 15 segundos. Oferece melhor seguimento de instruções e fidelidade visual aprimorada. |
Geração de vídeo | 03/12/2025 | Global |
| Wan2.6 texto para vídeo. O agendamento inteligente de tomadas suporta narrativas com múltiplas tomadas, gerando vídeos narrativos com sujeitos, cenas e atmosfera consistentes, com duração máxima de 15 segundos. Oferece melhor seguimento de instruções e fidelidade visual aprimorada. |
Geração de vídeo | 03/12/2025 | US |
| Wan2.6 imagem para vídeo. O agendamento inteligente de tomadas permite narrativas com múltiplas câmeras, oferece geração de voz de maior qualidade, suporta diálogos estáveis com múltiplos falantes com timbres vocais mais naturais e realistas, e permite a geração de clipes de até 15 segundos de duração. |
Geração de vídeo | 03/12/2025 | Global |
| Wan2.6 imagem para vídeo. O agendamento inteligente de tomadas permite narrativas com múltiplas câmeras, oferece geração de voz de maior qualidade, suporta diálogos estáveis com múltiplos falantes com timbres vocais mais naturais e realistas, e permite a geração de clipes de até 15 segundos de duração. |
Geração de texto, Raciocínio | 01/12/2025 | US |
| Esta versão é um snapshot de 1º de dezembro de 2025 e apresenta capacidades de raciocínio aprimoradas em comparação ao snapshot de 28 de julho. As capacidades de agente e de invocação de ferramentas em múltiplas turnos foram ainda mais reforçadas, e o desempenho em tarefas criativas subjetivas melhorou significativamente. Suporta comprimento de contexto de até 1 milhão de tokens, com preços escalonados com base no tamanho do contexto. |
Geração de texto, Raciocínio | 01/12/2025 | Global |
| Esta versão é um snapshot de 1º de dezembro de 2025 e apresenta capacidades de raciocínio aprimoradas em comparação ao snapshot de 28 de julho. As capacidades de agente e de invocação de ferramentas em múltiplas turnos foram ainda mais reforçadas, e o desempenho em tarefas criativas subjetivas melhorou significativamente. Suporta comprimento de contexto de até 1 milhão de tokens, com preços escalonados com base no tamanho do contexto. |
Compreensão visual | 21/11/2025 | Global |
| Este modelo é uma versão snapshot de 20 de novembro de 2025, baseada na mais recente arquitetura Qwen-VL3 com uma atualização abrangente. Apresenta melhorias significativas nas capacidades de análise de documentos e localização de texto, além de reduções substanciais na latência de ponta a ponta e em alucinações. |
Geração de texto | 19/11/2025 | Global |
| O Qwen-MT-Lite é um grande modelo de linguagem da série Qwen especializado em tradução multilíngue. Fornece services de tradução rápidos e de alta qualidade em 32 idiomas a um preço econômico. Oferece recursos como intervenção de terminologia, preservação de formatação e tradução específica por domínio para atender às diversas necessidades de várias aplicações, garantindo eficiência e desempenho. |
Geração de texto | 11/11/2025 | Global |
| O Qwen-MT-Flash, um grande modelo de linguagem da série Qwen, foi totalmente atualizado com a arquitetura Qwen 3 para desempenho e qualidade de tradução significativamente aprimorados. Fornece tradução rápida e econômica em 92 idiomas, suportando recursos avançados como intervenção de terminologia, preservação de formatação e adaptação específica por domínio. É a escolha ideal para aplicações que exigem um equilíbrio poderoso entre velocidade, qualidade e custo. |
Raciocínio, Compreensão visual | 21/10/2025 | Global |
| Maior modelo dense da série Qwen3-VL, sua versão de raciocínio possui capacidades de raciocínio multimodal superadas apenas pelo Qwen3-VL-235B-Thinking. Destaca-se na resolução de problemas de STEM e matemática, compreensão geral de imagens e vídeos, e alcança desempenho state-of-the-art em capacidades de agentes multimodais, sendo ideal para tarefas complexas de raciocínio multimodal. |
Compreensão visual | 21/10/2025 | Global |
| Maior modelo dense da série Qwen3-VL, em sua versão sem inferência, entrega desempenho geral superado apenas pelo Qwen3-VL-235B-Instruct. Destaca-se no reconhecimento e compreensão de documentos, demonstra forte consciência espacial e capacidades de identificação de objetos, e alcança desempenho state-of-the-art em detecção visual 2D e raciocínio espacial. É adequado para tarefas complexas de percepção em uma ampla variedade de cenários de uso geral. |
Compreensão visual | 15/10/2025 | US |
| A série Qwen3 de modelos de compreensão visual de pequena escala integra efetivamente os modos de pensamento e não-pensamento, entregando desempenho superior ao Qwen3-VL-30B-A3B open-source, mantendo velocidades de resposta rápidas. Apresenta uma atualização abrangente na compreensão de imagens/vídeos, suportando contextos ultralongos, como vídeos e documentos extensos, consciência espacial e reconhecimento de objetos em vários domínios. Equipado com capacidades de localização visual 2D/3D, é adequado para lidar com tarefas complexas do mundo real. |
Raciocínio, Compreensão visual | 15/10/2025 | Global |
| A série Qwen3 de modelos de compreensão visual de pequena escala integra efetivamente os modos de pensamento e não-pensamento, entregando desempenho superior ao Qwen3-VL-30B-A3B open-source, mantendo velocidades de resposta rápidas. Apresenta uma atualização abrangente na compreensão de imagens/vídeos, suportando contextos ultralongos, como vídeos e documentos extensos, consciência espacial e reconhecimento de objetos em vários domínios. Equipado com capacidades de localização visual 2D/3D, é adequado para lidar com tarefas complexas do mundo real. |
Raciocínio, Compreensão visual | 03/10/2025 | Global |
| A versão Thinking do segundo maior modelo MoE da série Qwen3-VL apresenta velocidades de resposta rápidas e capacidades aprimoradas de compreensão e raciocínio multimodal, agentes visuais e suporte a contextos extremamente longos, como vídeos e documentos extensos. Também possui compreensão de imagens/vídeos, consciência espacial e habilidades de reconhecimento de objetos totalmente atualizadas, sendo adequado para tarefas complexas do mundo real. |
Compreensão visual | 03/10/2025 | Global |
| A versão Instruct do segundo maior modelo MoE da série Qwen3-VL oferece velocidades de resposta rápidas e suporta contextos extremamente longos, como vídeos e documentos extensos. Inclui compreensão de imagens/vídeos, consciência espacial e capacidades de reconhecimento de objetos totalmente atualizadas, além de localização visual 2D/3D, permitindo lidar com desafios intricados do mundo real. |
Raciocínio, Compreensão visual | 30/09/2025 | Global |
| A versão Thinking do modelo Dense 8B da série Qwen3-VL consome menos memória GPU e é capaz de realizar compreensão e raciocínio multimodal. Suporta contextos extremamente longos, como vídeos e documentos extensos, localização visual 2D/3D, e apresenta capacidades de compreensão de imagens/vídeos, consciência espacial e reconhecimento de objetos totalmente atualizadas. |
Compreensão visual | 30/09/2025 | Global |
| A versão Instruct do modelo Dense 8B da série Qwen3-VL requer menos memória GPU e fornece compreensão de imagens/vídeos totalmente atualizada, suporte a contextos extremamente longos, como vídeos e documentos extensos, consciência espacial e capacidades de reconhecimento de objetos, sendo adequada para lidar com tarefas complexas do mundo real. |
Geração de texto, Raciocínio | 24/09/2025 | Global |
| O modelo Max da série Qwen 3 passou por atualizações especializadas em programação de agentes e invocação de ferramentas em comparação à versão preview. O modelo lançado oficialmente desta vez alcançou desempenho state-of-the-art (SOTA) em sua área e é mais adequado para atender às demandas de agentes operando em cenários mais complexos. |
Compreensão visual | 23/09/2025 | Global |
| Os modelos VL da série Qwen3 integram efetivamente os modos de pensamento e não-pensamento, alcançando desempenho líder mundial em capacidades de agentes visuais em datasets de benchmark públicos, como o OS World. Esta versão apresenta atualizações abrangentes em áreas como codificação visual, percepção espacial e raciocínio multimodal, aprimorando significativamente as habilidades de percepção e reconhecimento visual, e suportando a compreensão de vídeos ultralongos. |
Raciocínio, Compreensão visual | 23/09/2025 | Global |
| Os modelos VL da série Qwen3 apresentam capacidades de raciocínio multimodal significativamente aprimoradas, com foco especial na otimização do modelo para raciocínio STEM e matemático. As habilidades de percepção e reconhecimento visual foram amplamente melhoradas, e as capacidades de OCR passaram por uma grande atualização. |
Compreensão visual | 23/09/2025 | Global |
| Os modelos VL da série Qwen3 foram totalmente atualizados em áreas como codificação visual e percepção espacial. Suas capacidades de percepção e reconhecimento visual melhoraram significativamente, suportando a compreensão de vídeos ultralongos, e sua funcionalidade de OCR passou por um grande aprimoramento. |
Geração de texto | 23/09/2025 | Global |
| Modelo de geração de código baseado no Qwen3 com forte poder de agente de codificação, destaca-se na chamada de ferramentas e interação com o ambiente, capaz de programação autônoma com excelente capacidade de código, mantendo a habilidade geral. Este é um snapshot de 23 de setembro de 2025. Em comparação à versão anterior (snapshot de 22 de julho), demonstra robustez aprimorada no desempenho de tarefas downstream e na invocação de ferramentas, além de maior segurança de código. |
Reconhecimento de fala | 16/09/2025 | US |
| O Qwen3-ASR-Flash é um modelo de reconhecimento de fala multilíngue altamente preciso, inteligente e robusto, baseado em um grande modelo de linguagem. Aproveitando um modelo fundamental poderoso, grandes volumes de dados textuais e multimodais, e dezenas de milhões de horas de dados de áudio, o Qwen3-ASR-Flash alcança reconhecimento de fala de alta precisão. Pode determinar automaticamente o idioma e reconhecer com precisão a fala em 11 idiomas, garantindo transcrição precisa mesmo em ambientes de áudio complexos. |
Geração de texto, Raciocínio | 16/09/2025 | US |
| O Qwen-Plus é uma versão aprimorada do modelo de linguagem ultra-grande Qwen que suporta múltiplos idiomas de entrada, como chinês e inglês. Em comparação às versões anteriores, apresenta melhorias significativas na geração de código em chinês e inglês, raciocínio lógico e habilidades multilíngues. O estilo de resposta foi amplamente ajustado para se alinhar às preferências humanas, com melhorias notáveis no nível de detalhe e clareza das respostas. Melhorias especializadas foram feitas em escrita criativa, adesão à formatação JSON e habilidades de interpretação de papéis. |
Geração de texto, Raciocínio | 16/09/2025 | Global |
| O Qwen-Plus é uma versão aprimorada do modelo de linguagem ultra-grande Qwen que suporta múltiplos idiomas de entrada, como chinês e inglês. Em comparação às versões anteriores, apresenta melhorias significativas na geração de código em chinês e inglês, raciocínio lógico e habilidades multilíngues. O estilo de resposta foi amplamente ajustado para se alinhar às preferências humanas, com melhorias notáveis no nível de detalhe e clareza das respostas. Melhorias especializadas foram feitas em escrita criativa, adesão à formatação JSON e habilidades de interpretação de papéis. |
Geração de texto, Raciocínio | 11/09/2025 | Global |
| Nova geração de modelos de modo de pensamento open-source baseados no Qwen3. Esta versão oferece melhor seguimento de instruções e respostas de resumo mais diretas em relação à iteração anterior (Qwen3-235B-A22B-Thinking-2507). |
Geração de texto | 11/09/2025 | Global |
| Nova geração de modelo open-source de modo não-pensamento impulsionado pelo Qwen3. Esta versão demonstra compreensão superior de texto em chinês, raciocínio lógico aumentado e capacidades aprimoradas em tarefas de geração de texto em relação à iteração anterior (Qwen3-235B-A22B-Instruct-2507). |
Geração de texto, Raciocínio | 11/09/2025 | Global |
| No snapshot de 11 de setembro de 2025, esta versão apresenta seguimento de instruções aprimorado e respostas de resumo mais diretas no modo de pensamento. O modo não-pensamento fornece compreensão superior de texto em chinês e capacidades de raciocínio lógico aumentadas. O modelo suporta comprimento de contexto de 1M com preços escalonados. |
Geração de texto, Raciocínio | 05/09/2025 | Global |
| Versão preview do modelo Max na série Qwen 3, alcançando uma integração efetiva dos modos de pensamento e não-pensamento. No modo de pensamento, há um aprimoramento significativo em capacidades como programação de agentes inteligentes, raciocínio de senso comum e raciocínio em matemática, ciências e domínios gerais. |
Geração de texto, Raciocínio | 01/08/2025 | US |
| O modelo Qwen3 Flash oferece uma fusão poderosa dos modos de pensamento e não-pensamento com alternância dinâmica durante a conversa, destacando-se em raciocínio complexo e apresentando ganhos significativos no seguimento de instruções e compreensão de texto. Suporta comprimento de contexto de 1M e é faturado em um modelo escalonado correspondente ao uso do contexto. |
Geração de texto, Raciocínio | 01/08/2025 | Global |
| O modelo Qwen3 Flash oferece uma fusão poderosa dos modos de pensamento e não-pensamento com alternância dinâmica durante a conversa, destacando-se em raciocínio complexo e apresentando ganhos significativos no seguimento de instruções e compreensão de texto. Suporta comprimento de contexto de 1M e é faturado em um modelo escalonado correspondente ao uso do contexto. |
Geração de texto | 31/07/2025 | Global |
| Modelo de geração de código baseado no Qwen3 que herda a capacidade de agente de codificação do Qwen3-Coder-480B-A35B-Instruct; a capacidade de código atinge SOTA na mesma escala. |
Geração de texto, Raciocínio | 30/07/2025 | Global |
| Modelo de pensamento Qwen3 open-source; em comparação à versão anterior (Qwen3-30B-A3B), destaca-se em tarefas complexas de pensamento, incluindo lógica, matemática, ciências, código e outros cenários desafiadores; o seguimento de instruções, a compreensão de texto e as capacidades de tradução multilíngue foram significativamente aprimorados. |
Geração de texto | 29/07/2025 | Global |
| Baseado no Qwen3, este modelo de geração de código herda as capacidades de agente de codificação do Qwen3-Coder-Plus e suporta interação de ferramentas em múltiplas turnos. Apresenta otimizações focadas na compreensão no nível de repositório e maior estabilidade na chamada de ferramentas. |
Geração de texto | 29/07/2025 | Global |
| Modelo não-pensamento Qwen3 open-source; em comparação à versão anterior (Qwen3-30B-A3B), apresenta grandes melhorias nas capacidades gerais em chinês, inglês e multilíngues. Otimizado para tarefas subjetivas abertas, entregando respostas significativamente mais alinhadas às preferências do usuário e mais úteis. |
Geração de texto, Raciocínio | 29/07/2025 | Global |
| Modelo Plus da série Qwen3, integra os modos de pensamento e não-pensamento e pode alternar entre eles durante o diálogo. Em comparação à versão anterior, adiciona aprimoramentos dedicados para capacidades em chinês e inglês e chamada de ferramentas. Este é um snapshot de 28 de julho de 2025; o primeiro a suportar comprimento de contexto de 1M, utilizando preços escalonados. |
Geração de texto, Raciocínio | 25/07/2025 | Global |
| Modelo de pensamento Qwen3 open-source; em comparação à versão anterior (Qwen3-235B-A22B), apresenta grandes melhorias em capacidade lógica, capacidades gerais, aprimoramento de conhecimento e criatividade, adequado para cenários de alta dificuldade e pensamento forte. |
Geração de texto | 24/07/2025 | Global |
| O Qwen-MT-Plus, o modelo de tradução principal da nossa série Qwen, foi totalmente atualizado com a arquitetura Qwen3. Suporta 92 idiomas e entrega traduções excepcionalmente precisas e naturais. Suas capacidades avançadas de compreensão contextual, controle de terminologia e preservação de formatação o tornam uma escolha superior aos modelos tradicionais, especialmente para domínios especializados. |
Geração de texto | 23/07/2025 | Global |
| Modelo de geração de código baseado no Qwen3 com forte poder de agente de codificação, destaca-se na chamada de ferramentas e interação com o ambiente, capaz de programação autônoma com excelente capacidade de código, mantendo a habilidade geral. |
Geração de texto | 23/07/2025 | Global |
| Modelo de geração de código baseado no Qwen3 com forte poder de agente de codificação; a capacidade de código atinge SOTA open-source. |
Geração de texto | 23/07/2025 | Global |
| Modelo não-pensamento Qwen3 open-source; em comparação à versão anterior (Qwen3-235B-A22B), apresenta ligeiras melhorias em criatividade subjetiva e segurança do modelo. |
Compreensão visual | 07/07/2025 | Global |
| O Qwen-VL_OCR é um modelo de OCR treinado com base no Qwen-VL. Agrega várias tarefas de reconhecimento, análise e processamento de imagem-texto por meio de uma abordagem de modelo unificado, oferecendo poderosas capacidades de reconhecimento de imagem-texto. |
Geração de texto, Raciocínio | 12/05/2025 | Global |
| Alcança integração efetiva dos modos de pensamento e não-pensamento, permitindo alternância de modo durante as conversas. Sua capacidade de raciocínio atinge o nível SOTA na indústria de mesma escala, e sua capacidade geral supera significativamente o Qwen2.5-7B. |
Geração de texto, Raciocínio | 12/05/2025 | Global |
| Alcança integração efetiva dos modos de pensamento e não-pensamento, permitindo alternância de modo durante as conversas. Sua capacidade de raciocínio supera significativamente o QwQ, e sua capacidade geral excede marcadamente o Qwen2.5-32B-Instruct, atingindo o nível SOTA na indústria de mesma escala. |
Geração de texto, Raciocínio | 12/05/2025 | Global |
| Alcança integração efetiva dos modos de pensamento e não-pensamento, permitindo alternância de modo durante as conversas. Sua capacidade de raciocínio rivaliza com o QwQ-32B com um tamanho de parâmetro menor, e sua capacidade geral supera significativamente o Qwen2.5-14B, atingindo o nível SOTA na indústria de mesma escala. |
Geração de texto, Raciocínio | 12/05/2025 | Global |
| Alcança integração efetiva dos modos de pensamento e não-pensamento, permitindo alternância de modo durante as conversas. Sua capacidade de raciocínio supera significativamente o QwQ, e sua capacidade geral excede marcadamente o Qwen2.5-72B-Instruct, atingindo o nível SOTA na indústria de mesma escala. |
Geração de texto, Raciocínio | 12/05/2025 | Global |
| Alcança integração efetiva dos modos de pensamento e não-pensamento, permitindo alternância de modo durante as conversas. Sua capacidade de raciocínio atinge o nível SOTA na indústria de mesma escala, e sua capacidade geral supera significativamente o Qwen2.5-14B. |