Escolha o modelo de geração de texto ideal para agentes de IA, chatbots e processamento de documentos.
Modelos recomendados para ferramentas de codificação
Recomendamos o qwen3.7-plus para equilibrar desempenho e custo, com suporte completo a chamadas de ferramentas e janela de contexto de 1 milhão de tokens para grandes bases de código. Para obter a maior capacidade de raciocínio, escolha o qwen3.8-max.
Migração de modelos de código fechado
Mapeie seu modelo atual GPT, Claude ou Gemini para um modelo equivalente no Bailian.
Exemplos de código fechado | Recomendação do Bailian | |
|---|---|---|
Maior capacidade | GPT-5,5, Claude Opus 4,7, Gemini 3,1 Pro |
|
Equilibrado | GPT-5,4, Claude Sonnet 4,6, Gemini 3 Pro |
|
Leve e de baixo custo | GPT-5,4-mini, Claude Haiku 4,5, Gemini 3,1 Flash |
|
Casos de uso
Comece com o qwen3.7-plus para chatbots, geração de conteúdo, resumos e processamento de documentos. Esse modelo equilibra desempenho, custo e ferramentas integradas, oferecendo uma janela de contexto de 1 milhão de tokens. Para reduzir custos, migre para o qwen3.8-flash, que oferece capacidades semelhantes por um preço menor. Se precisar da maior capacidade de raciocínio, use o qwen3.8-max.
Produtividade de escritório (não relacionada a codificação)
Para tarefas de escritório sem codificação, como redação de documentos, composição de e-mails, resumo de notas de reuniões e análise de dados, comece com o qwen3.7-plus. Ele equilibra desempenho e custo, com janela de contexto de 1 milhão de tokens, suporte a Function Calling e ferramentas integradas. Para diminuir despesas, experimente o qwen3.8-flash, que entrega desempenho próximo ao dos modelos principais por um preço inferior, mantendo o mesmo tamanho de contexto. Caso necessite da capacidade de raciocínio mais robusta, opte pelo qwen3.8-max. Para processar documentos longos, como a revisão de múltiplos contratos, use o qwen-long (janela de contexto de 10 milhões de tokens).
Janela de contexto
Um milhão de tokens equivale a aproximadamente 750.000 palavras em inglês, ou entre 8 e 10 romances.
- Para documentos extensos ou grandes bases de código:
qwen3.7-plus/qwen3.8-flash(1 milhão de tokens). - Para tarefas padrão: geralmente 128k a 256k tokens são suficientes.
Modo de raciocínio
Raciocínio passo a passo para cálculos matemáticos complexos, depuração de código, planejamento de arquitetura e referências cruzadas jurídicas.
Ative esse recurso com o parâmetro enable_thinking ou use reasoning.effort na Responses API para controlar a profundidade do raciocínio. Todos os modelos Qwen3+ suportam esse recurso; a maioria opera em modo híbrido, alternável por solicitação.
Consulte Deep thinking .
Function calling e ferramentas integradas
Permita que o modelo execute ações como consultar o clima, pesquisar em bancos de dados ou agendar reuniões.
- Function calling (ferramentas personalizadas chamadas pelo modelo): compatível com todos os modelos de uso geral.
- Ferramentas integradas (busca na web, interpretador de código, extração de dados da web) sem necessidade de configuração.
Consulte Tool calling .
Saída estruturada
Garante uma saída JSON válida, útil para extrair dados estruturados, como nomes e endereços, diretamente do texto.
Consulte Structured output .
Inferência em lote
Processe grandes volumes de dados a um custo reduzido quando a latência não for crítica.
Consulte Batch inference .
Modelos recomendados
Model ID | Context | Thinking mode | Function Calling | Built-in tools | Structured output |
|---|---|---|---|---|---|
| 1M | Supported | Supported | Supported | Supported |
| 1M | Supported | Supported | Supported | Supported |
| 1M | Supported | Supported | Supported | Supported |
| 1M | Supported | Supported | Supported | Supported |
| 256k | Supported | Supported | Unsupported | Unsupported |
| 1M | Supported | Supported | Unsupported | Supported |
| 1M | Supported | Supported | Unsupported | Supported |
| 198k | Supported | Supported | Unsupported | Supported |
| 192k | Supported | Supported | Unsupported | Unsupported |
Modelos legados
Para novos projetos, use as séries Qwen3.6 ou Qwen3.5. Os modelos listados abaixo são legados e não são mais recomendados. Visite a página Models para visualizar parâmetros detalhados, como janela de contexto e faturamento.
Qwen3.7
| Model ID | Context | Thinking mode | Function Calling | Built-in tools | Structured output |
|---|---|---|---|---|---|
qwen3.7-max
Visualize snapshots qwen3.7-max-preview qwen3.7-max-2026-06-08 qwen3.7-max-2026-05-20 qwen3.7-max-2026-05-17 | 1M | Supported | Supported | Supported | Supported |
Qwen3.6
| Model ID | Context | Thinking mode | Function Calling | Built-in tools | Structured output |
|---|---|---|---|---|---|
qwen3.6-max-preview | 256k | Supported | Supported | Unsupported | Supported |
qwen3.6-plus | 1M | Supported | Supported | Supported | Supported |
qwen3.6-flash
Visualize snapshots qwen3.6-flash-2026-04-16 | 1M | Supported | Supported | Supported | Supported |
Qwen3.5
Model ID | Context | Thinking mode | Function Calling | Built-in tools | Structured output |
|---|---|---|---|---|---|
| 1M | Supported | Supported | Supported | Supported |
| 1M | Supported | Supported | Supported | Supported |
| 256k | Supported | Supported | Supported | Supported |
| 256k | Supported | Supported | Supported | Supported |
| 256k | Supported | Supported | Supported | Supported |
| 256k | Supported | Supported | Supported | Supported |
Qwen3
| Model ID | Context | Thinking mode | Function Calling | Built-in tools | Structured output |
|---|---|---|---|---|---|
qwen3-max
Visualize snapshots qwen3-max-2026-01-23 qwen3-max-preview qwen3-max-2025-09-23 | 256k | Supported | Supported | Supported | Supported |
qwen3-235b-a22b | 256k | Supported | Supported | Unsupported | Supported |
qwen3-235b-a22b-thinking-2507 | 256k | Supported | Supported | Unsupported | Unsupported |
qwen3-235b-a22b-instruct-2507 | 256k | Unsupported | Supported | Unsupported | Supported |
qwen3-next-80b-a3b-thinking | 256k | Supported | Supported | Unsupported | Unsupported |
qwen3-next-80b-a3b-instruct | 256k | Unsupported | Supported | Unsupported | Supported |
qwen3-32b | 256k | Supported | Supported | Unsupported | Supported |
qwen3-30b-a3b | 256k | Supported | Supported | Unsupported | Supported |
qwen3-30b-a3b-thinking-2507 | 256k | Supported | Supported | Unsupported | Unsupported |
qwen3-30b-a3b-instruct-2507 | 256k | Unsupported | Supported | Unsupported | Supported |
qwen3-14b | 256k | Supported | Supported | Unsupported | Supported |
qwen3-8b | 256k | Supported | Supported | Unsupported | Supported |
qwen3-4b | 256k | Supported | Supported | Unsupported | Supported |
qwen3-1.7b | 256k | Supported | Supported | Unsupported | Supported |
qwen3-0.6b | 256k | Supported | Supported | Unsupported | Supported |
Qwen3-Coder
| Model ID | Context | Thinking mode | Function Calling | Built-in tools | Structured output |
|---|---|---|---|---|---|
qwen3-coder-plus
Visualize snapshots qwen3-coder-plus-2025-09-23 qwen3-coder-plus-2025-07-22 | 1M | Supported | Supported | Unsupported | Supported |
qwen3-coder-flash
Visualize snapshots qwen3-coder-flash-2025-07-28 | 1M | Supported | Supported | Unsupported | Supported |
qwen3-coder-next | 256k | Supported | Supported | Unsupported | Supported |
qwen3-coder-480b-a35b-instruct | 256k | Unsupported | Supported | Unsupported | Supported |
qwen3-coder-30b-a3b-instruct | 256k | Unsupported | Supported | Unsupported | Supported |
Qwen2.5 (código aberto)
Model ID | Context | Thinking mode | Function Calling | Built-in tools | Structured output |
|---|---|---|---|---|---|
| 1M | Unsupported | Unsupported | Unsupported | Unsupported |
| 1M | Unsupported | Unsupported | Unsupported | Unsupported |
| 1M | Unsupported | Unsupported | Unsupported | Unsupported |
| 1M | Unsupported | Unsupported | Unsupported | Unsupported |
| 1M | Unsupported | Unsupported | Unsupported | Unsupported |
| 1M | Unsupported | Supported | Unsupported | Supported |
| 1M | Unsupported | Supported | Unsupported | Supported |
| 1M | Unsupported | Supported | Unsupported | Supported |
| 1M | Unsupported | Supported | Unsupported | Supported |
| 1M | Unsupported | Supported | Unsupported | Supported |
| 1M | Unsupported | Supported | Unsupported | Supported |
Tradução
Model ID | Context | Thinking mode | Function Calling | Built-in tools | Structured output |
|---|---|---|---|---|---|
| 16k | Unsupported | Unsupported | Unsupported | Unsupported |
| 16k | Unsupported | Unsupported | Unsupported | Unsupported |
| 16k | Unsupported | Unsupported | Unsupported | Unsupported |
| 16k | Unsupported | Unsupported | Unsupported | Unsupported |
Qwen-Long
| Model ID | Context | Thinking mode | Function Calling | Built-in tools | Structured output |
|---|---|---|---|---|---|
qwen-long
Visualize snapshots qwen-long-2025-01-25 | 10M | Unsupported | Unsupported | Unsupported | Supported |
qwen-long-latest | 10M | Unsupported | Unsupported | Unsupported | Supported |
Interpretação de personagens
Model ID | Context | Thinking mode | Function Calling | Built-in tools | Structured output |
|---|---|---|---|---|---|
| 32k | Unsupported | Unsupported | Unsupported | Unsupported |
| 32k | Unsupported | Unsupported | Unsupported | Unsupported |
| 8k | Unsupported | Unsupported | Unsupported | Unsupported |
Qwen legado
Model ID | Context | Thinking mode | Function Calling | Built-in tools | Structured output |
|---|---|---|---|---|---|
| 1M | Supported | Supported | Supported | Supported |
| 128k | Unsupported | Supported | Supported | Supported |
| 1M | Supported | Supported | Supported | Supported |
| 1M | Supported | Supported | Supported | Supported |
| 128k | Supported | Supported | Unsupported | Unsupported |
| 128k | Supported | Unsupported | Unsupported | Unsupported |
| 32k | Unsupported | Unsupported | Unsupported | Unsupported |
Modelos de terceiros
Model ID | Context | Thinking mode | Function Calling | Built-in tools | Structured output |
|---|---|---|---|---|---|
| 198k | Supported | Supported | Unsupported | Supported |
| 198k | Supported | Supported | Unsupported | Supported |
| 198k | Supported | Supported | Unsupported | Supported |
| 198k | Supported | Supported | Unsupported | Supported |
| 198k | Supported | Supported | Unsupported | Supported |
| 200k | Supported | Supported | Unsupported | Unsupported |
| 200k | Supported | Supported | Unsupported | Unsupported |
| 256k | Supported | Supported | Unsupported | Unsupported |
| 256k | Supported | Supported | Unsupported | Supported |
| 256k | Unsupported | Supported | Unsupported | Unsupported |
| 128k | Supported | Supported | Unsupported | Unsupported |
| 128k | Supported | Supported | Unsupported | Unsupported |
| 128k | Supported | Supported | Unsupported | Unsupported |
| 128k | Unsupported | Supported | Unsupported | Unsupported |
| 128k | Supported | Supported | Unsupported | Unsupported |
| 128k | Supported | Supported | Unsupported | Unsupported |
| 128k | Supported | Unsupported | Unsupported | Unsupported |
| 128k | Supported | Unsupported | Unsupported | Unsupported |
| 128k | Supported | Unsupported | Unsupported | Unsupported |
| 128k | Supported | Unsupported | Unsupported | Unsupported |
| 128k | Supported | Unsupported | Unsupported | Unsupported |
| 128k | Supported | Unsupported | Unsupported | Unsupported |