Os modelos de deep thinking realizam raciocínio antes de responder, o que aumenta a precisão em tarefas complexas, como raciocínio lógico e matemática.
Estes exemplos utilizam a Chat Completion API compatível com OpenAI e a DashScope API. Para a Responses API, consulte Deep thinking .
Uso
O Model Studio oferece suporte ao deep thinking em dois modos:
-
Modo de pensamento híbrido: Utilize o parâmetro
enable_thinkingpara alternar entre pensamento ativo e inativo por requisição:- Defina como
true— o modelo raciocina antes de responder. - Defina como
false— o modelo responde diretamente, ignorando a etapa de raciocínio.
- OpenAI compatible
- DashScope
- Defina como
-
Modo apenas de pensamento: O modelo sempre raciocina antes de responder — não é possível desativar esse comportamento. O formato da requisição é idêntico ao do modo de pensamento híbrido; o parâmetro
enable_thinkingnão é necessário.
reasoning_content e a resposta no campo content. Como o raciocínio adiciona latência, todos os exemplos usam streaming por padrão (recomendado para acompanhar o raciocínio em tempo real). Os modelos comerciais de pensamento também suportam saída sem streaming (síncrona); consulte o FAQ abaixo para detalhes de uso e ressalvas. Alguns modelos (como os open source qwen3-235b-a22b e qwen3-32b) aceitam apenas streaming, e uma chamada síncrona resultará em erro.
Modelos suportados
- Qwen3.8
- Qwen3.7
- Qwen3.6
- Qwen3.5
Qwen3.8 Max series (modo de pensamento hibrido, pensamento ativado por padrao): qwen3.8-maxQwen3.8 Flash series (modo de pensamento hibrido, pensamento ativado por padrao): qwen3.8-flashQwen3.8 Open-source series (modo de pensamento hibrido, pensamento ativado por padrao): qwen3.8-2.4t-a95b