Os modelos de deep thinking raciocinam antes de responder, o que melhora a precisão em tarefas complexas, como raciocínio lógico e matemática.
Estes exemplos utilizam a Chat Completion API compatível com OpenAI e a DashScope API. Para a Responses API, consulte Deep thinking .
Uso
O Model Studio oferece suporte ao deep thinking em dois modos:
-
Modo de pensamento híbrido: Utilize o parâmetro
enable_thinkingpara alternar entre pensamento ativo e inativo por requisição:Defina como
true— o modelo raciocina antes de responder.Defina como
false— o modelo responde diretamente, ignorando a etapa de raciocínio.
OpenAI compatible
# Import dependencies and create a client... completion = client.chat.completions.create( model="qwen-plus", # Select a model messages=[{"role": "user", "content": "Who are you"}], # Since enable_thinking is not a standard OpenAI parameter, pass it in extra_body. extra_body={"enable_thinking":True}, # Enable streaming output. stream=True, # Configure the stream to include token consumption information in the last data packet. stream_options={ "include_usage": True } )DashScope
A DashScope API para a série Qwen3.5 utiliza uma interface multimodal. O exemplo a seguir retorna um
url error. Para o uso correto, consulte Enable or disable thinking mode .# Import dependencies... response = Generation.call( # If you have not set the environment variable, replace the next line with your Model Studio API key, for example: api_key = "sk-xxx", api_key=os.getenv("DASHSCOPE_API_KEY"), # You can use other deep thinking models as needed. model="qwen-plus", messages=messages, result_format="message", enable_thinking=True, stream=True, incremental_output=True ) Modo apenas de pensamento: O modelo sempre raciocina antes de responder — não é possível desativar esse comportamento. O formato da requisição é idêntico ao do modo de pensamento híbrido; o parâmetro
enable_thinkingnão é necessário.
A API retorna o raciocínio no campo reasoning_content e a resposta no campo content. Como o raciocínio adiciona latência e a maioria dos modelos suporta apenas streaming, todos os exemplos utilizam streaming.