Central de documentação
 
Todos os produtos
Search
  • Central de documentação
  • Alibaba Cloud Model Studio
  • Guia do Usuário (Modelos)
  • Model Playground
  • Geração de texto
  • Deep thinking

Este produto

  • Este produto
  • Todos os produtos

    Alibaba Cloud Model Studio:Deep thinking

    Central de documentação

    Alibaba Cloud Model Studio:Deep thinking

    Última atualização: Jul 15, 2026

    Os modelos de deep thinking raciocinam antes de responder, o que melhora a precisão em tarefas complexas, como raciocínio lógico e matemática.

    Estes exemplos utilizam a Chat Completion API compatível com OpenAI e a DashScope API. Para a Responses API, consulte Deep thinking .
    QwQ Logo
    Qwen

    Uso

    O Model Studio oferece suporte ao deep thinking em dois modos:

    • Modo de pensamento híbrido: Utilize o parâmetro enable_thinking para alternar entre pensamento ativo e inativo por requisição:

      • Defina como true — o modelo raciocina antes de responder.

      • Defina como false — o modelo responde diretamente, ignorando a etapa de raciocínio.

      OpenAI compatible

      # Import dependencies and create a client...
      completion = client.chat.completions.create(
          model="qwen-plus", # Select a model
          messages=[{"role": "user", "content": "Who are you"}],    
          # Since enable_thinking is not a standard OpenAI parameter, pass it in extra_body.
          extra_body={"enable_thinking":True},
          # Enable streaming output.
          stream=True,
          # Configure the stream to include token consumption information in the last data packet.
          stream_options={
              "include_usage": True
          }
      )

      DashScope

      A DashScope API para a série Qwen3.5 utiliza uma interface multimodal. O exemplo a seguir retorna um url error . Para o uso correto, consulte Enable or disable thinking mode .
      # Import dependencies...
      
      response = Generation.call(
          # If you have not set the environment variable, replace the next line with your Model Studio API key, for example: api_key = "sk-xxx",
          api_key=os.getenv("DASHSCOPE_API_KEY"),
          # You can use other deep thinking models as needed.
          model="qwen-plus",
          messages=messages,
          result_format="message",
          enable_thinking=True,
          stream=True,
          incremental_output=True
      )
    • Modo apenas de pensamento: O modelo sempre raciocina antes de responder — não é possível desativar esse comportamento. O formato da requisição é idêntico ao do modo de pensamento híbrido; o parâmetro enable_thinking não é necessário.

    A API retorna o raciocínio no campo reasoning_content e a resposta no campo content. Como o raciocínio adiciona latência e a maioria dos modelos suporta apenas streaming, todos os exemplos utilizam streaming.

    Modelos suportados

    Obrigado! Recebemos o seu feedback.