Todos os produtos
Search
Central de documentação

Alibaba Cloud Model Studio:Geração de texto

Última atualização: Jul 14, 2026

Escolha o modelo de geração de texto ideal para agentes de IA, chatbots e processamento de documentos.

Modelos recomendados para ferramentas de codificação

Recomendamos o qwen3.7-plus para equilibrar desempenho e custo, com suporte completo a chamadas de ferramentas e janela de contexto de 1 milhão de tokens para grandes bases de código. Para obter a maior capacidade de raciocínio, escolha o qwen3.7-max.

Migração de modelos de código fechado

Mapeie seu modelo atual do GPT, Claude ou Gemini para um modelo equivalente no Bailian.

Exemplos de código fechado

Recomendação do Bailian

Maior capacidade

GPT-5,5, Claude Opus 4,7, Gemini 3,1 Pro

qwen3.7-max

Equilibrado

GPT-5,4, Claude Sonnet 4,6, Gemini 3 Pro

qwen3.7-plus, deepseek-v4-pro, glm-5.2

Leve e de baixo custo

GPT-5,4-mini, Claude Haiku 4,5, Gemini 3,1 Flash

qwen3.6-flash, deepseek-v4-flash, MiniMax-M2.5

Casos de uso

Comece com o qwen3.7-plus para chatbots, geração de conteúdo, resumos e processamento de documentos. Esse modelo equilibra desempenho, custo e ferramentas integradas, com uma janela de contexto de 1 milhão de tokens. Para reduzir despesas, migre para o qwen3.6-flash, que oferece capacidades semelhantes por um preço menor. Se precisar da maior capacidade de raciocínio possível, utilize o qwen3.7-max (contexto de 1 milhão, custo mais elevado).

Produtividade de escritório (não relacionada a código)

Para tarefas de escritório sem envolvimento de programação, como redação de documentos, composição de e-mails, resumo de notas de reuniões e análise de dados, inicie com o qwen3.7-plus. Ele equilibra desempenho e custo, com janela de contexto de 1 milhão de tokens, suporte a Function Calling e ferramentas nativas. Caso deseje economizar, experimente o qwen3.6-flash, pois entrega desempenho próximo ao topo de linha por um preço inferior, mantendo o mesmo tamanho de contexto. Para obter a capacidade de raciocínio mais robusta, opte pelo qwen3.7-max (custo mais alto). Já para processar documentos extensos, como a revisão de múltiplos contratos, use o qwen-long (janela de contexto de 10 milhões de tokens).

Nota

O TONGYI Lingma e o Qoder são ferramentas de codificação com IA projetadas para desenvolvimento de software. Elas não se destinam a tarefas gerais de produtividade de escritório.

Janela de contexto

Um milhão de tokens equivale a aproximadamente 750.000 palavras em inglês, ou entre 8 e 10 romances.

  • Documentos longos ou grandes bases de código: qwen3.7-plus / qwen3.6-flash (1 milhão de tokens).

  • Tarefas padrão: geralmente 128k a 256k tokens são suficientes.

Para obter detalhes sobre a janela de contexto, visite a página Models.

China (Beijing) | Singapore | US | China (Hong Kong) | Frankfurt

Modo de raciocínio

Raciocínio passo a passo para matemática complexa, depuração de código, planejamento de arquitetura e referências cruzadas jurídicas.

Ative esse recurso com o parâmetro enable_thinking ou utilize reasoning.effort na Responses API para controlar a profundidade do pensamento. Todos os modelos Qwen3+ suportam essa funcionalidade, e a maioria opera em modo híbrido, alternável por solicitação.

Consulte Pensamento profundo .

Chamada de funções e ferramentas integradas

Permita que o modelo execute ações como consultar o clima, pesquisar em bancos de dados ou agendar reuniões.

  • Chamada de função (ferramentas personalizadas invocadas pelo modelo): compatível com todos os modelos de uso geral.

  • Ferramentas integradas (pesquisa na web, interpretador de código, extração de dados da web) sem necessidade de configuração.

Consulte Chamada de ferramentas .

Saída estruturada

Garante uma saída JSON válida, útil para extrair dados estruturados, como nomes e endereços, diretamente do texto.

Consulte Saída estruturada .

Inferência em lote

Processe grandes volumes a um custo reduzido quando a latência não for crítica.

Consulte Inferência em lote .

Modelos recomendados

Model ID

Context

Thinking mode

Function Calling

Built-in tools

Structured output

qwen3.7-max

1M

Supported

Supported

Supported

Supported

qwen3.7-plus

1M

Supported

Supported

Supported

Supported

qwen3.6-flash

1M

Supported

Supported

Supported

Supported

kimi-k2.6

256k

Supported

Supported

Unsupported

Unsupported

deepseek-v4-pro

1M

Supported

Supported

Unsupported

Unsupported

deepseek-v4-flash

1M

Supported

Supported

Unsupported

Unsupported

glm-5.2

198k

Supported

Supported

Unsupported

Supported

MiniMax-M2.5

192k

Supported

Supported

Unsupported

Unsupported

Modelos legados

Para novos projetos, utilize as séries Qwen3.6 ou Qwen3.5. Os modelos listados abaixo são legados e não são mais recomendados. Acesse a página Models para visualizar parâmetros detalhados, como janela de contexto e faturamento.

Qwen3.6

Model ID

Context

Thinking mode

Function Calling

Built-in tools

Structured output

qwen3.6-max-preview

256k

Supported

Supported

Unsupported

Supported

qwen3.6-plus

1M

Supported

Supported

Supported

Supported

Qwen3.5

Model ID

Context

Thinking mode

Function Calling

Built-in tools

Structured output

qwen3.5-plus

1M

Supported

Supported

Supported

Supported

qwen3.5-flash

1M

Supported

Supported

Supported

Supported

qwen3.5-397b-a17b

256k

Supported

Supported

Supported

Supported

qwen3.5-122b-a10b

256k

Supported

Supported

Supported

Supported

qwen3.5-27b

256k

Supported

Supported

Supported

Supported

qwen3.5-35b-a3b

256k

Supported

Supported

Supported

Supported

Qwen3

Model ID

Context

Thinking mode

Function Calling

Built-in tools

Structured output

qwen3-max

Visualize snapshots

qwen3-max-2026-01-23 qwen3-max-preview qwen3-max-2025-09-23

256k

Supported

Supported

Supported

Supported

qwen3-235b-a22b

256k

Supported

Supported

Unsupported

Supported

qwen3-235b-a22b-thinking-2507

256k

Supported

Supported

Unsupported

Unsupported

qwen3-235b-a22b-instruct-2507

256k

Unsupported

Supported

Unsupported

Supported

qwen3-next-80b-a3b-thinking

256k

Supported

Supported

Unsupported

Unsupported

qwen3-next-80b-a3b-instruct

256k

Unsupported

Supported

Unsupported

Supported

qwen3-32b

256k

Supported

Supported

Unsupported

Supported

qwen3-30b-a3b

256k

Supported

Supported

Unsupported

Supported

qwen3-30b-a3b-thinking-2507

256k

Supported

Supported

Unsupported

Unsupported

qwen3-30b-a3b-instruct-2507

256k

Unsupported

Supported

Unsupported

Supported

qwen3-14b

256k

Supported

Supported

Unsupported

Supported

qwen3-8b

256k

Supported

Supported

Unsupported

Supported

qwen3-4b

256k

Supported

Supported

Unsupported

Supported

qwen3-1.7b

256k

Supported

Supported

Unsupported

Supported

qwen3-0.6b

256k

Supported

Supported

Unsupported

Supported

Qwen3-Coder

Model ID

Context

Thinking mode

Function Calling

Built-in tools

Structured output

qwen3-coder-plus

Visualize snapshots

qwen3-coder-plus-2025-09-23 qwen3-coder-plus-2025-07-22

1M

Supported

Supported

Unsupported

Supported

qwen3-coder-flash

Visualize snapshots

qwen3-coder-flash-2025-07-28

1M

Supported

Supported

Unsupported

Supported

qwen3-coder-next

256k

Supported

Supported

Unsupported

Supported

qwen3-coder-480b-a35b-instruct

256k

Unsupported

Supported

Unsupported

Supported

qwen3-coder-30b-a3b-instruct

256k

Unsupported

Supported

Unsupported

Supported

Qwen2.5 (código aberto)

Model ID

Context

Thinking mode

Function Calling

Built-in tools

Structured output

qwen2.5-omni-7b

1M

Unsupported

Unsupported

Unsupported

Unsupported

qwen2.5-vl-72b-instruct

1M

Unsupported

Unsupported

Unsupported

Unsupported

qwen2.5-vl-32b-instruct

1M

Unsupported

Unsupported

Unsupported

Unsupported

qwen2.5-vl-7b-instruct

1M

Unsupported

Unsupported

Unsupported

Unsupported

qwen2.5-vl-3b-instruct

1M

Unsupported

Unsupported

Unsupported

Unsupported

qwen2.5-72b-instruct

1M

Unsupported

Supported

Unsupported

Supported

qwen2.5-32b-instruct

1M

Unsupported

Supported

Unsupported

Supported

qwen2.5-14b-instruct

1M

Unsupported

Supported

Unsupported

Supported

qwen2.5-14b-instruct-1m

1M

Unsupported

Supported

Unsupported

Supported

qwen2.5-7b-instruct

1M

Unsupported

Supported

Unsupported

Supported

qwen2.5-7b-instruct-1m

1M

Unsupported

Supported

Unsupported

Supported

Tradução

Model ID

Context

Thinking mode

Function Calling

Built-in tools

Structured output

qwen-mt-plus

16k

Unsupported

Unsupported

Unsupported

Unsupported

qwen-mt-turbo

16k

Unsupported

Unsupported

Unsupported

Unsupported

qwen-mt-flash

16k

Unsupported

Unsupported

Unsupported

Unsupported

qwen-mt-lite

16k

Unsupported

Unsupported

Unsupported

Unsupported

Qwen-Long

Model ID

Context

Thinking mode

Function Calling

Built-in tools

Structured output

qwen-long

Visualize snapshots

qwen-long-2025-01-25

10M

Unsupported

Unsupported

Unsupported

Supported

qwen-long-latest

10M

Unsupported

Unsupported

Unsupported

Supported

Interpretação de personagens

Model ID

Context

Thinking mode

Function Calling

Built-in tools

Structured output

qwen-plus-character

32k

Unsupported

Unsupported

Unsupported

Unsupported

qwen-plus-character-ja

32k

Unsupported

Unsupported

Unsupported

Unsupported

qwen-flash-character

8k

Unsupported

Unsupported

Unsupported

Unsupported

Qwen legado

Model ID

Context

Thinking mode

Function Calling

Built-in tools

Structured output

qwen-plus e seus snapshots

1M

Supported

Supported

Supported

Supported

qwen-max e seus snapshots

128k

Unsupported

Supported

Supported

Supported

qwen-flash e seus snapshots

1M

Supported

Supported

Supported

Supported

qwen-turbo e seus snapshots

1M

Supported

Supported

Supported

Supported

qwq-plus

128k

Supported

Supported

Unsupported

Unsupported

qvq-max e seus snapshots

128k

Supported

Unsupported

Unsupported

Unsupported

qwen-omni-turbo e seus snapshots

32k

Unsupported

Unsupported

Unsupported

Unsupported

Modelos de terceiros

Model ID

Context

Thinking mode

Function Calling

Built-in tools

Structured output

glm-5.1

198k

Supported

Supported

Unsupported

Supported

glm-5

198k

Supported

Supported

Unsupported

Supported

glm-4.7

198k

Supported

Supported

Unsupported

Supported

glm-4.5

198k

Supported

Supported

Unsupported

Supported

glm-4.5-air

198k

Supported

Supported

Unsupported

Supported

MiniMax-M2.7

200k

Supported

Supported

Unsupported

Unsupported

MiniMax-M2.1

200k

Supported

Supported

Unsupported

Unsupported

kimi-k2.5

256k

Supported

Supported

Unsupported

Unsupported

kimi-k2-thinking

256k

Supported

Supported

Unsupported

Supported

Moonshot-Kimi-K2-Instruct

256k

Unsupported

Supported

Unsupported

Unsupported

deepseek-v3.2

128k

Supported

Supported

Unsupported

Unsupported

deepseek-v3.2-exp

128k

Supported

Supported

Unsupported

Unsupported

deepseek-v3.1

128k

Supported

Supported

Unsupported

Unsupported

deepseek-v3

128k

Unsupported

Supported

Unsupported

Unsupported

deepseek-r1

128k

Supported

Supported

Unsupported

Unsupported

deepseek-r1-0528

128k

Supported

Supported

Unsupported

Unsupported

deepseek-r1-distill-llama-70b

128k

Supported

Unsupported

Unsupported

Unsupported

deepseek-r1-distill-qwen-32b

128k

Supported

Unsupported

Unsupported

Unsupported

deepseek-r1-distill-qwen-14b

128k

Supported

Unsupported

Unsupported

Unsupported

deepseek-r1-distill-qwen-7b

128k

Supported

Unsupported

Unsupported

Unsupported

deepseek-r1-distill-qwen-1.5b

128k

Supported

Unsupported

Unsupported

Unsupported

deepseek-r1-distill-llama-8b

128k

Supported

Unsupported

Unsupported

Unsupported