All Products
Search
Document Center

Alibaba Cloud Model Studio:Generasi teks

Last Updated:Sep 09, 2026

Pilih model generasi teks yang tepat untuk Agen AI, chatbot, dan pemrosesan dokumen.

Model yang direkomendasikan untuk tool coding

Kami merekomendasikan qwen3.7-plus karena menawarkan keseimbangan optimal antara performa dan biaya, dilengkapi dukungan penuh tool calling serta jendela konteks 1 juta token untuk basis kode besar. Untuk kemampuan reasoning terkuat, pilih qwen3.8-max.

Migrasi dari model closed-source

Petakan model GPT, Claude, atau Gemini Anda saat ini ke model Bailian yang setara.

Contoh closed-source

Rekomendasi Bailian

Kemampuan tertinggi

GPT-5.5, Claude Opus 4.7, Gemini 3.1 Pro

qwen3.8-max

Seimbang

GPT-5.4, Claude Sonnet 4.6, Gemini 3 Pro

qwen3.7-plus, deepseek-v4-pro, glm-5.2

Ringan & berbiaya rendah

GPT-5.4-mini, Claude Haiku 4.5, Gemini 3.1 Flash

qwen3.8-flash, deepseek-v4-flash, MiniMax-M2.5

Kasus penggunaan

Mulai dengan qwen3.7-plus untuk chatbot, pembuatan konten, ringkasan, dan pemrosesan dokumen—model ini menyeimbangkan performa, biaya, dan fitur tool bawaan dengan jendela konteks 1 juta token. Untuk mengurangi biaya, beralihlah ke qwen3.8-flash, yang menawarkan kemampuan serupa dengan harga lebih rendah. Untuk kemampuan reasoning terkuat, gunakan qwen3.8-max.

Produktivitas kantor (non-coding)

Untuk tugas kantor non-coding seperti penyusunan dokumen, pengelolaan alur email, ringkasan catatan rapat, dan analitik data, mulailah dengan qwen3.7-plus—model ini menyeimbangkan performa dan biaya dengan jendela konteks 1 juta token, dukungan Function Calling, serta fitur tool bawaan. Untuk mengurangi biaya, coba qwen3.8-flash, yang memberikan performa mendekati flagship dengan harga lebih rendah dan panjang konteks yang sama. Untuk kemampuan reasoning terkuat, pilih qwen3.8-max. Untuk pemrosesan dokumen panjang seperti meninjau beberapa kontrak, gunakan qwen-long (jendela konteks 10 juta token).

CatatanTONGYI Lingma dan Qoder adalah tool coding AI yang dirancang khusus untuk pengembangan perangkat lunak. Tool ini tidak ditujukan untuk tugas produktivitas kantor umum.

Jendela konteks

1 juta token kira-kira setara dengan 750.000 kata dalam bahasa Inggris, atau 8–10 novel.

  • Untuk dokumen panjang atau basis kode besar: qwen3.8-max/qwen3.7-plus / qwen3.8-flash (1 juta token).
  • Untuk tugas standar: 128k–256k token biasanya sudah cukup.

Untuk detail jendela konteks, kunjungi halaman Models.

Tiongkok (Beijing) | Singapura | AS | Tiongkok (Hong Kong) | Frankfurt

Mode berpikir

Lakukan reasoning langkah demi langkah untuk matematika multi-langkah, debugging kode, perencanaan arsitektur, dan referensi silang hukum.

Aktifkan dengan parameter enable_thinking, atau gunakan reasoning.effort dalam Responses API untuk mengatur kedalaman berpikir. Semua model Qwen3+ mendukung fitur ini, sebagian besar beroperasi dalam mode hybrid yang dapat diaktifkan per permintaan.

Lihat Deep thinking.

Function calling dan tool bawaan

Biarkan model melakukan aksi seperti menanyakan cuaca, mencari database, atau memesan rapat.

  • Function calling (tool kustom yang dipanggil model): Didukung oleh semua model tujuan umum.
  • Tool bawaan (pencarian web, interpreter kode, web scraping) tanpa perlu konfigurasi tambahan.

Lihat Pemanggilan alat.

Output terstruktur

Paksa output JSON yang valid, berguna untuk mengekstraksi data terstruktur seperti nama dan alamat dari teks.

Lihat Output terstruktur.

Inferensi batch

Proses volume besar dengan biaya lebih rendah ketika latensi tidak menjadi pertimbangan utama.

Lihat Inferensi batch.

Model yang direkomendasikan

Model ID

Konteks

Mode berpikir

Function Calling

Tool bawaan

Output terstruktur

qwen3.8-max

1M

Didukung

Didukung

Didukung

Didukung

qwen3.8-flash

1M

Didukung

Didukung

Didukung

Didukung

qwen3.7-plus

1M

Didukung

Didukung

Didukung

Didukung

qwen3.7-flash

1M

Didukung

Didukung

Didukung

Didukung

kimi-k2.6

256k

Didukung

Didukung

Tidak didukung

Tidak didukung

deepseek-v4-pro

1M

Didukung

Didukung

Tidak didukung

Didukung

deepseek-v4-flash

1M

Didukung

Didukung

Tidak didukung

Didukung

glm-5.2

198k

Didukung

Didukung

Tidak didukung

Didukung

MiniMax-M2.5

192k

Didukung

Didukung

Tidak didukung

Tidak didukung

Model lama

Model-model berikut merupakan model lama dan tidak lagi direkomendasikan. Kunjungi halaman Models untuk melihat parameter model secara rinci, seperti jendela konteks dan penagihan.

Qwen3.7

ID ModelKonteksMode berpikirFunction CallingTool bawaanOutput terstruktur

qwen3.7-max

Lihat Snapshot

qwen3.7-max-preview qwen3.7-max-2026-06-08 qwen3.7-max-2026-05-20 qwen3.7-max-2026-05-17

1M

Didukung

Didukung

Didukung

Didukung

Qwen3.6

Model IDKonteksMode berpikirFunction CallingTool bawaanOutput terstruktur

qwen3.6-max-preview

256k

Didukung

Didukung

Tidak didukung

Didukung

qwen3.6-plus

1M

Didukung

Didukung

Didukung

Didukung

qwen3.6-flash

Lihat Snapshot

qwen3.6-flash-2026-04-16

1M

Didukung

Didukung

Didukung

Didukung

Qwen3.5

Model ID

Konteks

Mode berpikir

Function Calling

Tool bawaan

Output terstruktur

qwen3.5-plus

1M

Didukung

Didukung

Didukung

Didukung

qwen3.5-flash

1M

Didukung

Didukung

Didukung

Didukung

qwen3.5-397b-a17b

256k

Didukung

Didukung

Didukung

Didukung

qwen3.5-122b-a10b

256k

Didukung

Didukung

Didukung

Didukung

qwen3.5-27b

256k

Didukung

Didukung

Didukung

Didukung

qwen3.5-35b-a3b

256k

Didukung

Didukung

Didukung

Didukung

Qwen3

Model IDKonteksMode berpikirFunction CallingTool bawaanOutput terstruktur

qwen3-max

Lihat Snapshot

qwen3-max-2026-01-23 qwen3-max-preview qwen3-max-2025-09-23

256k

Didukung

Didukung

Didukung

Didukung

qwen3-235b-a22b

256k

Didukung

Didukung

Tidak didukung

Didukung

qwen3-235b-a22b-thinking-2507

256k

Didukung

Didukung

Tidak didukung

Tidak didukung

qwen3-235b-a22b-instruct-2507

256k

Tidak didukung

Didukung

Tidak didukung

Didukung

qwen3-next-80b-a3b-thinking

256k

Didukung

Didukung

Tidak didukung

Tidak didukung

qwen3-next-80b-a3b-instruct

256k

Tidak didukung

Didukung

Tidak didukung

Didukung

qwen3-32b

256k

Didukung

Didukung

Tidak didukung

Didukung

qwen3-30b-a3b

256k

Didukung

Didukung

Tidak didukung

Didukung

qwen3-30b-a3b-thinking-2507

256k

Didukung

Didukung

Tidak didukung

Tidak didukung

qwen3-30b-a3b-instruct-2507

256k

Tidak didukung

Didukung

Tidak didukung

Didukung

qwen3-14b

256k

Didukung

Didukung

Tidak didukung

Didukung

qwen3-8b

256k

Didukung

Didukung

Tidak didukung

Didukung

qwen3-4b

256k

Didukung

Didukung

Tidak didukung

Didukung

qwen3-1.7b

256k

Didukung

Didukung

Tidak didukung

Didukung

qwen3-0.6b

256k

Didukung

Didukung

Tidak didukung

Didukung

Qwen3-Coder

ID ModelKonteksMode berpikirFunction CallingTool bawaanOutput terstruktur

qwen3-coder-plus

Lihat Snapshot

qwen3-coder-plus-2025-09-23 qwen3-coder-plus-2025-07-22

1M

Didukung

Didukung

Tidak didukung

Didukung

qwen3-coder-flash

Lihat Snapshot

qwen3-coder-flash-2025-07-28

1M

Didukung

Didukung

Tidak didukung

Didukung

qwen3-coder-next

256k

Didukung

Didukung

Tidak didukung

Didukung

qwen3-coder-480b-a35b-instruct

256k

Tidak didukung

Didukung

Tidak didukung

Didukung

qwen3-coder-30b-a3b-instruct

256k

Tidak didukung

Didukung

Tidak didukung

Didukung

Qwen2.5 (open source)

ID Model

Konteks

Mode berpikir

Function Calling

Tool bawaan

Output terstruktur

qwen2.5-omni-7b

1M

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

qwen2.5-vl-72b-instruct

1M

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

qwen2.5-vl-32b-instruct

1M

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

qwen2.5-vl-7b-instruct

1M

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

qwen2.5-vl-3b-instruct

1M

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

qwen2.5-72b-instruct

1M

Tidak didukung

Didukung

Tidak didukung

Didukung

qwen2.5-32b-instruct

1M

Tidak didukung

Didukung

Tidak didukung

Didukung

qwen2.5-14b-instruct

1M

Tidak didukung

Didukung

Tidak didukung

Didukung

qwen2.5-14b-instruct-1m

1M

Tidak didukung

Didukung

Tidak didukung

Didukung

qwen2.5-7b-instruct

1M

Tidak didukung

Didukung

Tidak didukung

Didukung

qwen2.5-7b-instruct-1m

1M

Tidak didukung

Didukung

Tidak didukung

Didukung

Terjemahan

ID Model

Konteks

Mode berpikir

Function Calling

Tool bawaan

Output terstruktur

qwen-mt-plus

16k

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

qwen-mt-turbo

16k

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

qwen-mt-flash

16k

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

qwen-mt-lite

16k

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

Qwen-Long

Model IDKonteksMode berpikirFunction CallingTool bawaanOutput terstruktur

qwen-long

Lihat Snapshot

qwen-long-2025-01-25

10M

Tidak didukung

Tidak didukung

Tidak didukung

Didukung

qwen-long-latest

10M

Tidak didukung

Tidak didukung

Tidak didukung

Didukung

Role-playing

Model ID

Konteks

Mode berpikir

Function Calling

Tool bawaan

Output terstruktur

qwen-plus-character

32k

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

qwen-plus-character-ja

32k

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

qwen-flash-character

8k

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

Qwen lama

ID Model

Konteks

Mode berpikir

Function Calling

Tool bawaan

Output terstruktur

qwen-plus dan snapshot-nya

1M

Didukung

Didukung

Didukung

Didukung

qwen-max dan snapshot-nya

128k

Tidak didukung

Didukung

Didukung

Didukung

qwen-flash dan snapshot-nya

1M

Didukung

Didukung

Didukung

Didukung

qwen-turbo dan snapshot-nya

1M

Didukung

Didukung

Didukung

Didukung

qwq-plus

128k

Didukung

Didukung

Tidak didukung

Tidak didukung

qvq-max dan snapshot-nya

128k

Didukung

Tidak didukung

Tidak didukung

Tidak didukung

qwen-omni-turbo dan snapshot-nya

32k

Tidak didukung

Tidak didukung

Tidak didukung

Tidak didukung

Model pihak ketiga

ID Model

Konteks

Mode berpikir

Function Calling

Tool bawaan

Output terstruktur

glm-5.1

198k

Didukung

Didukung

Tidak didukung

Didukung

glm-5

198k

Didukung

Didukung

Tidak didukung

Didukung

glm-4.7

198k

Didukung

Didukung

Tidak didukung

Didukung

glm-4.5

198k

Didukung

Didukung

Tidak didukung

Didukung

glm-4.5-air

198k

Didukung

Didukung

Tidak didukung

Didukung

MiniMax-M2.7

200k

Didukung

Didukung

Tidak didukung

Tidak didukung

MiniMax-M2.1

200k

Didukung

Didukung

Tidak didukung

Tidak didukung

kimi-k2.5

256k

Didukung

Didukung

Tidak didukung

Tidak didukung

kimi-k2-thinking

256k

Didukung

Didukung

Tidak didukung

Didukung

Moonshot-Kimi-K2-Instruct

256k

Tidak didukung

Didukung

Tidak didukung

Tidak didukung

deepseek-v3.2

128k

Didukung

Didukung

Tidak didukung

Tidak didukung

deepseek-v3.2-exp

128k

Didukung

Didukung

Tidak didukung

Tidak didukung

deepseek-v3.1

128k

Didukung

Didukung

Tidak didukung

Tidak didukung

deepseek-v3

128k

Tidak didukung

Didukung

Tidak didukung

Tidak didukung

deepseek-r1

128k

Didukung

Didukung

Tidak didukung

Tidak didukung

deepseek-r1-0528

128k

Didukung

Didukung

Tidak didukung

Tidak didukung

deepseek-r1-distill-llama-70b

128k

Didukung

Tidak didukung

Tidak didukung

Tidak didukung

deepseek-r1-distill-qwen-32b

128k

Didukung

Tidak didukung

Tidak didukung

Tidak didukung

deepseek-r1-distill-qwen-14b

128k

Didukung

Tidak didukung

Tidak didukung

Tidak didukung

deepseek-r1-distill-qwen-7b

128k

Didukung

Tidak didukung

Tidak didukung

Tidak didukung

deepseek-r1-distill-qwen-1.5b

128k

Didukung

Tidak didukung

Tidak didukung

Tidak didukung

deepseek-r1-distill-llama-8b

128k

Didukung

Tidak didukung

Tidak didukung

Tidak didukung