Alibaba Cloud Model Studio menyediakan model Qwen dan pihak ketiga untuk teks, gambar, audio, serta video.
Text generation
Image & video
Understanding
Ekstrak deskripsi teks atau data terstruktur dari gambar dan video.
Generation
Hasilkan gambar dan video dari teks atau gambar, dengan dukungan pengeditan, referensi, dan output resolusi tinggi.
Audio & speech
Text-to-speech
Untuk pembacaan buku audio, siaran suara, avatar virtual, dan lainnya.
Speech recognition
Pendekatan berbasis ASR khusus dan LLM — pilih berdasarkan akurasi dan fleksibilitas.
Speech-to-speech
Konversi suara ujung-ke-ujung tanpa panggilan ASR dan TTS terpisah.
Omni
Mengintegrasikan kemampuan pemahaman dan generasi lintas modalitas teks, gambar, audio, dan video.
Embeddings & reranking
Konversikan teks atau konten multimodal menjadi vektor, dikombinasikan dengan penyusunan ulang untuk meningkatkan akurasi pengambilan.
View all models
Buka Model Plaza untuk menjelajahi semua model Qwen, pihak ketiga, spesifik domain, dan model lawas.