選擇適合映像分析、視頻理解、OCR等情境的模型。
從閉源模型遷移到百鍊?
如果你正在使用 GPT、Claude 或 Gemini,可參考下表按能力檔位選擇對應的百鍊模型。
能力檔位 | 閉源模型代表 | 百鍊推薦 |
|---|---|---|
高能力 | GPT-5.5、Claude Opus 4.7、Gemini 3.1 Pro |
|
平衡 | GPT-5.4、Claude Sonnet 4.6、Gemini 3 Pro |
|
輕量低成本 | GPT-5.4-mini、Gemini 3.1 Flash |
|
映像與視頻理解
推薦從qwen3.7-plus開始,它是千問旗艦模型,支援1M上下文、最長2小時視頻、Function Calling和內建工具等完整功能。當您的情境穩定後,可以嘗試qwen3.8-flash來降低成本,它提供接近旗艦的效果,並支援相同的上下文長度和功能集。
映像解析度
大多數模型支援每張圖片最高1600萬像素。更高的解析度會消耗更多Token:每張圖片的Token數計算公式為 h x w / (32 x 32) + 2。
視頻支援
- 最長2小時 / 2GB:
qwen3.8-max、qwen3.8-flash、qwen3.7-plus、qwen3.6-plus、qwen3.7-flash、qwen3.6-flash、qwen3.5-plus、qwen3.5-flash - 最長1小時 / 2GB:
qwen3-vl-plus、qwen3-vl-flash - 最長1小時 / 2GB:
qwen3.5-omni-plus、qwen3.5-omni-flash(同時支援音頻輸入)
Function Calling與內建工具
讓模型根據映像或視頻中的內容執行操作。
- Function Calling:Qwen3.8、Qwen3.7、Qwen3.6、Qwen3.5和Qwen3-VL系列模型均支援
- 內建工具(連網搜尋、代碼執行,無需額外配置):僅
qwen3.7-max-2026-06-08、qwen3.7-plus、qwen3.6-plus、qwen3.7-flash、qwen3.6-flash、qwen3.5-plus、qwen3.5-flash
結構化輸出
從視覺輸入中擷取有效JSON輸出,例如從照片中提取商品資訊。
Qwen3.8、Qwen3.7、Qwen3.6、Qwen3.5和Qwen3-VL系列支援此功能。
OCR與文檔提取
qwen3.5-ocr專為文檔、表格、試卷和手寫內容的文字提取而最佳化。您也可以使用qwen3.7-plus或qwen3.7-flash進行通用圖片文字提取。
推薦模型
模型 ID(Model ID) | 上下文 | 最大像素/圖 | 最大視頻時間長度 | 最大視頻大小 | 最大圖片數 | 最大視頻數 | Function Calling | 內建工具 | 結構化輸出 |
|---|---|---|---|---|---|---|---|---|---|
| 1M | 16M | 2小時 | 2GB | 2048 | 64 | 支援 | 支援 | 支援 |
| 1M | 16M | 2小時 | 2GB | 2048 | 64 | 支援 | 支援 | 支援 |
| 1M | 16M | 2小時 | 2GB | 2048 | 64 | 支援 | 支援 | 支援 |
| 1M | 16M | 2小時 | 2GB | 256 | 64 | 支援 | 支援 | 支援 |
| 64k | -- | 1小時 | 2GB | 2,048 | 512 | 支援 | -- | 支援 |
Qwen3.7
模型 ID(Model ID) | 輸入 | 輸出 | 上下文 | 最大輸出 | 最大圖片數 | 最大視頻數 | Function Calling | 內建工具 | 結構化輸出 |
|---|---|---|---|---|---|---|---|---|---|
| 文本、映像、視頻 | 文本 | 1M | 64k | 2048 | 64 | 支援 | 支援 | -- |
| 文本、映像、視頻 | 文本 | 1M | 64k | 2048 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 1M | 64k | 2048 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 1M | 64k | 256 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 1M | 64k | 256 | 64 | 支援 | 支援 | 支援 |
Qwen3.6
模型 ID(Model ID) | 輸入 | 輸出 | 上下文 | 最大輸出 | 最大圖片數 | 最大視頻數 | Function Calling | 內建工具 | 結構化輸出 |
|---|---|---|---|---|---|---|---|---|---|
| 文本、映像、視頻 | 文本 | 1M | 64k | 256 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 1M | 64k | 256 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 1M | 64k | 256 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 1M | 64k | 256 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 256k | 64k | 256 | 64 | 支援 | 支援 | 支援 |
舊版模型
Qwen3.5
模型 ID(Model ID) | 輸入 | 輸出 | 上下文 | 最大輸出 | 最大圖片數 | 最大視頻數 | Function Calling | 內建工具 | 結構化輸出 |
|---|---|---|---|---|---|---|---|---|---|
| 文本、映像、視頻 | 文本 | 1M | 64k | 256 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 1M | 64k | 256 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 1M | 64k | 256 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 1M | 64k | 256 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 32k | 8k | 256 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 32k | 8k | 256 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 32k | 8k | 256 | 64 | 支援 | 支援 | 支援 |
| 文本、映像、視頻 | 文本 | 32k | 8k | 256 | 64 | 支援 | 支援 | 支援 |
舊版及其他模型
以下模型不再作為首選推薦。新專案提案使用Qwen3.6或Qwen3.5系列。如需查看模型詳細參數,請前往模型廣場。
華北2(北京) | 新加坡 | 美國 | 中國香港 | 法蘭克福
查看舊版及其他模型列表
Qwen3-VL
qwen3-vl-plus及其快照版本qwen3-vl-flash及其快照版本
Qwen-Omni
qwen3-omni-flash及其快照版本qwen-omni-turbo及其快照版本
Qwen-OCR
qwen-vl-ocr及其快照版本qwen-vl-ocr-latest
QVQ
qvq-maxqvq-plus
舊版Qwen-VL
qwen-vl-maxqwen-vl-plus