Qwen-VL_OCR は、Qwen-VL をベースにトレーニングされた OCR モデルです。統一されたモデルアプローチを通じて、さまざまな画像テキスト認識、解析、処理タスクを集約し、強力な画像テキスト認識機能を提供します。このモデルバージョンは、スナップショットモデル qwen-vl-ocr-2025-11-20 と機能的に同等です。
推論サービスプロバイダー
qwen-vl-ocr の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト イメージ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート済み | ファインチューニング | サポート対象外 |
シンガポール
スコープ: 国際
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト イメージ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
ドイツ (フランクフルト)
スコープ: グローバル
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト イメージ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
米国 (バージニア)
スコープ: グローバル
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト イメージ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 30000 | 最大出力長 | 8192 |
コンテキストウィンドウ | 38192 |
料金
このページでは、モデル API 呼び出しの元の料金のみを表示しており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールにアクセスしてください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.043 | 100 万トークンあたり |
出力 | 0.072 | 100 万トークンあたり |
入力 (バッチファイル) | 0.022 | 100 万トークンあたり |
出力 (バッチファイル) | 0.036 | 100 万トークンあたり |
シンガポール
スコープ: 国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.07 | 100 万トークンあたり |
出力 | 0.16 | 100 万トークンあたり |
ドイツ (フランクフルト)
スコープ: グローバル
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.043 | 100 万トークンあたり |
出力 | 0.072 | 100 万トークンあたり |
米国 (バージニア)
スコープ: グローバル
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.043 | 100 万トークンあたり |
出力 | 0.072 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 6,000,000 |
シンガポール
スコープ: 国際
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 6,000,000 |
ドイツ (フランクフルト)
スコープ: グローバル
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 6,000,000 |
米国 (バージニア)
スコープ: グローバル
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 60 |
TPM (1 分あたりのトークン数) | 100,000 |
動的更新
qwen-vl-ocr-latest
VL-OCR(qwen-vl-ocr), Qwen-VLOCR., , , .
推論サービスプロバイダー
qwen-vl-ocr-latest の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト イメージ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート済み | ファインチューニング | サポート対象外 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 30000 | 最大出力長 | 8192 |
コンテキストウィンドウ | 38192 |
料金
このページでは、モデル API 呼び出しの元の料金のみを表示しており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールにアクセスしてください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.043 | 100 万トークンあたり |
出力 | 0.072 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 6000 |
TPM (1 分あたりのトークン数) | 30,000,000 |
スナップショットバージョン
qwen-vl-ocr-2025-11-20
このモデルは 2025年11月20日時点のスナップショットバージョンであり、最新の Qwen-VL3 アーキテクチャに基づいて包括的にアップグレードされています。ドキュメント解析とテキストのローカライズ機能が大幅に改善され、エンドツーエンドレイテンシとハルシネーションも大幅に削減されています。
推論サービスプロバイダー
qwen-vl-ocr-2025-11-20 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト イメージ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
シンガポール
スコープ: 国際
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | 画像 | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
ドイツ (フランクフルト)
スコープ: グローバル
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | 画像 | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
米国 (バージニア)
スコープ: グローバル
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | 画像 | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 30000 | 最大出力長 | 8192 |
コンテキストウィンドウ | 38192 |
料金
このページでは、モデル API 呼び出しの元の料金のみを表示しており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールにアクセスしてください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.043 | 100 万トークンあたり |
出力 | 0.072 | 100 万トークンあたり |
シンガポール
スコープ: 国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.07 | 100 万トークンあたり |
出力 | 0.16 | 100 万トークンあたり |
ドイツ (フランクフルト)
スコープ: グローバル
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.043 | 100 万トークンあたり |
出力 | 0.072 | 100 万トークンあたり |
米国 (バージニア)
スコープ: グローバル
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.043 | 100 万トークンあたり |
出力 | 0.072 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 6000 |
TPM (1 分あたりのトークン数) | 30,000,000 |
シンガポール
スコープ: 国際
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 1200 |
TPM (1 分あたりのトークン数) | 6,000,000 |
ドイツ (フランクフルト)
スコープ: グローバル
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 1200 |
TPM (1 分あたりのトークン数) | 6,000,000 |
米国 (バージニア)
スコープ: グローバル
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 60 |
TPM (1 分あたりのトークン数) | 100,000 |
qwen-vl-ocr-2025-04-13
VL-OCR(qwen-vl-ocr-2025-04-13), Qwen-VLOCR., , , .:, , , , , .20250413.
推論サービスプロバイダー
qwen-vl-ocr-2025-04-13 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト イメージ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 30000 | 最大出力長 | 4096 |
コンテキストウィンドウ | 34096 |
料金
このページでは、モデル API 呼び出しの元の料金のみを表示しており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールにアクセスしてください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.717 | 100 万トークンあたり |
出力 | 0.717 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 6,000,000 |
qwen-vl-ocr-1028
VL-OCR(qwen-vl-ocr)、Qwen-VLOCR。、、、。20241028。
推論サービスプロバイダー
qwen-vl-ocr-1028 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト イメージ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 30000 | 最大出力長 | 4096 |
コンテキストウィンドウ | 34096 |
料金
このページでは、モデル API 呼び出しの元の料金のみを表示しており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールにアクセスしてください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.717 | 100 万トークンあたり |
出力 | 0.717 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 6,000,000 |