ビデオ理解タスクの結果を照会します。
今すぐお試しください
テスト
RAM 認証
|
アクション |
アクセスレベル |
リソースタイプ |
条件キー |
依存アクション |
|
ice:QueryVideoCognitionJob |
get |
*All Resource
|
なし | なし |
リクエストパラメーター
|
パラメーター |
型 |
必須 / 任意 |
説明 |
例 |
| JobId |
string |
必須 |
インテリジェントタギングジョブの ID です。SubmitIntelligentTaggingJob 操作のレスポンスからこの ID を取得できます。 |
****20b48fb04483915d4f2cd8ac**** |
| Params |
string |
任意 |
追加のリクエストパラメーターを JSON 文字列として指定します。 |
{} |
| IncludeResults |
object |
任意 |
レスポンスに含めるアルゴリズム結果を決定するパラメーターのコンテナです。 |
|
| NeedAsr |
boolean |
任意 |
ASR 結果を返すかどうかを指定します。 |
true |
| NeedOcr |
boolean |
任意 |
OCR 結果を返すかどうかを指定します。 |
true |
| NeedProcess |
boolean |
任意 |
生のオペレーター結果へのリンクを返すかどうかを指定します。 |
true |
レスポンスフィールド
|
フィールド |
型 |
説明 |
例 |
|
object |
|||
| JobStatus |
string |
ジョブのステータス。有効な値は次のとおりです:
|
Success |
| RequestId |
string |
リクエスト ID です。 |
******11-DB8D-4A9A-875B-275798****** |
| UserData |
string |
ユーザーデータです。 |
{"userId":"123432412831"} |
| Results |
object |
||
| result |
array<object> |
分析結果オブジェクトの配列です。 |
|
|
object |
|||
| Type |
string |
分析結果のタイプ。有効な値は次のとおりです。
|
ASR |
| Data |
string |
分析結果のデータで、JSON 文字列形式です。データ構造は Type の値によって異なります。詳細については、「結果パラメーター」の説明をご参照ください。 |
{"title":"example-title-****"} |
| TemplateId |
string |
テンプレート ID です。 |
|
| Params |
string |
リクエストパラメーターです。 |
|
| Input |
object |
入力ファイルです。 |
|
| Type |
string |
入力ファイルのタイプ。有効な値:OSS。 |
|
| Media |
string |
入力ファイルの URL です。 |
結果パラメーター
VideoLabel データ構造
| パラメーター | タイプ | 説明 |
| persons | JSONArray | 検出された人物のリストです。 |
| persons.name | String | 認識された人物の名前です。 |
| persons.category | String | 人物のカテゴリです。指定可能な値は、celebrity (有名人)、politician (政治家)、sensitive (センシティブ)、unknown (不明) です。カスタム人物ライブラリから認識された場合は、このフィールドにライブラリの ID が返されます。 |
| persons.ratio | double | 人物の出現率で、範囲は 0 から 1 です。 |
| persons.occurrences | JSONArray | 人物の出現箇所のリストです。 |
| persons.occurrences.score | double | 信頼度スコアです。 |
| persons.occurrences.from | double | 人物の出現開始時刻 (秒) です。 |
| persons.occurrences.to | double | 人物の出現終了時刻 (秒) です。 |
| persons.occurrences.position | JSONObject | 顔の座標です。 |
| persons.occurrences.position.leftTop | int[] | 左上隅の x 座標と y 座標です。 |
| persons.occurrences.position.rightBottom | int[] | 右下隅の x 座標と y 座標です。 |
| persons.occurrences.timestamp | double | 顔座標のタイムスタンプ (秒) です。 |
| persons.occurrences.scene | String | カメラショットタイプです。指定可能な値は、closeUp (クローズアップ)、medium-closeUp (ミディアムクローズアップ)、medium (ミディアムショット)、medium-long (ミディアムロングショット) です。 |
| tags | JSONArray | オブジェクトやシーンなど、検出された要素のタグのリストです。 |
| tags.mainTagName | String | メインタグです。 |
| tags.subTagName | String | サブタグです。 |
| tags.ratio | double | タグの出現率で、範囲は 0 から 1 です。 |
| tags.occurrences | JSONArray | タグの出現箇所のリストです。 |
| tags.occurrences.score | double | 信頼度スコアです。 |
| tags.occurrences.from | double | 出現開始時刻 (秒) です。 |
| tags.occurrences.to | double | 出現終了時刻 (秒) です。 |
| classifications | JSONArray | ビデオ分類のリストです。 |
| classifications.score | double | 分類の信頼度スコアです。 |
| classifications.category1 | String | プライマリカテゴリです。例:Lifestyle、Animation、Automotive。 |
| classifications.category2 | String | セカンダリカテゴリです。例えば、プライマリカテゴリが Lifestyle のビデオは、セカンダリカテゴリとして Health や Home を持つことがあります。 |
ビデオタグの例
| カテゴリ | 例 |
| program | 例:The Amazing Race、America's Got Talent |
| role | 例:医師、看護師、教師 |
| object | 例:ピアノ、カップ、テーブル、車、化粧品、食品 |
| logo | 例:CNN、BBC、YouTube、Netflix |
| action | 例:ダンス、キス、ハグ、会議、歌唱、電話、乗馬、格闘 |
| location | 例:天安門広場、自由の女神、楽山大仏、中国、米国 |
| scene | 例:寝室、地下鉄駅、棚田、ビーチ、砂漠 |
ImageLabel データ構造
| パラメーター | タイプ | 説明 |
| persons | JSONArray | 検出された人物です。 |
| persons.name | String | 認識された人物の名前です。 |
| persons.category | String | 人物カテゴリです。有効な値は、celebrity (有名人)、politician (政治家)、sensitive person (センシティブな人物) です。 |
| persons.score | double | 人物認識の信頼度スコアです。 |
| persons.position | JSONObject | 検出された人物のバウンディングボックスです。 |
| persons.position.leftTop | int[] | バウンディングボックスの左上隅の x 座標と y 座標です。 |
| persons.position.rightBottom | int[] | バウンディングボックスの右下隅の x 座標と y 座標です。 |
| persons.scene | String | ショットタイプです。有効な値は、closeUp (クローズアップ)、medium-closeUp (ミディアムクローズアップ)、medium (ミディアムショット)、medium-long (ロングショット) です。 |
| tags | JSONArray | オブジェクトやシーンなどの要素に対して検出されたタグです。例については、以下の表をご参照ください。 |
| tags.mainTagName | String | メインタグです。 |
| tags.subTagName | String | サブタグです。 |
| tags.score | double | 信頼度スコアです。 |
イメージタグの例
| メインタグ名 | サブタグ名 |
| character | 医師、看護師、教師など |
| location | 天安門広場、自由の女神、楽山大仏、中国、米国など |
| action event | スピーチなど |
| logo | CCTV-1、CCTV-2、Youku、Dragon TV など |
| action event | ダンス、キス、ハグ、会議、歌唱、電話、乗馬、格闘など |
| object | ピアノ、カップ、テーブル、トマトと卵の炒め物、車、化粧品など |
| scene | 寝室、地下鉄駅、棚田、ビーチ、砂漠など |
TextLabel データ構造 (ASR および OCR の出力)
| パラメーター | タイプ | 説明 |
| tags | JSONArray | タグの配列です。 |
| tags.name | String | タグキーです。 |
| tags.value | String | タグ値です。複数の値はカンマ (,) で区切ります。 |
イメージ タグの例
| パラメーター | 値 |
| region | 例:us-east-1、eu-west-2、ap-southeast-1 |
| organization | 例:マーケティング部、開発チーム、Acme 社 |
| identifier | 例:user-12345、prod-db-01、f7b4c278-6e54-4a8f-8f9d-3e58a9c8b4e7 |
| keyword | 例:データベース、課金、エラー |
CPVLabel データ構造
cates:カテゴリ (プライマリ、セカンダリ、またはターシャリ) のリストです。entities:知識グラフからの情報を含むカテゴリ属性のリストです。hotwords:人気のある用語のリストです。freeTags:フリータグ (キーワード) のリストです。
| パラメーター | タイプ | 値の例 | 説明 |
| type | String | hmi | 結果タイプです。有効な値は、hmi (人間と機械の共同作業結果) と autp (自動タグ付け結果) です。 |
| cates | JSONArray | - | 分類結果の配列です。 |
| cates.labelLevel1 | String | Travel | レベル 1 タグです。 |
| cates.labelLevel2 | String | Scenic Travel | レベル 2 タグです。 |
| cates.label | String | "" | タグ名です。アルゴリズムが値を返さない場合、このフィールドは空になることがあります。 |
| cates.appearanceProbability | double | 0.96 | 出現確率です。 |
| cates.detailInfo | JSONArray | - | カテゴリの各出現箇所を詳述するオブジェクトの配列です。 |
| cates.detailInfo.score | double | 0.9 | 信頼度スコアです。 |
| cates.detailInfo.startTime | double | 0.021 | 開始時刻です。 |
| cates.detailInfo.endTime | double | 29.021 | 終了時刻です。 |
| entities | JSONArray | - | 検出されたエンティティの配列です。 |
| entities.labelLevel1 | String | location | レベル 1 タグです。 |
| entities.labelLevel2 | String | landmark | レベル 2 タグです。 |
| entities.label | String | 黄果樹の滝 | タグ名です。 |
| entities.appearanceProbability | double | 0.067 | 出現確率です。 |
| entities.knowledgeInfo | String | {"name": "黄果樹の滝", "nameEn": "Huangguoshu Waterfall", "description": "アジア四大瀑布の一つ"} | 知識グラフ情報です。フィールドの完全なリストについては、エンターテイメント IP、音楽、人物、ランドマーク、オブジェクトに対応する表をご参照ください。 |
| entities.detailInfo | JSONArray | - | エンティティの各出現箇所を詳述するオブジェクトの配列です。 |
| entities.detailInfo.score | double | 0.33292606472969055 | 信頼度スコアです。 |
| entities.detailInfo.startTime | double | 6.021 | 開始時刻です。 |
| entities.detailInfo.endTime | double | 8.021 | 終了時刻です。 |
| entities.detailInfo.trackData | JSONArray | - | エンティティの構造化された追跡データを含むオブジェクトの配列です。 |
| entities.detailInfo.trackData.score | double | 0.32 | 信頼度スコアです。 |
| entities.detailInfo.trackData.bbox | integer[] | 23, 43, 45, 67 | バウンディングボックスです。 |
| entities.detailInfo.trackData.timestamp | double | 7.9 | タイムスタンプです。 |
| hotwords | JSONArray | - | 検出されたホットワードの配列です。 |
| hotwords.labelLevel1 | String | keyword | レベル 1 タグです。 |
| hotwords.labelLevel1 | String | keyword | レベル 1 タグです。 |
| hotwords.labelLevel2 | String | "" | レベル 2 タグです。 |
| hotwords.label | String | 中国気象局 | ホットワードです。 |
| hotwords.appearanceProbability | double | 0.96 | 出現確率です。 |
| hotwords.detailInfo | JSONArray | ホットワードの各出現箇所を詳述するオブジェクトの配列です。 | |
| hotwords.detailInfo.score | double | 1.0 | 信頼度スコアです。 |
| hotwords.detailInfo.startTime | double | 0.021 | 開始時刻です。 |
| hotwords.detailInfo.endTime | double | 29.021 | 終了時刻です。 |
| freeTags | JSONArray | 検出されたフリータグの配列です。 | |
| freeTags.labelLevel1 | String | keyword | レベル 1 タグです。 |
| freeTags.labelLevel2 | String | "" | レベル 2 タグです。 |
| freeTags.label | String | 国家気象センター | タグ名です。 |
| freeTags.appearanceProbability | double | 0.96 | 出現確率です。 |
| freeTags.detailInfo | JSONArray | フリータグの各出現箇所を詳述するオブジェクトの配列です。 | |
| freeTags.detailInfo.score | double | 0.9 | 信頼度スコアです。 |
| freeTags.detailInfo.startTime | double | 0.021 | 開始時刻です。 |
| freeTags.detailInfo.endTime | double | 29.021 | 終了時刻です。 |
自動音声認識 (ASR) 結果
| パラメーター | タイプ | 説明 |
| details | JSONArray | タスクの詳細な結果です。 |
| details.from | double | 開始タイムスタンプ (秒) です。 |
| details.to | double | 終了タイムスタンプ (秒) です。 |
| details.content | String | 認識されたテキストです。 |
文字認識 (OCR) の結果
| パラメーター | タイプ | 説明 |
| details | JSONArray | 詳細なタスク結果です。 |
| details.timestamp | double | タイムスタンプ (秒) です。 |
| details.info | JSONArray | 対応するタイムスタンプの認識結果の配列です。 |
| details.info.score | double | 認識の信頼度スコアです。 |
| details.info.position | JSONObject | 認識されたテキストの座標です。 |
| details.info.position.leftTop | int[] | 左上隅の x 座標と y 座標です。 |
| details.info.position.rightBottom | int[] | 右下隅の x 座標と y 座標です。 |
| details.info.content | String | 認識されたテキストです。 |
メタデータアノテーションの結果
お客様が SubmitSmarttagJob の呼び出しで手動ラベリングを使用せずに needMetaData を指定した場合、QuerySmarttagJob は元のタイトルを返します。
| パラメーター | タイプ | 説明 |
| title | String | タイトルです。 |
サブタイトル
| パラメーター | タイプ | 説明 |
| details | JSONArray | 詳細なタスク結果です。 |
| details.allResultUrl | String | すべての字幕結果の URL です。URL はタスク完了後 6 か月間有効です。 |
| details.chResultUrl | String | 中国語字幕結果の URL です。URL はタスク完了後 6 か月間有効です。 |
| details.engResultUrl | String | 英語字幕結果の URL です。URL はタスク完了後 6 か月間有効です。 |
字幕結果 URL のコンテンツは、次のフォーマットを使用します: シーケンス番号+期間+字幕コンテンツ (1行に1つの字幕)。
NLP 結果
| パラメーター | タイプ | 説明 |
| transcription | object | 生成された文字起こしです。 |
| autoChapters | object | 生成されたチャプター概要です。 |
| summarization | object | 生成された大規模モデルの要約です。 |
| meetingAssistance | object | 生成されたインテリジェントな議事録です。 |
| translation | object | 生成されたテキスト翻訳です。 |
文字起こし
| パラメーター | タイプ | 説明 |
| transcription | object | transcription 結果オブジェクトです。 |
| transcription.paragraphs | list[] | 文字起こしを構成する paragraph オブジェクトのリストです。 |
| transcription.paragraphs[i].paragraphId | string | paragraph の ID です。 |
| transcription.paragraphs[i].speakerId | string | speaker の ID です。 |
| transcription.paragraphs[i].words | list[] | paragraph 内の word オブジェクトのリストです。 |
| transcription.paragraphs[i].words[i].id | int | word のシーケンス番号です。このフィールドは通常無視できます。 |
| transcription.paragraphs[i].words[i].sentenceId | int | sentence の ID です。同じ sentenceId を持つ単語が文を形成します。 |
| transcription.paragraphs[i].words[i].start | long | word の開始時刻で、ミリ秒単位の相対タイムスタンプです。 |
| transcription.paragraphs[i].words[i].end | long | word の終了時刻で、ミリ秒単位の相対タイムスタンプです。 |
| transcription.paragraphs[i].words[i].text | string | word のテキストです。 |
要約 (全文・話者ベース・質問ベース)
| パラメーター | タイプ | 説明 |
| summarization | object | 要約結果オブジェクトです。0 個以上の要約タイプの結果を含みます。 |
| summarization.paragraphSummary | string | 全文要約です。 |
| summarization.conversationalSummary | list[] | 会話要約のリストです。 |
| summarization.conversationalSummary[i].speakerId | string | 話者 ID です。 |
| summarization.conversationalSummary[i].speakerName | string | 話者名です。 |
| summarization.conversationalSummary[i].summary | string | この話者の要約です。 |
| summarization.questionsAnsweringSummary | list[] | Q&A 要約のリストです。 |
| summarization.questionsAnsweringSummary[i].question | string | 質問です。 |
| summarization.questionsAnsweringSummary[i].sentenceIdsOfQuestion | list[] | 質問に対応する元の文字起こしからの SentenceId 値のリストです。 |
| summarization.questionsAnsweringSummary[i].answer | string | 質問への回答です。 |
| summarization.questionsAnsweringSummary[i].sentenceIdsOfAnswer | list[] | 回答に対応する元の文字起こしからの SentenceId 値のリストです。 |
| summarization.mindMapSummary | list[object] | トピック階層を表すマインドマップ要約のリストです。 |
| summarization.mindMapSummary[i].title | string | マインドマップのタイトルです。 |
| summarization.mindMapSummary[i].topic | list[object] | トップレベルのトピックの配列で、各トピックはサブトピックを含むことができます。 |
| summarization.mindMapSummary[i].topic[i].title | string | トピックのタイトルです。 |
| summarization.mindMapSummary[i].topic[i].topic | list[object] | 親トピックのサブトピックの配列です。この配列は空の場合があります。 |
翻訳
| パラメーター | タイプ | 説明 |
| translation | object | 翻訳結果オブジェクトです。 |
| translation.paragraphs | list[] | 音声認識結果に対応する翻訳された段落のリストです。 |
| translation.paragraphs.paragraphId | string | 段落 ID で、音声認識結果の ParagraphId に対応します。 |
| translation.paragraphs.sentences | list[] | 文オブジェクトのリストです。 |
| translation.paragraphs.sentences[i].sentenceId | long | 文 ID です。 |
| translation.paragraphs.sentences[i].start | long | 音声の先頭からの相対的な文の開始時刻 (ミリ秒) です。 |
| translation.paragraphs.sentences[i].end | long | 音声の先頭からの相対的な文の終了時刻 (ミリ秒) です。 |
| translation.paragraphs.sentences[i].text | string | 翻訳されたテキストで、音声認識結果の文テキストに対応します。 |
自動チャプター
| パラメーター | タイプ | 説明 |
| autoChapters | list[] | チャプター概要オブジェクトのリストです。 |
| autoChapters[i].id | int | チャプター ID です。 |
| autoChapters[i].start | long | 音声の先頭からの相対タイムスタンプとしてのチャプターの開始時刻 (ミリ秒) です。 |
| autoChapters[i].end | long | 音声の先頭からの相対タイムスタンプとしてのチャプターの終了時刻 (ミリ秒) です。 |
| autoChapters[i].headline | string | チャプターの見出しです。 |
| autoChapters[i].summary | string | チャプターの要約です。 |
meetingAssistance (インテリジェントな会議要約抽出: キーワード、キーセンテンス、アクションアイテム)
| パラメーター | タイプ | 説明 |
| meetingAssistance | object | 会議支援結果のコンテナです。このオブジェクトは複数の結果タイプを保持することも、空にすることもできます。 |
| meetingAssistance.keywords | list[] | キーワード抽出結果です。 |
| meetingAssistance.keySentences | list[] | キーセンテンス抽出結果で、主要コンテンツとも呼ばれます。 |
| meetingAssistance.keySentences[i].id | long | キーセンテンスの ID です。 |
| meetingAssistance.keySentences[i].sentenceId | long | 元の ASR 文字起こしにおける対応する文の ID です。 |
| meetingAssistance.keySentences[i].start | long | 音声の先頭からの相対的な開始時刻 (ミリ秒) です。 |
| meetingAssistance.keySentences[i].end | long | 音声の先頭からの相対的な終了時刻 (ミリ秒) です。 |
| meetingAssistance.keySentences[i].text | string | キーセンテンスのテキストです。 |
| meetingAssistance.actions | list[] | アクションアイテムとアクションアイテム要約のリストです。 |
| meetingAssistance.actions[i].id | long | アクションアイテムの ID です。 |
| meetingAssistance.actions[i].sentenceId | long | 元の ASR 文字起こしにおける対応する文の ID です。 |
| meetingAssistance.actions[i].start | long | 音声の先頭からの相対的な開始時刻 (ミリ秒) です。 |
| meetingAssistance.actions[i].end | long | 音声の先頭からの相対的な終了時刻 (ミリ秒) です。 |
| meetingAssistance.actions[i].text | string | アクションアイテムのテキストです。 |
| meetingAssistance.classifications | object | シーン分類結果です。現在、3 つのシーンクラスがサポートされています。 |
| meetingAssistance.classifications.interview | float | インタビュークラスの信頼度スコアです。 |
| meetingAssistance.classifications.lecture | float | 講義クラスの信頼度スコアです。 |
| meetingAssistance.classifications.meeting | float | 会議クラスの信頼度スコアです。 |
例
成功レスポンス
JSONJSON
{
"JobStatus": "Success",
"RequestId": "******11-DB8D-4A9A-875B-275798******\n",
"UserData": "{\"userId\":\"123432412831\"}\n",
"Results": {
"result": [
{
"Type": "ASR",
"Data": "{\"title\":\"example-title-****\"}\t\n"
}
]
},
"TemplateId": "",
"Params": "",
"Input": {
"Type": "",
"Media": ""
}
}
エラーコード
完全なリストについては、「エラーコード」をご参照ください。
変更履歴
完全なリストについては、「変更履歴」をご参照ください。