全部產品
Search
文件中心

OpenSearch:服務概覽及體驗

更新時間:Jul 10, 2026

服務廣場匯聚了 AI 搜尋開放平台的全量服務,支援免登入直接查閱詳情。您可以通過體驗中心可視化試用文檔解析、多模態向量/排序、主體識別、文本向量及視頻解析等核心能力,快速驗證服務與業務需求的匹配度。

服務概覽

智能體搜尋服務

文本/文檔處理服務

服務類別

服務說明

Jina AI Reader

一款專為大語言模型設計的網頁內容提取服務,它能將任意URL轉換為LLM友好的純文字格式,自動去除廣告、導航等幹擾資訊,精準提取網頁核心內容。

文檔內容解析

  • 文檔內容解析服務001:通用文檔解析服務,支援從非結構化文檔(文本、表格、圖片等)中提取標題、分段等邏輯層級結構,以結構化格式輸出。

  • 文檔內容解析服務002:提供pdf、圖片等多種非結構化文檔格式的解析,對複雜元素(表格、公式和圖表等)的識別方面出色,且具備較快的推理速度。

文本向量化

  • OpenSearch文本向量化服務-001:提供多語言(40+)文本向量化服務,輸入文本最大長度300 token,輸出向量維度1536維。

  • OpenSearch通用文本向量化服務-002:提供多語言(100+)文本向量化服務,輸入文本最大長度8192 token,輸出向量維度1024維。

  • OpenSearch文本向量化服務-中文-001:提供中文文本向量化服務,輸入文本最大長度1024 token,輸出向量維度768維。

  • OpenSearch文本向量化服務-英文-001:提供英文文本向量化服務,輸入文本最大長度512 token,輸出向量維度768維。

  • GTE文本向量-多語言-Base:多語言(70+)文本向量化服務,輸入文本最大長度8192,輸出向量維度768維。

  • Qwen3文本向量-0.6B:Qwen3系列多語言(100+)文本向量化服務,輸入最大長度32k,輸出向量維度1024維,參數量0.6B。

  • 文本向量-ops-dmeta-text-embedding-zh:專為中文最佳化的文本向量化模型,能夠將中文文本轉化為高品質的語義向量,適用於語義檢索、文本相似性計算等任務。

文本稀疏向量化

OpenSearch文本稀疏向量化服務:將文本轉化為稀疏向量表達,稀疏向量儲存空間更小,常用於表達關鍵詞和詞頻資訊,可與稠密向量搭配進行混合檢索以提升檢索效果。支援多語言(100+),輸入文本最大長度8192 token。

文檔切片

提供通用文本切片服務,支援基於文檔段落、文本語義、指定規則,對HTML、Markdown、TXT格式的結構化資料進行拆分,同時支援以富文本形式提取文檔中的代碼、圖片以及表格。

向量降維

向量降維embedding-dim-reduction:提供向量模型調優服務,可通過定製訓練將高維度向量降低維度,在不顯著影響檢索效果的前提下降低儲存成本,提升性價比。

多模態處理服務

服務類別

服務說明

多模態向量

  • M2-Encoder-多模態向量模型:中英雙語多模態服務,基於60億圖文對資料(其中30億為中文資料,30億為英文資料)在BM-6B基礎上訓練而成。該模型支援圖文跨模態檢索(包括文本搜尋圖片和圖片搜尋文本),以及圖片分類任務。

  • M2-Encoder-Large-多模態向量模型:與M2-Encoder同架構,參數量提升至1B(10億參數),在多模態任務中具備更強的表達能力和效能表現。

  • GME多模態向量-Qwen2-VL-2B:基於 Qwen2-VL 多模態大型語言模型(MLLMs) 訓練的多模態向量服務,支援單一模態及多模態組合輸入,能夠高效處理文本、映像及組合類別型的資料。

  • 多模態向量-ops-mm-embedding-v1-2b:阿里雲OpenSearch-AI團隊開發,基於Qwen2-VL 2B Instruct微調,支援文本、映像、視頻等單模態及多模態組合輸入,適用於跨模態檢索與理解任務。

  • 多模態向量-ops-mm-embedding-v1-7b:與2B版本能力相同,基於Qwen2-VL 7B Instruct微調,參數量更大,模型表達能力更強。

  • 電商多模態向量-ops-mm-embedding-ecom-001:由阿里雲 OpenSearch-AI 團隊自研的電商領域定製多模態向量模型,支援圖搜圖、圖搜圖文兩種多模態搜尋方式,適用於電商情境跨模態檢索與理解任務。

  • 人臉多模態向量-ops-mm-embedding-face-001:面向人臉檢索任務,通過先進的人臉向量模型,支援單張或多張映像輸入,將人臉資訊統一編碼為高維語義向量,助力高效精準的人臉搜尋與比對。

多模態排序

提供映像的相關性排序服務,可在RAG及多模態搜尋情境中按相關性對檢索結果重新排序,有效提升檢索及大模型產生的準確率。

視頻總結

提供視頻總結服務,對指定視頻片段進行理解,利用大模型能力產生視頻總結、標題與標籤。

視頻切割

提供視頻切割服務,對視頻進行理解和分析,提取主要畫面格並將視頻切割為相應段落。

視頻截幀

視頻截幀服務001:提供視頻內容提取能力,可從視頻中捕獲主要畫面格畫面。結合多模態向量服務或圖片解析能力,實現跨模態檢索。

語音辨識

語音辨識服務001:提供語音轉文本能力,可將視頻或音頻中的語音內容快速轉化為結構化文本。該服務支援多種語言。

主體識別

  • 主體識別服務-ops-object-detect-001:從映像或視頻中自動定位並識別主要目標或對象,支援單個及多個主體的識別,適用於智能監控、自動駕駛、映像檢索等應用。

  • Face Service服務-ops-object-detect-face-001:從映像中自動定位並識別人臉,支援多個人臉的識別,適用於智能監控、映像檢索等應用。

  • 服飾主體識別001-ops-object-detect-fashion-001:服飾類目主體識別模型,由阿里雲OpenSearch團隊自研,支援20多類服飾相關主體識別,輸出主體類別、位置框及置信分。可用於複雜情境中主體提取,作為下遊任務的輸入,可排除圖片背景或其他主體對下遊embedding和rerank模型的幹擾。

圖片內容解析

圖片內容理解服務:基於多模態大模型對圖片內容進行解析理解以及文字識別,解析後的文本可用於圖片檢索、問答情境。

圖片文本識別服務:OCR圖片文本識別,識別後的文本可用於圖片檢索問答情境。

功能介紹

體驗中心提供以下服務:

服務大類

服務類別

服務說明

智能體搜尋服務

智能體記憶

為Agentic AI智能體與智能搜尋服務提供長期/短期/上下文記憶儲存與檢索服務,支援個人化記憶memory,Agent智能體記憶,搜尋記憶和技能Skill管理服務等多種搜尋資料的儲存、查詢、更新和遺忘操作,採用BM25和向量檢索結合的融合檢索與多路召回技術,確保高效準確召回的智能記憶檢索服務。

Agentic Memory智能體記憶服務:提供Memory和Skill兩類資料的儲存與管理:Memory儲存使用者個人愛好、興趣、偏好等資訊;Skill儲存可複用的執行邏輯和技能。

大模型

  • Qwen3-235B-A22B:新一代Qwen系列大型語言模型,基於廣泛的訓練,Qwen3在推理、指令跟隨、Agent能力和多語言支援方面取得了突破性進展,可支援100多種語言和方言,具備強大的多語言理解、推理和產生能力。

  • OpenSearch-千問-Turbo:以qwen-turbo大規模語言模型為模型底座,進行有監督的模型微調,強化檢索增強,減少有害性。

  • 千問-Turbo:千問系列速度最快、成本極低的模型,適合簡單任務,詳情請參見選擇模型

  • 千問-Plus:能力均衡,推理效果、成本和速度介於千問-Max和千問-Turbo之間,適合中等複雜任務,詳情請參見選擇模型

  • 千問-Max:千問系列效果最好的模型,適合複雜、多步驟的任務,詳情請參見選擇模型

  • DeepSeek-R1:專註於複雜推理任務的大語言模型,在複雜指令理解、結果準確性等方面表現較突出。

  • DeepSeek-V3:MoE模型,在長文本、代碼、數學、百科、中文能力上表現優秀。

  • DeepSeek-R1-distill-qwen-7b:基於知識蒸餾技術,通過使用DeepSeek-R1產生的訓練樣本對Qwen-7B微調訓練的模型。

  • DeepSeek-R1-distill-qwen-14b:基於知識蒸餾技術,通過使用DeepSeek-R1產生的訓練樣本對Qwen-14B微調訓練的模型。

  • DeepSeek-V4-Pro:旗艦級MoE大模型,總參1.6T、啟用49B,原生支援百萬級超長上下文。依託海量高品質訓練資料,具備頂尖數學邏輯、複雜推理、專業代碼與長文本深度解析能力,適配高階科研、複雜辦公、深度智能代理等高難度情境。

  • DeepSeek-V4-Flash:高效輕量化MoE模型,總參284B,啟用13B,原生支援百萬超長上下文能力。推理速度快、延遲低、調用成本低廉,綜合能力均衡,主打高並發、輕量化任務,適合日常對話、內容創作、基礎RAG、批量文案處理等普惠剛需情境。

連網搜尋

搜尋過程中,當私人知識庫無法給出相應的答案時,可拓展連網搜尋,擷取更多互連網資訊,補充私人知識庫,結合大語言模型給出更豐富的回答。

查詢分析

提供Query內容分析服務,基於大語言模型及NLP能力,可對使用者輸入的查詢內容進行意圖識別、相似問題擴充、NL2SQL處理等,有效提升RAG情境中檢索問答效果。

通用Query分析服務,基於大語言模型對使用者輸入Query進行意圖理解以及相似問題擴充。

排序服務

  • BGE重排模型:提供基於BGE模型的文檔打分服務,可根據Query與文檔內容的相關性,按分數由高到低對DOC進行排序,並輸出對應的打分結果。支援中英雙語,最大輸入token長度512(Query+Doc長度)。

  • OpenSearch自研重排模型:融合多行業資料集訓練,提供高水準的重排服務,可根據Query及DOC的語義相關性從高到低對Doc進行排序。支援中英雙語,最大輸入token長度512(Query+doc長度)。

  • Qwen3排序服務-0.6B:Qwen3系列文檔重排服務,支援100+語言,最大輸入token長度32k(Query+doc長度),參數量0.6B。

  • 文本排序-ops-bge-reranker-v2:高效能文本重排序模型,用於對檢索結果進行精細化重新排序,以提升RAG(檢索增強產生)等情境中的相關性精度。

文本/文檔處理服務

Jina AI Reader

一款專為大語言模型設計的網頁內容提取服務,它能將任意URL轉換為LLM友好的純文字格式,自動去除廣告、導航等幹擾資訊,精準提取網頁核心內容。

文檔內容解析

  • 文檔內容解析服務001:通用文檔解析服務,支援從非結構化文檔(文本、表格、圖片等)中提取標題、分段等邏輯層級結構,以結構化格式輸出。

  • 文檔內容解析服務002:提供pdf、圖片等多種非結構化文檔格式的解析,對複雜元素(表格、公式和圖表等)的識別方面出色,且具備較快的推理速度。

文本向量化

  • OpenSearch文本向量化服務-001:提供多語言(40+)文本向量化服務,輸入文本最大長度300 token,輸出向量維度1536維。

  • OpenSearch通用文本向量化服務-002:提供多語言(100+)文本向量化服務,輸入文本最大長度8192 token,輸出向量維度1024維。

  • OpenSearch文本向量化服務-中文-001:提供中文文本向量化服務,輸入文本最大長度1024 token,輸出向量維度768維。

  • OpenSearch文本向量化服務-英文-001:提供英文文本向量化服務,輸入文本最大長度512 token,輸出向量維度768維。

  • GTE文本向量-多語言-Base:多語言(70+)文本向量化服務,輸入文本最大長度8192,輸出向量維度768維。

  • Qwen3文本向量-0.6B:Qwen3系列多語言(100+)文本向量化服務,輸入最大長度32k,輸出向量維度1024維,參數量0.6B。

  • 文本向量-ops-dmeta-text-embedding-zh:專為中文最佳化的文本向量化模型,能夠將中文文本轉化為高品質的語義向量,適用於語義檢索、文本相似性計算等任務。

文本稀疏向量化

提供將文本資料轉化為稀疏向量形式表達的服務,稀疏向量儲存空間更小,常用於表達關鍵詞和詞頻資訊,可與稠密向量搭配進行混合檢索,提升檢索效果。

OpenSearch文本稀疏向量化服務:提供多語言(100+)文本向量化服務,輸入文本最大長度8192 token。

文檔切片

提供通用文本切片服務,支援基於文檔段落、文本語義、指定規則,對HTML、Markdown、TXT格式的結構化資料進行拆分,同時支援以富文本形式提取文檔中的代碼、圖片以及表格。

向量降維

向量降維embedding-dim-reduction:提供向量模型調優服務,可通過定製訓練向量降維等模型,在不帶來過多檢索效果損失的情況下,輔助將高維度向量降低維度,以便提升性價比。

多模態處理服務

多模態向量

  • M2-Encoder-多模態向量模型:中英雙語多模態服務,基於60億圖文對資料(其中30億為中文資料,30億為英文資料)在BM-6B基礎上訓練而成。該模型支援圖文跨模態檢索(包括文本搜尋圖片和圖片搜尋文本),以及圖片分類任務。

  • M2-Encoder-Large-多模態向量模型:中英雙語多模態服務,相比M2-Encoder模型擁有更大的參數量,達到 1B(10億參數),從而在多模態任務處理中具備更強的表達能力和效能表現。

  • GME多模態向量-Qwen2-VL-2B:基於 Qwen2-VL 多模態大型語言模型(MLLMs) 訓練的多模態向量服務,支援單一模態及多模態組合輸入,能夠高效處理文本、映像及組合類別型的資料。

  • 多模態向量-ops-mm-embedding-v1-2b:由阿里雲 OpenSearch-AI 團隊開發的多模態向量模型,基於 Qwen2-VL 2B Instruct 微調,支援文本、映像、視頻等單模態及多模態組合輸入,將其統一編碼為語義向量,適用於跨模態檢索與理解任務。

  • 多模態向量-ops-mm-embedding-v1-7b:由阿里雲 OpenSearch-AI 團隊開發的多模態向量模型,基於 Qwen2-VL 7B Instruct 微調,支援文本、映像、視頻等單模態及多模態組合輸入,將其統一編碼為語義向量,適用於跨模態檢索與理解任務。

  • 電商多模態向量-ops-mm-embedding-ecom-001:由阿里雲 OpenSearch-AI 團隊自研的電商領域定製多模態向量模型,支援圖搜圖、圖搜圖文兩種多模態搜尋方式,適用於電商情境跨模態檢索與理解任務。

  • 人臉多模態向量-ops-mm-embedding-face-001:面向人臉檢索任務,通過先進的人臉向量模型,支援單張或多張映像輸入,將人臉資訊統一編碼為高維語義向量,助力高效精準的人臉搜尋與比對。

多模態排序

提供映像的相關性排序服務,在RAG及多模態搜尋情境中,可通過排序服務找到相關性更高的內容並依次返回,引入排序服務可有效提升檢索及大模型產生的準確率。

視頻總結

提供視頻總結服務,對指定視頻片段進行理解,利用大模型能力產生視頻總結、標題與標籤。

視頻切割

提供視頻切割服務,對視頻進行理解和分析,提取主要畫面格並將視頻切割為相應段落。

視頻截幀

視頻截幀服務001:提供視頻內容提取能力,可從視頻中捕獲主要畫面格畫面。結合多模態向量服務或圖片解析能力,實現跨模態檢索。

語音辨識

語音辨識服務001:提供語音轉文本能力,可將視頻或音頻中的語音內容快速轉化為結構化文本。該服務支援多種語言。

主體識別

  • 主體識別服務-ops-object-detect-001:從映像或視頻中自動定位並識別主要目標或對象,支援單個及多個主體的識別,適用於智能監控、自動駕駛、映像檢索等應用。

  • Face Service服務-ops-object-detect-face-001:從映像中自動定位並識別人臉,支援多個人臉的識別,適用於智能監控、映像檢索等應用。

  • 服飾主體識別001-ops-object-detect-fashion-001:服飾類目主體識別模型,由阿里雲OpenSearch團隊自研,支援20多類服飾相關主體識別,輸出主體類別、位置框及置信分。可用於複雜情境中主體提取,作為下遊任務的輸入,可排除圖片背景或其他主體對下遊embedding和rerank模型的幹擾。

圖片內容解析

圖片內容理解服務:基於多模態大模型對圖片內容進行解析理解以及文字識別,解析後的文本可用於圖片檢索、問答情境。

圖片文本識別服務:OCR圖片文本識別,識別後的文本可用於圖片檢索問答情境。

服務體驗

以文檔解析和多模態向量為例,介紹如何在體驗中心快速試用服務、查看結果並擷取調用代碼。

文檔解析

  1. 登入AI搜尋開放平台控制台

  2. 在左側導覽列選擇体验中心

  3. 服务类别選擇文档解析/图片解析(document-analyze),選擇具體的体验服务

  4. 體驗資料可以使用系統提供的示例数据,支援通過管理数据上傳您自己的資料,檔案類型支援Txt、Pdf、Html、Doc、Docx、Ppt、Pptx格式,大小不超過20M。

    • 文件:上傳本地檔案,7天后自動清除, 平台不會長期儲存您的資料。

    • URL:提供檔案URL地址和對應的檔案類型,支援上傳多個網址,每個網址各佔一行。

      說明

      資料格式選擇錯誤會導致文檔解析失敗,請根據檔案資料選擇正確的檔案類型。

      重要

      請您確保在法律法規允許的範圍內使用網頁連結匯入功能,遵守目標平台管理規範、保障權利人合法權益,您應對此獨立承擔責任。AI搜尋開放平台作為工具提供方不對您的解析或下載行為承擔任何責任。

  5. 如您使用自己的資料,從下拉式清單中選擇提前上傳的檔案或者URL。

  6. 單擊获取结果,系統調用服務解析文檔。

    • 结果:展示解析進度和解析結果

    • 结果源码:查看結果響應代碼、通過复制代码或者下载文件將代碼下載到本地。

    • 示例代码:查看和下載調用常值內容解析服務的示例代码

多模態向量

  1. 登入AI搜尋開放平台控制台

  2. 在左側導覽列選擇体验中心

  3. 服务类别選擇多模态向量(multi-modal-embedding),選擇具體的体验服务,選擇文本图片或者文本+图片

    說明

    上傳本地圖片進行向量化時,圖片將在7天后自動清除, 平台不會長期儲存您的資料。

  4. 單擊获取结果,擷取多模態向量化結果。

    • 结果:展示向量化結果

    • 结果源码:查看結果響應代碼、通過复制代码或者下载文件將代碼下載到本地。

    • 示例代码:查看和下載調用文本向量化服務的示例代码