Todos os produtos
Search
Central de documentação

Vector Retrieval Service for Milvus:AI Function

Última atualização: Aug 03, 2026

O Milvus AI Function encapsula chamadas de modelo como Collection Function e interfaces REST. Esse recurso permite processar texto, imagens, vídeos e áudio durante a ingestão de dados, a recuperação ou os fluxos de trabalho de negócios, sem a necessidade de manter pipelines separados para chamadas de modelo. O AI Function abrange cenários comuns de IA, incluindo embedding, reranking, compreensão e geração de conteúdo, produção de mídia, processamento em lote e detecção de segurança.

Cenários comuns

  • @id="fzlseql3ivnv2" Recuperação multimodal e RAG — Gere embeddings para texto, imagens e vídeos e reclassifique os candidatos recuperados.

  • @id="cxychm5d6tna8" Compreensão e processamento de conteúdo — Obtenha títulos, traduções, resumos, classificações, resultados de análise de sentimento, palavras-chave, entidades e tags estruturadas.

  • @id="frqw7788ublcq" Produção de mídia — Transcreva gravações de atendimento ao cliente, edite imagens de product ou crie e consulte tarefas de geração de vídeo.

  • @id="fv63cd53wqubw" Governança de lotes e segurança — Inicie inferência assíncrona em lote sobre ativos históricos e ative a detecção de segurança na etapa de entrada ou saída das chamadas de modelo.

Arquitetura

Os dados de entrada e os service de modelo alimentam a camada de capacidade do Milvus AI Function. Conforme o tipo de função, essa camada retorna embeddings, informações estruturadas, texto gerado ou URLs de mídia para uso em sistemas de busca, produção de conteúdo e aplicações de negócios.

AI Functions suportadas

A tabela a seguir lista todas as AI Functions. A coluna de modelo indica os tipos e os modelos representativos. Os modelos disponíveis dependem da configuração do Provider no lado do servidor.

@id="c2xvzumcyscwn" AI Function

@id="e4yflf54ixds0" Descrição

@id="dw9b2eyz37sbh" Modalidade de entrada

@id="fzsrd37v90kwg" Tipos de modelo/modelos representativos suportados

@id="f52phlri1k9u5" @id="avduwqos7hxm3" AI_EMBEDDING

@id="aktvo8j8k643n" Converte conteúdo em vetores densos para busca semântica, RAG, clustering, recomendações e recuperação de imagem-texto.

@id="doovznm40idsf" Texto, imagem, vídeo

@id="djfy458hepmsm" Embedding de texto: @id="cziran966gcw2" text-embedding-v4; Embedding multimodal: @id="cjsqm3w5sq242" qwen3-vl-embedding, @id="etguy6e41uh7y" tongyi-embedding-vision-plus.

@id="ef5n6a5cq12di" @id="bnrufowjkmap7" AI_EMBEDDING_CACHE

@id="asl1ct0fxesaj" Reutiliza vetores do cache de correspondência exata do Redis para textos repetidos, reduzindo a latência de embedding e o uso do modelo.

@id="emqnqc4cw49t9" Texto

@id="fafadv0pe3e2p" Embedding de texto: @id="a8qxzmyd05dpl" text-embedding-v4, @id="ftb8c4cactuxw" text-embedding-v3.

@id="ddyfxq0nhdoz3" @id="bwk07vxrg40zw" AI_RERANK

@id="cv4dkaag3pm4z" Pontua e reordena uma consulta em relação a textos, imagens ou vídeos candidatos recuperados.

@id="ftkh6sqg47g3q" Texto, imagem, vídeo

@id="arar2oj62inwj" Reranking de texto: @id="deai03u25m9fi" qwen3-rerank; Reranking multimodal: @id="f62rwze2dfx7j" qwen3-vl-rerank.

@id="ctwuu3e1hqoim" @id="fkwjvp7fjzmq2" AI_TEXT_TRANSFORM

@id="eu1808tsuj7py" Gera títulos, textos publicitários, tags ou resultados de preenchimento de campos linha por linha com base em um prompt.

@id="fg3gt75cdfjcn" Texto

@id="eei9vu96xqhga" Modelos de texto: @id="diop4nx989nmx" qwen3.7-max, @id="afrr9khoikz40" deepseek-v4-pro, @id="dznktyt1licg3" deepseek-v4-flash.

@id="feartecfvfcm2" @id="a88em6kku1js0" AI_TRANSLATE

@id="f1qvs5fcj4y07" Traduz texto para o idioma de destino especificado.

@id="fxojyebrqg8kw" Texto

@id="a0i5ixaoj4gp1" Modelos de texto: @id="ca2g6gwv40yqa" qwen3.7-max, @id="dlhklreqp3lg1" deepseek-v4-pro, @id="egftucalbewpa" deepseek-v4-flash.

@id="ddxr102g3ibd2" @id="du2gx2gkstifp" AI_SIMILARITY

@id="d5w4fl851a4vt" Compara a similaridade semântica de pares de texto e retorna uma pontuação de 0 a 1.

@id="ee22ks16evxdw" Texto

@id="ff1nfhfvva5gq" Modelos de texto: @id="fq413p78tiq7e" qwen3.7-max, @id="dixpzrtq6ay0m" deepseek-v4-pro, @id="eppw8homc13xc" deepseek-v4-flash.

@id="adc0779uk48kr" @id="fw3zm3acl1zqk" AI_PII_MASK

@id="dpyspn8llw00m" Identifica e mascara informações pessoais sensíveis no texto.

@id="fmuyfbcgm981a" Texto

@id="ay8st7qf9nnlr" Modelos de texto: @id="fz1fngqgqgz9y" qwen3.7-max, @id="ecu3vk5v4gn5f" deepseek-v4-pro, @id="efwzvjvj3ak6a" glm-5.2.

@id="dcwaw4q8vmvdp" @id="eudp0e5bn471i" AI_SUMMARIZATION

@id="a4k8m0ox78c29" Condensa textos, imagens ou vídeos em resumos concisos.

@id="cjdkp3bc8518s" Texto, imagem, vídeo

@id="erojlfc04u4o8" Modelos de texto: @id="ffkd7mycsra5y" qwen3.7-max; Modelos multimodais: @id="ezsldxlq9s7r1" qwen3.7-plus, @id="fpds9pm2odyrc" qwen3.6-plus, @id="eq7ypvbuh1p2l" kimi-k2.6.

@id="f1v0uf35e9xfn" @id="am9irs9z0mhai" AI_EXTRACTION

@id="e6cf98kmbo9nz" Extrai campos estruturados do conteúdo com base em rótulos fornecidos e retorna JSON.

@id="bs3lywp9m61ji" Texto, imagem, vídeo

@id="e1ky6xc1nqqvg" Modelos de texto: @id="bsledl7ma6yik" qwen3.7-max; Modelos multimodais: @id="an9yixu18p9ly" qwen3.7-plus, @id="buvtxzzt5nyiq" qwen3.6-plus, @id="c3no5oj7tuyif" kimi-k2.6.

@id="cagve7s3jdbp4" @id="afmoehidm2t7f" AI_ENTITY

@id="d5a47rfnoa4to" Extrai entidades nomeadas, como nomes, organizações, locais, datas e valores monetários, e retorna JSON.

Texto, imagem, vídeo

@id="ca5sh2okk5k7r" Modelos de texto: @id="fnrjhdx9o5ocl" qwen3.7-max; Modelos multimodais: @id="bm4dv6gvukuyn" qwen3.7-plus, @id="e4rcbn1a6xedo" qwen3.6-plus, @id="c3ee3ptz6cn21" kimi-k2.6.

@id="bc90clxui0eo4" @id="dn92b876jrotq" AI_KEYWORD

@id="atloyz8i95r73" Extrai palavras-chave representativas do conteúdo e retorna JSON.

@id="b1shns828h0sp" Texto, imagem, vídeo

@id="dlqmmr6xwe5fp" Modelos de texto: @id="ayz7j7o4zxixz" qwen3.7-max; Modelos multimodais: @id="a71uaz52xb3r5" qwen3.7-plus, @id="fqazd4b0675bb" qwen3.6-plus, @id="bij36bbu2ynco" kimi-k2.6.

@id="d38sqwfykfxs7" @id="a8cgc69zpfejq" AI_CLASSIFICATION

@id="cfyib9ttcy94o" Selecione a categoria entre os rótulos candidatos que melhor corresponde ao conteúdo.

@id="c8fzppboxgk8j" Texto, imagem, vídeo

@id="bpcutcofdbfpk" Modelos de texto: @id="c4gugzzgifq2k" qwen3.7-max; Modelos multimodais: @id="cd10nrtrouwxh" qwen3.7-plus, @id="eaorne2n0pm42" qwen3.6-plus, @id="cs6gtl6u1fojo" kimi-k2.6.

@id="a6il9cftoi961" @id="eil5yvcf1yuhf" AI_SENTIMENT

@id="e9a2jwri8e3b0" Selecione a categoria de sentimento entre as opções candidatas que melhor corresponde ao conteúdo.

@id="fxn35myfxi7f0" Texto, imagem, vídeo

@id="ele57ifg8d9t8" Modelos de texto: @id="bk9ce1kos9l0o" qwen3.7-max; Modelos multimodais: @id="b6hbum75lt2mw" qwen3.7-plus, @id="fh29a6cmef4jy" qwen3.6-plus, @id="eoomjwiqxq7km" kimi-k2.6.

@id="fd7vt40swumbx" @id="c4xvjlq3ugxwk" AI_MULTIMODAL_GENERATION

@id="evc7n663h3cbo" Gera resultados em texto a partir de texto, imagens, vídeos ou áudio.

@id="f7c1hbywbiy9u" Texto, imagem, vídeo, áudio

@id="fowu5y5crry7y" Modelos multimodais: @id="e85qkypjfttde" qwen3.7-plus, @id="etkeczbct4t3g" qwen3.6-plus, @id="b83dhctxcdg6h" kimi-k2.6; Reconhecimento de fala: @id="cx32hrr6y4cen" qwen3-asr-flash.

@id="bbpnuxd8wdwe7" @id="d4arak08k6qg1" AI_TRANSCRIPTION

@id="dkdco326sf17q" Transcreve uma URL de áudio em texto pesquisável.

@id="adbvv5v4x5pj0" Áudio

@id="cc2bzn1bbaj2i" Modelo de reconhecimento de fala: @id="cdjgcjv1lhrpb" qwen3-asr-flash.

@id="bomk52lkefrgz" @id="amm7h7y558ynf" AI_IMAGE_EDIT

@id="blmso812o9f01" Gera uma URL de imagem editada com base em uma imagem e um prompt.

@id="auujftkgvyxq6" Texto, imagem

@id="db5xorj9gdebp" Modelos de geração de imagem: @id="f6yt903wpwnjl" wan2.7-image-pro, @id="du4j9id3o1upy" wan2.7-image.

@id="eawpslg0ps6c1" @id="cyblsiipgy9w1" AI_VIDEO_EDIT

@id="dzoi9zpq3sr2c" Envia tarefas de texto para vídeo, imagem para vídeo ou edição de vídeo e recupera assincronicamente a URL do vídeo resultante.

@id="cl9aqe8pwk7bz" Texto, imagem, vídeo

@id="ese1n609a3du5" Modelos de vídeo: @id="fnphtah1r2rul" happyhorse-1.1-t2v, @id="ddwd2nftxlubq" happyhorse-1.1-i2v, @id="ce0bgmqesxni2" happyhorse-1.0-video-edit.

@id="dmhvz478mlccs" @id="dfjq07oy15wy8" AI_BATCH

@id="bv1z79utz3ywq" Envia solicitações de Chat Completions em formato JSONL como tarefas assíncronas em lote, consulta o status e baixa arquivos de saída ou de erro.

@id="a14dll4g4jydd" Texto, imagem, vídeo, áudio

@id="e6bmzq550qy87" Modelos de texto: @id="ey1joyfwbdrdw" qwen3.7-max; Modelos de visão: @id="fxw335z20ryn0" qwen3-vl-plus; Modelos omnimodais: @id="b49fi5rkg4cqo" qwen3.5-omni-plus.

@id="c6hyqwu92hswi" @id="cwjy70fpswhfb" AI_DATA_INSPECTION

@id="ew50d6vewedi1" Verifica a presença de conteúdo inseguro na etapa de entrada, na etapa de saída ou em ambas as etapas de uma chamada de modelo.

@id="by3l41bba323c" Texto

@id="f60qcrsh490tl" Utiliza o modelo de texto da chamada TextTransform atual, como @id="dbb45w3ip8y0x" qwen3.7-max, @id="dppolgqm3uc4d" deepseek-v4-pro.

Uso

  • @id="fty3crjqhu8xl" Collection Function — Configure funções no Collection Schema para execução automática durante as etapas de escrita, recuperação ou busca.

  • @id="ewpph16884x28" Interface REST — Chame funções sob demanda a partir dos seus service de negócios. Cada página de função fornece exemplos em cURL e Python.

  • @id="f86wge4vnixgl" Tarefas assíncronas — @id="dxkqal3dna442" AI_BATCH e @id="ajdagf5620wa9" AI_VIDEO_EDIT retornam identificadores de tarefa. Consulte periodicamente até que a tarefa atinja um estado terminal antes de ler a saída ou baixar os resultados.

Guia de seleção

  • @id="fy97zkuqrkp3w" Recuperação — Utilize primeiro @id="e0zlw4ut5n0ot" AI_EMBEDDING e depois use @id="f0g1rb6lqsm3c" AI_RERANK conforme necessário. Ative @id="a1gwjf3ol34mt" AI_EMBEDDING_CACHE para textos repetidos.

  • @id="ef73fa8i4i539" Compreensão de conteúdo — Escolha a função de resumo, extração, entidade, palavra-chave, classificação, análise de sentimento ou geração multimodal de acordo com seu objetivo.

  • @id="cshoefhcqmxb1" Geração de mídia — Aplique @id="czg7siuclcb90" AI_IMAGE_EDIT para imagens e @id="dt22w8jhs2nct" AI_VIDEO_EDIT para vídeos. Para processamento offline em grande escala, recorra a @id="a7ey7ht7k91tk" AI_BATCH.

  • @id="bhk5y7kr8ettz" Tratamento de conteúdo sensível — Ative @id="bg2oviy8lp1v9" data_inspection nos parâmetros da solicitação TextTransform ou da Function.