O Milvus AI Function encapsula chamadas de modelo como Collection Function e interfaces REST. Esse recurso permite processar texto, imagens, vídeos e áudio durante a ingestão de dados, a recuperação ou os fluxos de trabalho de negócios, sem a necessidade de manter pipelines separados para chamadas de modelo. O AI Function abrange cenários comuns de IA, incluindo embedding, reranking, compreensão e geração de conteúdo, produção de mídia, processamento em lote e detecção de segurança.
Cenários comuns
@id="fzlseql3ivnv2" Recuperação multimodal e RAG — Gere embeddings para texto, imagens e vídeos e reclassifique os candidatos recuperados.
@id="cxychm5d6tna8" Compreensão e processamento de conteúdo — Obtenha títulos, traduções, resumos, classificações, resultados de análise de sentimento, palavras-chave, entidades e tags estruturadas.
@id="frqw7788ublcq" Produção de mídia — Transcreva gravações de atendimento ao cliente, edite imagens de product ou crie e consulte tarefas de geração de vídeo.
@id="fv63cd53wqubw" Governança de lotes e segurança — Inicie inferência assíncrona em lote sobre ativos históricos e ative a detecção de segurança na etapa de entrada ou saída das chamadas de modelo.
Arquitetura
Os dados de entrada e os service de modelo alimentam a camada de capacidade do Milvus AI Function. Conforme o tipo de função, essa camada retorna embeddings, informações estruturadas, texto gerado ou URLs de mídia para uso em sistemas de busca, produção de conteúdo e aplicações de negócios.
AI Functions suportadas
A tabela a seguir lista todas as AI Functions. A coluna de modelo indica os tipos e os modelos representativos. Os modelos disponíveis dependem da configuração do Provider no lado do servidor.
|
@id="c2xvzumcyscwn" AI Function |
@id="e4yflf54ixds0" Descrição |
@id="dw9b2eyz37sbh" Modalidade de entrada |
@id="fzsrd37v90kwg" Tipos de modelo/modelos representativos suportados |
|
@id="f52phlri1k9u5" @id="avduwqos7hxm3" AI_EMBEDDING |
@id="aktvo8j8k643n" Converte conteúdo em vetores densos para busca semântica, RAG, clustering, recomendações e recuperação de imagem-texto. |
@id="doovznm40idsf" Texto, imagem, vídeo |
@id="djfy458hepmsm" Embedding de texto: @id="cziran966gcw2" |
|
@id="ef5n6a5cq12di" @id="bnrufowjkmap7" AI_EMBEDDING_CACHE |
@id="asl1ct0fxesaj" Reutiliza vetores do cache de correspondência exata do Redis para textos repetidos, reduzindo a latência de embedding e o uso do modelo. |
@id="emqnqc4cw49t9" Texto |
@id="fafadv0pe3e2p" Embedding de texto: @id="a8qxzmyd05dpl" |
|
@id="ddyfxq0nhdoz3" @id="bwk07vxrg40zw" AI_RERANK |
@id="cv4dkaag3pm4z" Pontua e reordena uma consulta em relação a textos, imagens ou vídeos candidatos recuperados. |
@id="ftkh6sqg47g3q" Texto, imagem, vídeo |
@id="arar2oj62inwj" Reranking de texto: @id="deai03u25m9fi" |
|
@id="ctwuu3e1hqoim" @id="fkwjvp7fjzmq2" AI_TEXT_TRANSFORM |
@id="eu1808tsuj7py" Gera títulos, textos publicitários, tags ou resultados de preenchimento de campos linha por linha com base em um prompt. |
@id="fg3gt75cdfjcn" Texto |
@id="eei9vu96xqhga" Modelos de texto: @id="diop4nx989nmx" |
|
@id="feartecfvfcm2" @id="a88em6kku1js0" AI_TRANSLATE |
@id="f1qvs5fcj4y07" Traduz texto para o idioma de destino especificado. |
@id="fxojyebrqg8kw" Texto |
@id="a0i5ixaoj4gp1" Modelos de texto: @id="ca2g6gwv40yqa" |
|
@id="ddxr102g3ibd2" @id="du2gx2gkstifp" AI_SIMILARITY |
@id="d5w4fl851a4vt" Compara a similaridade semântica de pares de texto e retorna uma pontuação de 0 a 1. |
@id="ee22ks16evxdw" Texto |
@id="ff1nfhfvva5gq" Modelos de texto: @id="fq413p78tiq7e" |
|
@id="adc0779uk48kr" @id="fw3zm3acl1zqk" AI_PII_MASK |
@id="dpyspn8llw00m" Identifica e mascara informações pessoais sensíveis no texto. |
@id="fmuyfbcgm981a" Texto |
@id="ay8st7qf9nnlr" Modelos de texto: @id="fz1fngqgqgz9y" |
|
@id="dcwaw4q8vmvdp" @id="eudp0e5bn471i" AI_SUMMARIZATION |
@id="a4k8m0ox78c29" Condensa textos, imagens ou vídeos em resumos concisos. |
@id="cjdkp3bc8518s" Texto, imagem, vídeo |
@id="erojlfc04u4o8" Modelos de texto: @id="ffkd7mycsra5y" |
|
@id="f1v0uf35e9xfn" @id="am9irs9z0mhai" AI_EXTRACTION |
@id="e6cf98kmbo9nz" Extrai campos estruturados do conteúdo com base em rótulos fornecidos e retorna JSON. |
@id="bs3lywp9m61ji" Texto, imagem, vídeo |
@id="e1ky6xc1nqqvg" Modelos de texto: @id="bsledl7ma6yik" |
|
@id="cagve7s3jdbp4" @id="afmoehidm2t7f" AI_ENTITY |
@id="d5a47rfnoa4to" Extrai entidades nomeadas, como nomes, organizações, locais, datas e valores monetários, e retorna JSON. |
Texto, imagem, vídeo |
@id="ca5sh2okk5k7r" Modelos de texto: @id="fnrjhdx9o5ocl" |
|
@id="bc90clxui0eo4" @id="dn92b876jrotq" AI_KEYWORD |
@id="atloyz8i95r73" Extrai palavras-chave representativas do conteúdo e retorna JSON. |
@id="b1shns828h0sp" Texto, imagem, vídeo |
@id="dlqmmr6xwe5fp" Modelos de texto: @id="ayz7j7o4zxixz" |
|
@id="d38sqwfykfxs7" @id="a8cgc69zpfejq" AI_CLASSIFICATION |
@id="cfyib9ttcy94o" Selecione a categoria entre os rótulos candidatos que melhor corresponde ao conteúdo. |
@id="c8fzppboxgk8j" Texto, imagem, vídeo |
@id="bpcutcofdbfpk" Modelos de texto: @id="c4gugzzgifq2k" |
|
@id="a6il9cftoi961" @id="eil5yvcf1yuhf" AI_SENTIMENT |
@id="e9a2jwri8e3b0" Selecione a categoria de sentimento entre as opções candidatas que melhor corresponde ao conteúdo. |
@id="fxn35myfxi7f0" Texto, imagem, vídeo |
@id="ele57ifg8d9t8" Modelos de texto: @id="bk9ce1kos9l0o" |
|
@id="fd7vt40swumbx" @id="c4xvjlq3ugxwk" AI_MULTIMODAL_GENERATION |
@id="evc7n663h3cbo" Gera resultados em texto a partir de texto, imagens, vídeos ou áudio. |
@id="f7c1hbywbiy9u" Texto, imagem, vídeo, áudio |
@id="fowu5y5crry7y" Modelos multimodais: @id="e85qkypjfttde" |
|
@id="bbpnuxd8wdwe7" @id="d4arak08k6qg1" AI_TRANSCRIPTION |
@id="dkdco326sf17q" Transcreve uma URL de áudio em texto pesquisável. |
@id="adbvv5v4x5pj0" Áudio |
@id="cc2bzn1bbaj2i" Modelo de reconhecimento de fala: @id="cdjgcjv1lhrpb" |
|
@id="bomk52lkefrgz" @id="amm7h7y558ynf" AI_IMAGE_EDIT |
@id="blmso812o9f01" Gera uma URL de imagem editada com base em uma imagem e um prompt. |
@id="auujftkgvyxq6" Texto, imagem |
@id="db5xorj9gdebp" Modelos de geração de imagem: @id="f6yt903wpwnjl" |
|
@id="eawpslg0ps6c1" @id="cyblsiipgy9w1" AI_VIDEO_EDIT |
@id="dzoi9zpq3sr2c" Envia tarefas de texto para vídeo, imagem para vídeo ou edição de vídeo e recupera assincronicamente a URL do vídeo resultante. |
@id="cl9aqe8pwk7bz" Texto, imagem, vídeo |
@id="ese1n609a3du5" Modelos de vídeo: @id="fnphtah1r2rul" |
|
@id="dmhvz478mlccs" @id="dfjq07oy15wy8" AI_BATCH |
@id="bv1z79utz3ywq" Envia solicitações de Chat Completions em formato JSONL como tarefas assíncronas em lote, consulta o status e baixa arquivos de saída ou de erro. |
@id="a14dll4g4jydd" Texto, imagem, vídeo, áudio |
@id="e6bmzq550qy87" Modelos de texto: @id="ey1joyfwbdrdw" |
|
@id="c6hyqwu92hswi" @id="cwjy70fpswhfb" AI_DATA_INSPECTION |
@id="ew50d6vewedi1" Verifica a presença de conteúdo inseguro na etapa de entrada, na etapa de saída ou em ambas as etapas de uma chamada de modelo. |
@id="by3l41bba323c" Texto |
@id="f60qcrsh490tl" Utiliza o modelo de texto da chamada TextTransform atual, como @id="dbb45w3ip8y0x" |
Uso
@id="fty3crjqhu8xl" Collection Function — Configure funções no Collection Schema para execução automática durante as etapas de escrita, recuperação ou busca.
@id="ewpph16884x28" Interface REST — Chame funções sob demanda a partir dos seus service de negócios. Cada página de função fornece exemplos em cURL e Python.
@id="f86wge4vnixgl" Tarefas assíncronas — @id="dxkqal3dna442"
AI_BATCHe @id="ajdagf5620wa9"AI_VIDEO_EDITretornam identificadores de tarefa. Consulte periodicamente até que a tarefa atinja um estado terminal antes de ler a saída ou baixar os resultados.
Guia de seleção
@id="fy97zkuqrkp3w" Recuperação — Utilize primeiro @id="e0zlw4ut5n0ot"
AI_EMBEDDINGe depois use @id="f0g1rb6lqsm3c"AI_RERANKconforme necessário. Ative @id="a1gwjf3ol34mt"AI_EMBEDDING_CACHEpara textos repetidos.
@id="ef73fa8i4i539" Compreensão de conteúdo — Escolha a função de resumo, extração, entidade, palavra-chave, classificação, análise de sentimento ou geração multimodal de acordo com seu objetivo.
@id="cshoefhcqmxb1" Geração de mídia — Aplique @id="czg7siuclcb90"
AI_IMAGE_EDITpara imagens e @id="dt22w8jhs2nct"AI_VIDEO_EDITpara vídeos. Para processamento offline em grande escala, recorra a @id="a7ey7ht7k91tk"AI_BATCH.
@id="bhk5y7kr8ettz" Tratamento de conteúdo sensível — Ative @id="bg2oviy8lp1v9"
data_inspectionnos parâmetros da solicitação TextTransform ou da Function.