Todos os produtos
Search
Central de documentação

Simple Log Service:Importar dados do OSS

Última atualização: Aug 31, 2026

Importe arquivos de log de buckets do Object Storage Service (OSS) para o Simple Log Service para consulta, análise e transformação. O Simple Log Service importa objetos do OSS de até 5 GB. Para objetos compactados, esse limite aplica-se ao tamanho compactado.

Faturamento

O Simple Log Service não cobra pelo recurso de importação de dados. No entanto, como esse recurso chama APIs do Object Storage Service (OSS), há geração de taxas de tráfego e de solicitação do OSS. Para obter mais informações sobre os preços dos itens faturáveis relacionados, consulte Preços do OSS. A taxa diária do OSS para importação de dados é calculada pela seguinte fórmula:

image..png

Parâmetros de faturamento

Parâmetro

Descrição

N

Número de arquivos importados por dia.

T

Quantidade total de dados importados por dia, em GB.

p_read

Taxa de tráfego por GB de dados.

  • Na importação dentro da mesma região, há geração de tráfego de saída interno. Esse tráfego é gratuito.

  • Na importação entre regiões, há geração de tráfego de saída pela internet.

p_put

Taxa por 10.000 solicitações PUT.

O Simple Log Service chama a operação de API ListObjects para listar arquivos no bucket de source. O OSS cobra pela operação ListObjects como solicitações PUT. Cada chamada de API pode retornar até 1.000 objetos. Por exemplo, se houver 1.000.000 de novos arquivos para importar, serão necessárias 1.000 solicitações (1.000.000 de arquivos / 1.000 arquivos por solicitação).

p_get

Taxa por 10.000 solicitações GET.

M

Intervalo de verificação de novos arquivos, em minutos.

Ao criar uma configuração de importação de dados, defina o parâmetro New File Check Cycle.

Pré-requisitos

  • Carregue os arquivos de log em um bucket do Object Storage Service (OSS). Para mais detalhes, consulte Upload objects.

  • Crie um Project e um Logstore. Consulte Manage projects e Create a basic Logstore para instruções.

  • Conclua a Autorização de Acesso a Recursos Cloud para autorizar o Simple Log Service a acessar seus recursos do OSS com a função AliyunLogImportOSSRole.

  • Sua conta precisa da permissão oss:ListBuckets para listar buckets do OSS. Veja mais em Attach a custom policy to a RAM user.

    Para usuários RAM, conceda também a permissão PassRole. Consulte Create a custom policy e Manage RAM user permissions para orientações.

    {
      "Statement": [
        {
          "Effect": "Allow",
          "Action": ["ram:PassRole", "ram:GetRole"],
          "Resource": "acs:ram:*:*:role/aliyunlogimportossrole"
        },
        {
          "Effect": "Allow",
          "Action": "oss:GetBucketWebsite",
          "Resource": "*"
        },
        {
          "Effect": "Allow",
          "Action": "oss:ListBuckets",
          "Resource": "*"
        }
      ],
      "Version": "1"
    }    

    Para importar dados entre contas diferentes, a conta raiz B deve autorizar a Conta A e uma função dentro da Conta A usando uma Bucket Policy no console do OSS. Exemplo de função: acs:ram::123456789:role/aliyunlogimportossrole.

    Autorização entre contas

    Execute as etapas abaixo como a Conta B, proprietária do bucket do OSS, para conceder acesso de leitura ao bucket para a Conta A e para a função de importação da Conta A.

    1. Faça login no console do OSS como Conta B.

    2. Na lista Buckets, clique em no bucket desejado.

    3. No painel de navegação à esquerda, clique em Bucket Policy e depois em Add Authorization.

    4. Conceda acesso à Conta A: defina Resource como todo o bucket, configure Authorized User para Other Accounts e insira o ID da conta (UID) da Conta A, especifique as Actions necessárias e clique em OK.

    5. Gere a política para a função de importação da Conta A: insira a função (por exemplo, acs:ram::123456789:role/aliyunlogimportossrole), clique em Generate Policy, ajuste Action na política gerada e salve-a.

    6. Após salvar a política, uma nova entrada aparecerá na lista Bucket Policy. Essa entrada corresponde à política daquela função na Conta A.

    Depois de concluir a autorização, a Conta A poderá selecionar o bucket da Conta B ao configurar a importação de dados do OSS.

Criar uma configuração de importação de dados

Importante

Se você anexar dados a um arquivo do OSS já importado, o job de importação reimportará o arquivo inteiro.

  1. Faça login no console do Simple Log Service.

  2. Na seção Import Data, clique em na aba Data Import e selecione OSS - Data Import.

  3. Selecione o Project e o Logstore de destino e clique em Next.

  4. Configure a importação.

    1. Na etapa Import Configuration, defina os seguintes parâmetros.

      Parâmetros

      Parâmetro

      Descrição

      Task Name

      Nome exclusivo para o job de importação.

      Display Name

      Nome de exibição do job.

      Job Description

      Descrição do job de importação.

      OSS Region

      Região onde o bucket do OSS de source está localizado.

      Se o bucket do OSS e o Project do Log Service estiverem na mesma região, você economiza custos de tráfego de rede pública e obtém transferência de dados mais rápida.

      Bucket

      Bucket de source que contém os arquivos de dados a serem importados.

      File Path Prefix Filter

      Filtra arquivos do OSS por prefixo de caminho. Por exemplo, se todos os arquivos a importar estiverem no diretório csv/, especifique o prefixo como csv/.

      Sem essa configuração, o job percorre todo o bucket do OSS.

      Nota

      Recomendamos configurar este parâmetro. Em buckets com muitos arquivos, percorrer tudo reduz significativamente a eficiência da importação.

      File Path Regex Filter

      Filtra arquivos do OSS correspondendo seus caminhos a uma expressão regular. Apenas arquivos cujos caminhos correspondem à expressão são importados. Por padrão, este campo fica vazio, indicando ausência de filtro.

      Por exemplo, se o caminho do arquivo for testdata/csv/bill.csv, defina a expressão regular como (testdata/csv/)(.*).

      Para saber como testar expressões regulares, consulte How to test a regular expressionComo testar uma expressão regular.

      File Modification Time Filter

      Filtra arquivos do OSS pela data de modificação.

      • All: Selecione esta opção para importar todos os arquivos correspondentes.

      • From Specific Time: Escolha esta opção para importar arquivos modificados após um momento específico.

      • Specific Time Range: Use esta opção para importar arquivos modificados dentro de um intervalo de tempo definido.

      Data Format

      Formato de análise do arquivo. Valores válidos:

      • CSV: Arquivo de texto delimitado. É possível usar a primeira linha como nomes de campo ou especificá-los manualmente. Cada linha subsequente é analisada como uma entrada de log.

      • Single-line JSON: Lê o arquivo do OSS linha por linha, analisando cada linha como um objeto JSON separado. As chaves do objeto JSON tornam-se os nomes dos campos no log.

      • JSON array: Lê o arquivo inteiro do OSS de uma vez. O conteúdo deve ser um array JSON contendo um ou mais objetos JSON.

      • CloudTrail: Lê o arquivo inteiro do OSS de uma vez. O conteúdo deve estar no formato padrão de estrutura de dados do CloudTrail.

      • Single-line Text Log: Analisa cada linha do arquivo do OSS como uma única entrada de log.

      • Multi-line Text Logs: Modo multilinha que usa expressão regular para identificar o início ou fim de uma entrada de log que abrange várias linhas.

      • ORC: Formato Optimized Row Columnar (ORC). O arquivo é automaticamente analisado em logs sem configuração adicional.

      • Parquet: Formato Parquet. A análise em logs ocorre automaticamente, sem necessidade de configuração extra.

      • Alibaba Cloud OSS Access Log: Formato para logs de acesso do Alibaba Cloud OSS. Para mais informações, veja Log shipping.

      • Alibaba Cloud CDN Download Log: Formato para logs de download do Alibaba Cloud CDN. Consulte Quick start para detalhes.

      Compression Format

      Formato de compactação dos arquivos de source. O Log Service descompacta os arquivos conforme o formato especificado antes de ler os dados.

      Encoding Format

      Formato de codificação dos arquivos de source. Atualmente, apenas UTF-8 e GBK são suportados.

      New File Check Cycle

      Se novos arquivos forem adicionados continuamente ao caminho do OSS de source, defina um New File Check Cycle. O job de importação executará em segundo plano, descobrindo e lendo novos arquivos periodicamente. O sistema garante que os dados do mesmo arquivo do OSS não sejam importados mais de uma vez. Por exemplo, ao criar um job às 12:00 com ciclo de 30 minutos, a primeira importação ocorre às 12:00. Se surgirem novos arquivos, a próxima importação será às 12:30.

      Caso não haja expectativa de novos arquivos no caminho do OSS de source, defina o ciclo como Never Check. O job de importação para após ler todos os arquivos existentes que atendem aos critérios.

      Import Archive Files

      Arquivos armazenados nas classes Archive ou Cold Archive no OSS precisam ser restaurados antes da leitura. Ative esta opção para restaurar os arquivos automaticamente. A classe Deep Cold Archive não é suportada.

      Nota
      • A restauração de arquivos Archive leva cerca de um minuto, podendo causar timeout na visualização inicial. Se ocorrer timeout, aguarde um momento e tente novamente.

      • Restaurar arquivos Cold Archive demora aproximadamente uma hora. Se a visualização expirar, pule-a ou aguarde uma hora antes de tentar outra vez.

        Durante a restauração de arquivos Cold Archive, as cópias restauradas permanecem disponíveis por sete dias, garantindo tempo suficiente para a importação.

      Log Time Configuration

      Time Field

      Ao selecionar Data Format como Single-line JSON, Single-line JSON, CloudTrail, ORC, Parquet, Alibaba Cloud OSS Access Log ou Alibaba Cloud CDN Download Log, especifique um campo de tempo. O Log Service utiliza esse campo para definir o horário de cada entrada de log importada.

      Data Format

      Quando o Time Field Extraction Regular Expression for Data Format ou Single-line Text Log, utilize uma expressão regular para extrair o tempo do conteúdo do log.

      Por exemplo, para a entrada de log 127.0.0.1 - - [10/Sep/2018:12:36:49 +0800] "GET /index.html HTTP/1.1", defina a Multi-line Text Logs como [0-9]{0,2}\/[0-9a-zA-Z]+\/[0-9\: +]+.

      Nota

      Em outros formatos de dados, também é possível usar expressão regular caso precise extrair apenas parte do campo de tempo.

      Time Field Extraction Regular Expression

      Define o formato de tempo usado para analisar o valor no campo de tempo.

      • Suporta sintaxe SimpleDateFormat do Java, como yyyy-MM-dd HH:mm:ss. Para detalhes da sintaxe, veja Class SimpleDateFormat. Para formatos comuns, consulte Time formats.

      • Aceita formatos epoch, incluindo epoch, epochMillis, epochMicro e epochNano.

      Time Field Format

      Selecione o fuso horário do campo de tempo. Este parâmetro não é necessário se o formato for do tipo epoch.

      Para considerar o horário de verão ao analisar o tempo do log, escolha um formato baseado em UTC. Caso contrário, prefira um formato baseado em GMT.

      Time Zone

      Advanced Settings

      Se o número de arquivos no bucket do OSS ultrapassar um milhão, ative fortemente esta opção. Caso contrário, a descoberta de arquivos torna-se ineficiente. Com a indexação de metadados do OSS, novos arquivos no bucket são descobertos em segundos, permitindo importação de dados quase em tempo real.

      Para utilizar a indexação de metadados do OSS, primeiro ative o recurso de gerenciamento de metadados para o bucket no console do OSS. Consulte Scalar search para mais informações.

      Se você escolher OSS Metadata Indexing ou Multi-line text log como Data Format, configure parâmetros adicionais conforme descrito nas tabelas a seguir.

      CSV

      Parâmetro

      Descrição

      Multi-line Text Logs

      Delimitador usado para separar campos no log. O padrão é vírgula (,).

      Delimiter

      Caractere de aspas usado para strings no arquivo CSV.

      Quote

      Caractere de escape para logs. O padrão é barra invertida (\\).

      Quote

      Número máximo de linhas que uma única entrada de log pode abranger. O padrão é 1.

      Maximum Lines

      Ao ativar a chave First Line as Field Name, a primeira linha do arquivo CSV serve como nomes dos campos. Por exemplo, a primeira linha do exemplo abaixo é extraída como nomes dos campos de log. Visualização do arquivo de exemplo:

      remote_addr,remote_user,time_local,request_time,request_length
      xxx,5,-,11/Dec/2020:15:31:06,0,000,133,3650,404,GET
      xxx,5,-,11/Dec/2020:15:32:06,0,000,133,3650,404,GET
      xxx,5,-,11/Dec/2020:15:34:10,0,000,133,3650,404,GET

      First Line as Field Name

      Desativando a opção Custom Fields, especifique uma lista de nomes de campos personalizados separados por vírgulas.

      First Line as Field Name

      Quantidade de linhas de cabeçalho a ignorar. Por exemplo, o valor 1 indica que a coleta de dados começa na segunda linha do arquivo CSV.

      Log de texto multilinha

      Parâmetro

      Descrição

      Lines to Skip

      Define onde aplicar a expressão regular:

      • Position to Match Regular Expression: Usa expressão regular para corresponder à primeira linha de uma entrada de log. Linhas subsequentes que não correspondem são anexadas à entrada atual, até o limite máximo configurado.

      • Regular Expression to Match First Line: Utiliza expressão regular para identificar o fim de uma entrada de log. A entrada inclui todas as linhas até aquela que corresponde a esta expressão.

      Regular Expression to Match Last Line

      Insira uma expressão regular baseada no conteúdo do seu log.

      Para mais detalhes, consulte How to test a regular expressionComo testar uma expressão regular.

      Regular Expression

      Limite máximo de linhas que uma única entrada de log pode abranger.

    2. Clique em Maximum Lines para visualizar os resultados da importação.

    3. Após confirmar as configurações, clique em Preview.

  5. Crie índices e visualize os dados. Em seguida, clique em Next. Por padrão, o Simple Log Service ativa a indexação de texto completo. Também é possível criar manualmente índices de campo para os logs coletados ou clicar em Next para que o Simple Log Service gere os índices de campo automaticamente. Para mais informações, consulte Create indexes.

    Importante

    Para consultar todos os campos nos logs, recomendamos índices de texto completo. Se precisar consultar apenas campos específicos, prefira índices de campo para reduzir o tráfego de indexação. Para analisar campos, a criação de índices de campo é obrigatória. Inclua uma instrução SELECT na sua consulta para realizar análises.

  6. Clique em Automatic Index Generation para abrir a página de consulta e análise e verificar se a importação dos dados do OSS foi bem-sucedida.

    Aguarde cerca de um minuto. Se os dados do OSS alvo aparecerem, a importação ocorreu com sucesso.

Operações relacionadas

Após criar uma configuração de importação de dados, visualize a configuração e seus relatórios estatísticos no console.

  1. Na lista Project, clique em no Project desejado.

  2. No painel de navegação à esquerda, escolha Query Log > Log Storage. Na página exibida, localize o Logstore desejado, selecione Logstore > Data Collection e clique em no nome da configuração.

  3. Visão geral

    Na página Data Import, visualize as informações básicas da configuração e os relatórios estatísticos.

    A página Import Configuration Overview contém as seguintes informações: A seção Basic Information exibe parâmetros como Configuration Name, Status, Bucket, Compression Format, Encoding Format, File Path Regex Filter, Import Archive Files, OSS Region, New File Check Interval, Data Format e Use System Time. A seção Statistical Reports (Data Processing Insight) mostra seis métricas: Successful Reads, Failed Reads, Public Read Traffic, Successful Writes, Failed Writes e Public Write Traffic, além de um Gráfico de Linhas de Taxa de Processamento e um Gráfico de Atraso de Progresso. A tabela Running Status na parte inferior lista informações de cada tarefa, como Time, Type, Instance, Successful Items, Failed Items e Average Response Time. O canto superior direito oferece os botões de ação Edit Configurations, Stop e Delete Configuration.

    Modificar

    Clique em Import Configuration Overview para alterar a configuração de importação de dados. Para mais detalhes, veja Create a data import configuration.

    Excluir

    Clique em Edit Configurations para remover a configuração de importação de dados.

    Aviso

    Esta operação é irreversível. Proceda com cautela.

    Parar

    Para interromper a tarefa de importação de dados, clique em Delete Configuration.

    Iniciar

    Clique em Stop para iniciar a tarefa de importação de dados.

Perguntas frequentes

Problema

Possível causa

Solução

Ao visualizar arquivos de um diretório HDFS no meu bucket, nenhum dado aparece.

Não há suporte para importar arquivos diretamente de um diretório HDFS.

Se o service HDFS estiver ativado para o bucket, um diretório .dlsdata é criado por padrão no caminho do OSS. Importe os arquivos a partir do diretório .dlsdata.

Nenhum dado exibido durante a visualização.

O bucket do OSS não contém arquivos, os arquivos estão vazios ou nenhum arquivo corresponde às condições de filtro.

  • Verifique se o bucket possui arquivos não vazios. Para arquivos CSV, garanta que tenham mais que uma linha de cabeçalho. Caso contrário, aguarde a disponibilidade dos dados antes de iniciar a importação.

  • Ajuste itens de configuração como Start, File Path Prefix Filter e File Path Regex Filter.

Os dados importados apresentam caracteres incorretos.

Formato de dados, compactação ou codificação incorreto.

Confirme o formato real do arquivo do OSS e ajuste configurações como File Modification Time Filter, Data Format ou Compression Format.

Para corrigir dados corrompidos existentes, crie um novo Logstore e uma nova configuração de importação de dados.

Os carimbos de data/hora no Simple Log Service não correspondem aos dos dados de source.

A configuração de importação não possui o campo de tempo do log, ou o formato/fuso horário está errado.

Especifique o campo de tempo do log e configure o formato e fuso horário corretos. Consulte Create a data import configuration para mais informações.

Após a importação, não consigo consultar ou analisar os dados.

  • Os dados estão fora do intervalo de tempo da consulta.

  • Índice não configurado.

  • O índice ainda não entrou em vigor.

  • Verifique se os dados desejados estão dentro do intervalo de tempo especificado. Caso contrário, ajuste o intervalo e consulte novamente.

    Se os dados não estiverem no intervalo de consulta, modifique-o e pesquise outra vez.

  • Verifique se há um índice definido para o Logstore.

    Se não houver índice, crie um primeiro. Veja Create index ou Rebuild index.

  • Se você definiu um índice e a quantidade de dados importados com sucesso mostrada no painel Encoding Format estiver conforme esperado, o índice pode não ter entrado em vigor. Tente reindexar os dados. Consulte Reindex data.

O número de entradas importadas é menor que o esperado.

Alguns arquivos contêm linhas únicas de dados que excedem o limite de 3 MB e são descartadas durante a importação. Consulte Collection limits.

Ao gravar dados em arquivos do OSS, garanta que nenhuma linha individual exceda 3 MB.

Ao criar uma configuração de importação, não consigo selecionar um bucket do OSS.

O Simple Log Service não foi autorizado a assumir a função AliyunLogImportOSSRole.

Conclua a autorização conforme descrito nos pré-requisitos.

Alguns arquivos não foram importados.

Condições de filtro configuradas incorretamente ou alguns arquivos excedem o limite de 5 GB. Consulte Collection limits.

  • Verifique se os arquivos a importar correspondem às condições de filtro. Caso contrário, modifique-as.

  • Garanta que o tamanho de cada arquivo a importar seja inferior a 5 GB. Se um arquivo exceder esse limite, reduza seu tamanho.

    Caso um único arquivo ultrapasse 5 GB, diminua seu tamanho.

Arquivos de arquivamento não são importados.

A chave Data Processing Insight está desativada. Consulte Collection limits.

  • Método 1: Modifique a configuração de importação de dados e ative a chave Import Archive Files.

  • Método 2: Crie uma nova configuração de importação de dados e ative a chave Import Archive Files.

Logs de texto multilinha são analisados incorretamente.

Expressão regular de primeira linha ou última linha configurada incorretamente.

Corrija as expressões regulares de primeira e última linha.

Alta latência na importação de novos arquivos.

Existem muitos arquivos correspondentes ao filtro de prefixo de caminho e a chave Import Archive Files está desativada na configuração de importação.

Se houver grande volume de arquivos (mais de um milhão) correspondendo ao filtro de prefixo, ative a chave OSS Metadata Indexing na configuração de importação. Caso contrário, a descoberta de novos arquivos torna-se muito lenta.

Erro de permissão relacionado a STS durante a criação.

Permissões insuficientes do usuário RAM.

  1. Verifique se a AccessKey do usuário RAM é válida e está habilitada. Consulte AccessKey pair.

  2. Verifique se a credencial de acesso temporário (token STS) do usuário RAM expirou. Se sim, estenda sua validade. Veja Access OSS by using STS temporary credentials.

  3. Confirme que você concluiu a Autorização de Acesso a Recursos Cloud, que concede ao Simple Log Service permissão para acessar seus recursos do OSS assumindo a função AliyunLogImportOSSRole.

Tratamento de erros

Erro

Descrição

Falha na leitura do objeto

Se um job de importação não conseguir ler completamente um objeto, devido a exceção de rede ou dano ao objeto, ele tentará novamente automaticamente. Se a leitura falhar após três tentativas, o job ignora o objeto.

O intervalo de nova tentativa segue o New File Check Cycle. Se o New File Check Cycle estiver definido como Never Check, o job tenta novamente após 5 minutos.

Erro de análise do formato de compactação

Ao encontrar um objeto com formato de compactação inválido, o job de importação ignora o objeto.

Erro de análise do formato de dados

  • Se o job falhar ao analisar um objeto em formato binário, como ORC ou Parquet, ele ignora o objeto.

  • Em caso de falha na análise de outros formatos, o job armazena o conteúdo de texto bruto no campo content do log.

Bucket do OSS não encontrado

O job de importação tenta novamente periodicamente. A importação retoma automaticamente após a recriação do bucket do OSS.

Erro de permissão

Se ocorrer erro de permissão ao ler de um bucket do OSS ou gravar em um Logstore, o job de importação tenta novamente periodicamente. O job retoma automaticamente assim que o problema de permissão for resolvido.

Durante um erro de permissão, o job não ignora objetos. Portanto, após a correção das permissões, o job processa todos os objetos pendentes no bucket do OSS, importando seus dados para o Logstore.

API de ingestão do OSS

Ações

API

Criar um job de importação de dados do OSS

CreateOSSIngestion

Atualizar um job de importação de dados do OSS

UpdateOSSIngestion

Obter um job de importação de dados do OSS

GetOSSIngestion

Excluir um job de importação de dados do OSS

DeleteOSSIngestion

Iniciar um job de importação de dados do OSS

StartOSSIngestion

Parar um job de importação de dados do OSS

StopOSSIngestion