Tous les produits
Search
Centre de documentation

Simple Log Service:Importation de données OSS

Dernière mise à jour :Aug 31, 2026

Vous pouvez importer des fichiers journaux depuis des compartiments Object Storage Service (OSS) vers Simple Log Service afin de les interroger, de les analyser et de les transformer. Simple Log Service importe des objets OSS d'une taille maximale de 5 Go. Pour les objets compressés, cette limite s'applique à leur taille compressée.

Facturation

Simple Log Service ne facture pas la fonctionnalité d'importation de données. Toutefois, cette fonctionnalité appelle les API Object Storage Service (OSS), ce qui engendre des frais de trafic et des frais de requête OSS. Pour plus d'informations sur la tarification des éléments facturables concernés, consultez Tarification OSS. Les frais quotidiens OSS liés à l'importation de données depuis OSS sont calculés selon la formule suivante :

image..png

Paramètres de facturation

Paramètre

Description

N

Le nombre de fichiers importés par jour.

T

Le volume total de données importées par jour, en Go.

p_read

Le tarif du trafic par Go de données.

  • Si vous importez des données au sein de la même région, un trafic sortant interne est généré. Ce trafic est gratuit.

  • Si vous importez des données entre différentes régions, un trafic Internet sortant est généré.

p_put

Le tarif pour 10 000 requêtes PUT.

Simple Log Service appelle l'opération d'API ListObjects pour répertorier les fichiers dans le compartiment source. OSS facture l'opération ListObjects comme des requêtes PUT. Chaque appel d'API peut renvoyer jusqu'à 1 000 objets. Par exemple, si vous avez 1 000 000 nouveaux fichiers à importer, 1 000 requêtes sont nécessaires (1 000 000 fichiers / 1 000 fichiers par requête).

p_get

Le tarif pour 10 000 requêtes GET.

M

L'intervalle de vérification des nouveaux fichiers, en minutes.

Lorsque vous créez une configuration d'importation de données, vous pouvez définir le paramètre New File Check Cycle.

Prérequis

  • Les fichiers journaux sont chargés dans un compartiment Object Storage Service (OSS). Pour plus d'informations, consultez Charger des objets.

  • Un projet et un Logstore ont été créés. Pour plus d'informations, consultez Gérer les projets et Créer un Logstore de base.

  • Vous avez effectué l'autorisation d'accès aux ressources cloud, qui autorise Simple Log Service à accéder à vos ressources OSS avec le rôle AliyunLogImportOSSRole.

  • Votre compte dispose de l'autorisation oss:ListBuckets pour répertorier les compartiments OSS. Pour plus d'informations, consultez Attacher une stratégie personnalisée à un utilisateur RAM.

    Si vous utilisez un utilisateur RAM, vous devez également lui accorder l'autorisation PassRole. Pour plus d'informations, consultez Créer une stratégie personnalisée et Gérer les autorisations des utilisateurs RAM.

    {
      "Statement": [
        {
          "Effect": "Allow",
          "Action": ["ram:PassRole", "ram:GetRole"],
          "Resource": "acs:ram:*:*:role/aliyunlogimportossrole"
        },
        {
          "Effect": "Allow",
          "Action": "oss:GetBucketWebsite",
          "Resource": "*"
        },
        {
          "Effect": "Allow",
          "Action": "oss:ListBuckets",
          "Resource": "*"
        }
      ],
      "Version": "1"
    }    

    Si vous souhaitez importer des données entre différents comptes, le compte racine B doit d'abord autoriser le compte A et un rôle au sein du compte A à l'aide d'une stratégie de compartiment dans la console OSS. Exemple de rôle : acs:ram::123456789:role/aliyunlogimportossrole.

    Autorisation entre comptes

    Effectuez les étapes suivantes en tant que compte B, propriétaire du compartiment OSS, pour accorder un accès en lecture au compartiment au compte A et au rôle d'importation sous le compte A.

    1. Connectez-vous à la console OSS en tant que compte B.

    2. Dans la liste Buckets, cliquez sur le compartiment cible.

    3. Dans le volet de navigation de gauche, cliquez sur Bucket Policy, puis sur Add Authorization.

    4. Accordez l'accès au compte A : définissez Resource sur l'intégralité du compartiment, définissez Authorized User sur Other Accounts et saisissez l'ID de compte (UID) du compte A, configurez les Actions requises, puis cliquez sur OK.

    5. Générez la stratégie pour le rôle d'importation sous le compte A : saisissez le rôle (par exemple, acs:ram::123456789:role/aliyunlogimportossrole), cliquez sur Generate Policy, ajustez Action dans la stratégie générée, puis enregistrez-la.

    6. Après avoir enregistré la stratégie, une nouvelle entrée apparaît dans la liste Bucket Policy. Cette entrée correspond à la stratégie pour ce rôle sous le compte A.

    Une fois l'autorisation terminée, le compte A peut sélectionner le compartiment du compte B lors de la création d'une configuration d'importation de données OSS.

Créer une configuration d'importation de données

Important

Si vous ajoutez des données à un fichier OSS qui a déjà été importé, la tâche d'importation réimporte l'intégralité du fichier.

  1. Connectez-vous à la console Simple Log Service.

  2. Dans la section Import Data, cliquez sur l'onglet Data Import, puis sur OSS - Data Import.

  3. Sélectionnez le projet et le Logstore de destination, puis cliquez sur Next.

  4. Configurez les paramètres d'importation.

    1. À l'étape Import Configuration, configurez les paramètres suivants.

      Paramètres

      Paramètre

      Description

      Task Name

      Nom unique de la tâche d'importation.

      Display Name

      Nom d'affichage de la tâche.

      Job Description

      Description de la tâche d'importation.

      OSS Region

      Région dans laquelle se trouve le bucket OSS source.

      Si le bucket OSS et le projet Log Service se trouvent dans la même région, vous pouvez réduire les coûts de trafic réseau public et bénéficier d'un transfert de données plus rapide.

      Bucket

      Bucket source contenant les fichiers de données à importer.

      File Path Prefix Filter

      Filtre les fichiers OSS en fonction d'un préfixe de chemin d'accès. Par exemple, si tous les fichiers à importer se trouvent dans le répertoire csv/, vous pouvez spécifier le préfixe csv/.

      Si vous ne définissez pas ce paramètre, la tâche parcourt l'intégralité du bucket OSS.

      Remarque

      Nous vous recommandons de configurer ce paramètre. Si un bucket contient un grand nombre de fichiers, le parcours intégral du bucket réduit considérablement l'efficacité de l'importation des données.

      File Path Regex Filter

      Filtre les fichiers OSS en faisant correspondre leurs chemins d'accès à une expression régulière. Seuls les fichiers dont les chemins correspondent à l'expression régulière sont importés. Par défaut, ce paramètre est vide, ce qui signifie qu'aucun filtrage n'est appliqué.

      Par exemple, si le chemin d'accès au fichier est testdata/csv/bill.csv, vous pouvez définir l'expression régulière sur (testdata/csv/)(.*).

      Pour plus d'informations sur la façon de tester une expression régulière, consultez Comment tester une expression régulièreComment tester une expression régulière.

      File Modification Time Filter

      Filtre les fichiers OSS en fonction de leur heure de modification.

      • All : sélectionnez cette option pour importer tous les fichiers correspondants.

      • From Specific Time : sélectionnez cette option pour importer les fichiers modifiés après un moment précis.

      • Specific Time Range : sélectionnez cette option pour importer les fichiers modifiés dans une plage horaire spécifique.

      Data Format

      Format d'analyse du fichier. Valeurs possibles :

      • CSV : fichier texte délimité. Vous pouvez utiliser la première ligne comme noms de champs ou spécifier manuellement les noms de champs. Chaque ligne suivante est analysée comme une entrée de journal.

      • Single-line JSON : lit le fichier OSS ligne par ligne, en analysant chaque ligne comme un objet JSON distinct. Les clés de l'objet JSON deviennent les noms de champs dans le journal.

      • JSON array : lit l'intégralité du fichier OSS en une seule fois. Le contenu du fichier doit être un tableau JSON contenant un ou plusieurs objets JSON.

      • CloudTrail : lit l'intégralité du fichier OSS en une seule fois. Le contenu doit respecter le format de structure de données CloudTrail standard.

      • Single-line Text Log : analyse chaque ligne du fichier OSS comme une entrée de journal unique.

      • Multi-line Text Logs : mode multiligne qui utilise une expression régulière pour identifier le début ou la fin d'une entrée de journal s'étendant sur plusieurs lignes.

      • ORC : format Optimized Row Columnar (ORC). Le fichier est automatiquement analysé en journaux sans configuration supplémentaire.

      • Parquet : format Parquet. Le fichier est automatiquement analysé en journaux sans configuration supplémentaire.

      • Alibaba Cloud OSS Access Log : format des journaux d'accès Alibaba Cloud OSS. Pour plus d'informations, consultez Expédition des journaux.

      • Alibaba Cloud CDN Download Log : format des journaux de téléchargement Alibaba Cloud CDN. Pour plus d'informations, consultez Démarrage rapide.

      Compression Format

      Format de compression des fichiers sources. Log Service décompresse les fichiers selon le format spécifié avant de lire les données.

      Encoding Format

      Format d'encodage des fichiers sources. Actuellement, seuls les formats UTF-8 et GBK sont pris en charge.

      New File Check Cycle

      Si de nouveaux fichiers sont continuellement ajoutés au chemin OSS source, vous pouvez définir un New File Check Cycle. La tâche d'importation s'exécute en arrière-plan et découvre et lit périodiquement les nouveaux fichiers. Le système garantit que les données d'un même fichier OSS ne sont pas importées plusieurs fois. Par exemple, si vous créez une tâche à 12 h 00 avec un cycle de vérification de 30 minutes, la première importation s'exécute à 12 h 00. Si de nouveaux fichiers sont générés, la prochaine importation s'exécute à 12 h 30.

      Si aucun nouveau fichier n'est attendu dans le chemin OSS source, définissez le cycle sur Never Check. La tâche d'importation s'arrête après avoir lu tous les fichiers existants correspondant aux critères.

      Import Archive Files

      Si les fichiers sources sont stockés sous les classes de stockage Archive ou Cold Archive dans OSS, ils doivent être restaurés avant de pouvoir être lus. Activez cette option pour restaurer automatiquement les fichiers. La classe de stockage Deep Cold Archive n'est pas prise en charge.

      Remarque
      • La restauration des fichiers Archive prend environ une minute, ce qui peut entraîner un dépassement du délai lors de la prévisualisation initiale. En cas de dépassement du délai, attendez quelques instants et réessayez.

      • La restauration des fichiers Cold Archive prend environ une heure. Si la prévisualisation expire, vous pouvez ignorer la prévisualisation ou attendre une heure avant de réessayer.

        Lors de la restauration des fichiers Cold Archive, les copies restaurées restent disponibles pendant sept jours afin de garantir un temps suffisant pour l'importation.

      Log Time Configuration

      Time Field

      Lorsque vous sélectionnez Data Format, Single-line JSON, Single-line JSON, CloudTrail, ORC, Parquet, Alibaba Cloud OSS Access Log ou Alibaba Cloud CDN Download Log comme Data Format, vous devez spécifier un champ temporel. Log Service utilise ce champ pour définir l'heure de chaque entrée de journal importée.

      Time Field Extraction Regular Expression

      Lorsque vous sélectionnez Data Format ou Single-line Text Log comme Multi-line Text Logs, vous devez utiliser une expression régulière pour extraire l'heure du contenu du journal.

      Par exemple, pour l'entrée de journal 127.0.0.1 - - [10/Sep/2018:12:36:49 +0800] "GET /index.html HTTP/1,1", vous pouvez définir Time Field Extraction Regular Expression sur [0-9]{0,2}\/[0-9a-zA-Z]+\/[0-9\: +]+.

      Remarque

      Pour les autres formats de données, vous pouvez également utiliser une expression régulière si vous devez extraire uniquement une partie du champ temporel.

      Time Field Format

      Spécifie le format temporel utilisé pour analyser la valeur du champ temporel.

      • Prend en charge la syntaxe SimpleDateFormat de Java, telle que yyyy-MM-dd HH:mm:ss. Pour plus d'informations sur la syntaxe, consultez Class SimpleDateFormat. Pour les formats temporels courants, consultez Formats temporels.

      • Prend en charge les formats epoch, notamment epoch, epochMillis, epochMicro et epochNano.

      Time Zone

      Sélectionnez le fuseau horaire du champ temporel. Ce paramètre n'est pas requis si le format temporel est de type epoch.

      Pour prendre en compte l'heure d'été lors de l'analyse de l'heure du journal, sélectionnez un format basé sur UTC. Sinon, sélectionnez un format basé sur GMT.

      Advanced Settings

      OSS Metadata Indexing

      Si le nombre de fichiers dans votre bucket OSS dépasse un million, nous vous recommandons vivement d'activer cette option. Sinon, la découverte des fichiers est inefficace. Avec l'indexation des métadonnées OSS, les nouveaux fichiers du bucket peuvent être découverts en quelques secondes, permettant une importation de données en quasi temps réel.

      Pour utiliser l'indexation des métadonnées OSS, vous devez d'abord activer la fonctionnalité de gestion des métadonnées pour le bucket dans la console OSS. Pour plus d'informations, consultez Recherche scalaire.

      Si vous sélectionnez Data Format ou Multi-line text log comme Multi-line Text Logs, vous devez configurer des paramètres supplémentaires comme décrit dans les tableaux suivants.

      CSV

      Paramètre

      Description

      Delimiter

      Délimiteur utilisé pour séparer les champs dans le journal. La valeur par défaut est une virgule (,).

      Quote

      Caractère de guillemet utilisé pour les chaînes dans le fichier CSV.

      Quote

      Caractère d'échappement pour les journaux. La valeur par défaut est une barre oblique inverse (\\).

      Maximum Lines

      Nombre maximal de lignes qu'une seule entrée de journal peut couvrir. La valeur par défaut est 1.

      First Line as Field Name

      Après avoir activé l'option First Line as Field Name, la première ligne du fichier CSV est utilisée comme noms de champs. Par exemple, la première ligne de l'exemple suivant est extraite comme noms des champs de journal. Aperçu du fichier exemple :

      remote_addr,remote_user,time_local,request_time,request_length
      xxx,5,-,11/Dec/2020:15:31:06,0,000,133,3650,404,GET
      xxx,5,-,11/Dec/2020:15:32:06,0,000,133,3650,404,GET
      xxx,5,-,11/Dec/2020:15:34:10,0,000,133,3650,404,GET

      Custom Fields

      Si vous désactivez l'option First Line as Field Name, vous devez spécifier une liste de noms de champs personnalisés séparés par des virgules.

      Lines to Skip

      Nombre de lignes d'en-tête à ignorer. Par exemple, une valeur de 1 signifie que la collecte des données commence à partir de la deuxième ligne du fichier CSV.

      Journal texte multiligne

      Paramètre

      Description

      Position to Match Regular Expression

      Spécifie où faire correspondre l'expression régulière :

      • Regular Expression to Match First Line : utilise une expression régulière pour faire correspondre la première ligne d'une entrée de journal. Les lignes suivantes qui ne correspondent pas sont ajoutées à l'entrée de journal actuelle, jusqu'au nombre maximal de lignes configuré.

      • Regular Expression to Match Last Line : utilise une expression régulière pour identifier la fin d'une entrée de journal. Une entrée de journal inclut toutes les lignes jusqu'à et y compris la ligne qui correspond à cette expression.

      Regular Expression

      Saisissez une expression régulière en fonction du contenu de votre journal.

      Pour plus d'informations, consultez Comment tester une expression régulièreComment tester une expression régulière.

      Maximum Lines

      Nombre maximal de lignes qu'une seule entrée de journal peut couvrir.

    2. Cliquez sur Preview pour prévisualiser les résultats de l'importation.

    3. Une fois les paramètres confirmés, cliquez sur Next.

  5. Créez des index et prévisualisez les données. Ensuite, cliquez sur Next. Par défaut, l'indexation en texte intégral est activée dans Simple Log Service. Vous pouvez également créer manuellement des index de champ pour les journaux collectés ou cliquer sur Automatic Index Generation. Simple Log Service génère alors des index de champ. Pour plus d'informations, consultez Créer des index.

    Important

    Si vous souhaitez interroger tous les champs des journaux, nous vous recommandons d'utiliser des index en texte intégral. Si vous souhaitez interroger uniquement des champs spécifiques, nous vous recommandons d'utiliser des index de champ. Cela permet de réduire le trafic lié aux index. Si vous souhaitez analyser des champs, vous devez créer des index de champ. Vous devez inclure une instruction SELECT dans votre instruction de requête pour l'analyse.

  6. Cliquez sur Query Log pour ouvrir la page de requête et d'analyse et vérifier si les données OSS ont été importées avec succès.

    Attendez environ une minute. Si les données OSS cibles apparaissent, l'importation a réussi.

Opérations connexes

Après avoir créé une configuration d'importation de données, vous pouvez consulter cette configuration ainsi que ses rapports statistiques dans la console.

  1. Dans la liste Project, cliquez sur le projet souhaité.

  2. Dans le volet de navigation de gauche, choisissez Log Storage > Logstore. Sur la page qui s'affiche, localisez le Logstore souhaité, choisissez Data Collection > Data Import, puis cliquez sur le nom de la configuration.

  3. Aperçu

    Sur la page Import Configuration Overview, vous pouvez consulter les informations de base de la configuration ainsi que les rapports statistiques.

    La page Import Configuration Overview contient les informations suivantes : La section Basic Information affiche des paramètres tels que Configuration Name, Status, Bucket, Compression Format, Encoding Format, File Path Regex Filter, Import Archive Files, OSS Region, New File Check Interval, Data Format et Use System Time. La section Statistical Reports (Data Processing Insight) présente six métriques : Successful Reads, Failed Reads, Public Read Traffic, Successful Writes, Failed Writes et Public Write Traffic, ainsi qu'un graphique linéaire du taux de traitement et un graphique du décalage de progression. Le tableau Running Status en bas de page répertorie les informations relatives à chaque tâche, telles que Time, Type, Instance, Successful Items, Failed Items et Average Response Time. Dans le coin supérieur droit, vous trouverez les boutons d'action Edit Configurations, Stop et Delete Configuration.

    Modifier

    Cliquez sur Edit Configurations pour modifier la configuration d'importation de données. Pour plus d'informations, consultez la rubrique Créer une configuration d'importation de données.

    Supprimer

    Cliquez sur Delete Configuration pour supprimer la configuration d'importation de données.

    Avertissement

    Cette opération est irréversible. Procédez avec prudence.

    Arrêter

    Pour arrêter la tâche d'importation de données, cliquez sur Stop.

    Démarrer

    Cliquez sur Start pour démarrer la tâche d'importation de données.

FAQ

Problème

Cause possible

Solution

Lorsque je prévisualise les fichiers d'un répertoire HDFS dans mon bucket, aucune donnée ne s'affiche.

L'importation directe de fichiers depuis un répertoire HDFS n'est pas prise en charge.

Si le service HDFS est activé pour le bucket, un répertoire .dlsdata est créé par défaut dans le chemin OSS. Vous pouvez importer les fichiers depuis le répertoire .dlsdata.

Aucune donnée ne s'affiche lors de la prévisualisation.

Le bucket OSS ne contient aucun fichier, les fichiers sont vides ou aucun fichier ne correspond aux conditions de filtrage.

  • Vérifiez que le bucket contient des fichiers non vides. Pour les fichiers CSV, assurez-vous qu'ils contiennent plus qu'une simple ligne d'en-tête. Si ce n'est pas le cas, attendez que les données soient disponibles avant de démarrer l'importation.

  • Ajustez les éléments de configuration tels que le File Path Prefix Filter, le File Path Regex Filter et le File Modification Time Filter.

Les données importées contiennent des caractères illisibles.

Le format des données, le format de compression ou le format d'encodage est incorrect.

Vérifiez le format réel du fichier OSS, puis ajustez les paramètres tels que Data Format, Compression Format ou Encoding Format.

Pour corriger les données illisibles existantes, créez un nouveau Logstore et une nouvelle configuration d'importation de données.

Les horodatages dans Simple Log Service ne correspondent pas aux horodatages des données source.

La configuration d'importation de données ne comporte pas le champ d'heure du journal, ou le format d'heure ou le fuseau horaire est incorrect.

Spécifiez le champ d'heure du journal et configurez le format d'heure et le fuseau horaire corrects. Pour plus d'informations, consultez la rubrique Créer une configuration d'importation de données.

Après l'importation des données, je ne peux pas les interroger ni les analyser.

  • Les données se situent en dehors de la plage de temps de la requête.

  • Aucun index n'est configuré.

  • L'index n'a pas encore pris effet.

  • Vérifiez si les données que vous souhaitez interroger se trouvent dans la plage de temps spécifiée. Si ce n'est pas le cas, ajustez la plage de temps et relancez la requête.

    Si les données ne figurent pas dans la plage de requête, ajustez celle-ci et effectuez une nouvelle recherche.

  • Vérifiez si un index a été défini pour le Logstore.

    Si aucun index n'est défini, commencez par en créer un. Pour plus d'informations, consultez les rubriques Créer un index ou Reconstruire un index.

  • Si vous avez défini un index et que le volume de données importées avec succès indiqué dans le tableau de bord Data Processing Insight correspond à vos attentes, il est possible que l'index n'ait pas encore pris effet. Essayez de réindexer les données. Pour plus d'informations, consultez la rubrique Réindexer les données.

Le nombre d'entrées importées est inférieur aux attentes.

Certains fichiers contiennent des lignes de données uniques dépassant la limite de 3 Mo et sont ignorés pendant le processus d'importation. Pour plus d'informations, consultez la rubrique Limites de collecte.

Lorsque vous écrivez des données dans les fichiers OSS, veillez à ce qu'aucune ligne de données ne dépasse 3 Mo.

Lorsque je crée une configuration d'importation de données, je ne peux pas sélectionner de bucket OSS.

Simple Log Service n'a pas été autorisé à endosser le rôle AliyunLogImportOSSRole.

Effectuez l'autorisation comme décrit dans les prérequis.

Certains fichiers ne sont pas importés.

Les conditions de filtrage sont mal configurées ou certains fichiers dépassent la limite de taille de 5 Go. Pour plus d'informations, consultez la rubrique Limites de collecte.

  • Vérifiez si les fichiers à importer correspondent aux conditions de filtrage. Si ce n'est pas le cas, modifiez les conditions de filtrage.

  • Assurez-vous que la taille de chaque fichier à importer est inférieure à 5 Go. Si un fichier dépasse cette limite, vous devez réduire sa taille.

    Si un fichier unique dépasse 5 Go, réduisez sa taille.

Les fichiers d'archive ne sont pas importés.

L'option Import Archive Files est désactivée. Pour plus d'informations, consultez la rubrique Limites de collecte.

  • Méthode 1 : Modifiez la configuration d'importation de données et activez l'option Import Archive Files.

  • Méthode 2 : Créez une nouvelle configuration d'importation de données et activez l'option Import Archive Files.

Les journaux texte multilignes sont analysés incorrectement.

L'expression régulière de première ligne ou de dernière ligne est mal configurée.

Corrigez les expressions régulières de première et de dernière ligne.

La latence d'importation des nouveaux fichiers est élevée.

Il y a trop de fichiers existants correspondant au filtre de préfixe de chemin de fichier et l'option OSS Metadata Indexing est désactivée dans la configuration d'importation de données.

Si un grand nombre de fichiers (plus d'un million) correspondent au filtre de préfixe de chemin de fichier, vous devez activer l'option OSS Metadata Indexing dans la configuration d'importation de données. Sinon, la découverte des nouveaux fichiers devient très lente.

Une erreur d'autorisation liée à STS se produit lors de la création.

L'utilisateur RAM ne dispose pas d'autorisations suffisantes.

  1. Vérifiez que la clé AccessKey de l'utilisateur RAM est valide et activée. Pour plus d'informations, consultez la rubrique Paire de clés AccessKey.

  2. Vérifiez si les identifiants d'accès temporaires de l'utilisateur RAM (jeton STS) ont expiré. Si c'est le cas, prolongez leur période de validité. Pour plus d'informations, consultez la rubrique Accéder à OSS à l'aide d'identifiants temporaires STS.

  3. Vérifiez que vous avez effectué l'autorisation d'accès aux ressources cloud, qui accorde à Simple Log Service l'autorisation d'accéder à vos ressources OSS en endossant le rôle AliyunLogImportOSSRole.

Gestion des erreurs

Erreur

Description

Échec de lecture de l'objet

Si une tâche d'importation de données ne parvient pas à lire complètement un objet, par exemple en raison d'une exception réseau ou d'une corruption de l'objet, elle effectue automatiquement des nouvelles tentatives. Si l'opération de lecture échoue toujours après trois tentatives, la tâche ignore l'objet.

L'intervalle entre les tentatives est identique au cycle de vérification des nouveaux fichiers. Si le cycle de vérification des nouveaux fichiers est défini sur Never Check, la tâche effectue une nouvelle tentative après 5 minutes.

Erreur d'analyse du format de compression

Si une tâche d'importation de données rencontre un objet dont le format de compression est invalide, elle ignore l'objet.

Erreur d'analyse du format de données

  • Si la tâche d'importation de données ne parvient pas à analyser un objet dans un format binaire, tel que ORC ou Parquet, elle ignore l'objet.

  • Si l'analyse échoue pour des données dans d'autres formats, la tâche d'importation de données stocke le contenu textuel brut dans le champ content du journal.

Bucket OSS introuvable

La tâche d'importation de données effectue des nouvelles tentatives périodiques. La tâche reprend automatiquement l'importation après la recréation du bucket OSS.

Erreur d'autorisation

Si une erreur d'autorisation se produit lors de la lecture depuis un bucket OSS ou de l'écriture dans un Logstore, la tâche d'importation de données effectue des nouvelles tentatives périodiques. La tâche reprend automatiquement une fois le problème d'autorisation résolu.

La tâche d'importation de données n'ignore aucun objet en cas d'erreur d'autorisation. Par conséquent, après la correction des autorisations, la tâche traite tous les objets non traités dans le bucket OSS, en important leurs données dans le Logstore.

API d'ingestion OSS

Actions

API

Créer une tâche d'importation de données OSS

CreateOSSIngestion

Mettre à jour une tâche d'importation de données OSS

UpdateOSSIngestion

Obtenir une tâche d'importation de données OSS

GetOSSIngestion

Supprimer une tâche d'importation de données OSS

DeleteOSSIngestion

Démarrer une tâche d'importation de données OSS

StartOSSIngestion

Arrêter une tâche d'importation de données OSS

StopOSSIngestion