Vous pouvez importer des fichiers journaux depuis des compartiments Object Storage Service (OSS) vers Simple Log Service afin de les interroger, de les analyser et de les transformer. Simple Log Service importe des objets OSS d'une taille maximale de 5 Go. Pour les objets compressés, cette limite s'applique à leur taille compressée.
Facturation
Simple Log Service ne facture pas la fonctionnalité d'importation de données. Toutefois, cette fonctionnalité appelle les API Object Storage Service (OSS), ce qui engendre des frais de trafic et des frais de requête OSS. Pour plus d'informations sur la tarification des éléments facturables concernés, consultez Tarification OSS. Les frais quotidiens OSS liés à l'importation de données depuis OSS sont calculés selon la formule suivante :
![]()
Prérequis
Les fichiers journaux sont chargés dans un compartiment Object Storage Service (OSS). Pour plus d'informations, consultez Charger des objets.
Un projet et un Logstore ont été créés. Pour plus d'informations, consultez Gérer les projets et Créer un Logstore de base.
Vous avez effectué l'autorisation d'accès aux ressources cloud, qui autorise Simple Log Service à accéder à vos ressources OSS avec le rôle AliyunLogImportOSSRole.
-
Votre compte dispose de l'autorisation oss:ListBuckets pour répertorier les compartiments OSS. Pour plus d'informations, consultez Attacher une stratégie personnalisée à un utilisateur RAM.
Si vous utilisez un utilisateur RAM, vous devez également lui accorder l'autorisation PassRole. Pour plus d'informations, consultez Créer une stratégie personnalisée et Gérer les autorisations des utilisateurs RAM.
{ "Statement": [ { "Effect": "Allow", "Action": ["ram:PassRole", "ram:GetRole"], "Resource": "acs:ram:*:*:role/aliyunlogimportossrole" }, { "Effect": "Allow", "Action": "oss:GetBucketWebsite", "Resource": "*" }, { "Effect": "Allow", "Action": "oss:ListBuckets", "Resource": "*" } ], "Version": "1" }Si vous souhaitez importer des données entre différents comptes, le compte racine B doit d'abord autoriser le compte A et un rôle au sein du compte A à l'aide d'une stratégie de compartiment dans la console OSS. Exemple de rôle :
acs:ram::123456789:role/aliyunlogimportossrole.
Créer une configuration d'importation de données
Si vous ajoutez des données à un fichier OSS qui a déjà été importé, la tâche d'importation réimporte l'intégralité du fichier.
Connectez-vous à la console Simple Log Service.
Dans la section Import Data, cliquez sur l'onglet Data Import, puis sur OSS - Data Import.
Sélectionnez le projet et le Logstore de destination, puis cliquez sur Next.
-
Configurez les paramètres d'importation.
-
À l'étape Import Configuration, configurez les paramètres suivants.
Cliquez sur Preview pour prévisualiser les résultats de l'importation.
Une fois les paramètres confirmés, cliquez sur Next.
-
-
Créez des index et prévisualisez les données. Ensuite, cliquez sur Next. Par défaut, l'indexation en texte intégral est activée dans Simple Log Service. Vous pouvez également créer manuellement des index de champ pour les journaux collectés ou cliquer sur Automatic Index Generation. Simple Log Service génère alors des index de champ. Pour plus d'informations, consultez Créer des index.
ImportantSi vous souhaitez interroger tous les champs des journaux, nous vous recommandons d'utiliser des index en texte intégral. Si vous souhaitez interroger uniquement des champs spécifiques, nous vous recommandons d'utiliser des index de champ. Cela permet de réduire le trafic lié aux index. Si vous souhaitez analyser des champs, vous devez créer des index de champ. Vous devez inclure une instruction SELECT dans votre instruction de requête pour l'analyse.
-
Cliquez sur Query Log pour ouvrir la page de requête et d'analyse et vérifier si les données OSS ont été importées avec succès.
Attendez environ une minute. Si les données OSS cibles apparaissent, l'importation a réussi.
Opérations connexes
Après avoir créé une configuration d'importation de données, vous pouvez consulter cette configuration ainsi que ses rapports statistiques dans la console.
Dans la liste Project, cliquez sur le projet souhaité.
Dans le volet de navigation de gauche, choisissez . Sur la page qui s'affiche, localisez le Logstore souhaité, choisissez , puis cliquez sur le nom de la configuration.
-
Aperçu
Sur la page Import Configuration Overview, vous pouvez consulter les informations de base de la configuration ainsi que les rapports statistiques.
La page Import Configuration Overview contient les informations suivantes : La section Basic Information affiche des paramètres tels que Configuration Name, Status, Bucket, Compression Format, Encoding Format, File Path Regex Filter, Import Archive Files, OSS Region, New File Check Interval, Data Format et Use System Time. La section Statistical Reports (Data Processing Insight) présente six métriques : Successful Reads, Failed Reads, Public Read Traffic, Successful Writes, Failed Writes et Public Write Traffic, ainsi qu'un graphique linéaire du taux de traitement et un graphique du décalage de progression. Le tableau Running Status en bas de page répertorie les informations relatives à chaque tâche, telles que Time, Type, Instance, Successful Items, Failed Items et Average Response Time. Dans le coin supérieur droit, vous trouverez les boutons d'action Edit Configurations, Stop et Delete Configuration.
Modifier
Cliquez sur Edit Configurations pour modifier la configuration d'importation de données. Pour plus d'informations, consultez la rubrique Créer une configuration d'importation de données.
Supprimer
Cliquez sur Delete Configuration pour supprimer la configuration d'importation de données.
AvertissementCette opération est irréversible. Procédez avec prudence.
Arrêter
Pour arrêter la tâche d'importation de données, cliquez sur Stop.
Démarrer
Cliquez sur Start pour démarrer la tâche d'importation de données.
FAQ
Problème | Cause possible | Solution |
Lorsque je prévisualise les fichiers d'un répertoire HDFS dans mon bucket, aucune donnée ne s'affiche. | L'importation directe de fichiers depuis un répertoire HDFS n'est pas prise en charge. | Si le service HDFS est activé pour le bucket, un répertoire |
Aucune donnée ne s'affiche lors de la prévisualisation. | Le bucket OSS ne contient aucun fichier, les fichiers sont vides ou aucun fichier ne correspond aux conditions de filtrage. |
|
Les données importées contiennent des caractères illisibles. | Le format des données, le format de compression ou le format d'encodage est incorrect. | Vérifiez le format réel du fichier OSS, puis ajustez les paramètres tels que Data Format, Compression Format ou Encoding Format. Pour corriger les données illisibles existantes, créez un nouveau Logstore et une nouvelle configuration d'importation de données. |
Les horodatages dans Simple Log Service ne correspondent pas aux horodatages des données source. | La configuration d'importation de données ne comporte pas le champ d'heure du journal, ou le format d'heure ou le fuseau horaire est incorrect. | Spécifiez le champ d'heure du journal et configurez le format d'heure et le fuseau horaire corrects. Pour plus d'informations, consultez la rubrique Créer une configuration d'importation de données. |
Après l'importation des données, je ne peux pas les interroger ni les analyser. |
|
|
Le nombre d'entrées importées est inférieur aux attentes. | Certains fichiers contiennent des lignes de données uniques dépassant la limite de 3 Mo et sont ignorés pendant le processus d'importation. Pour plus d'informations, consultez la rubrique Limites de collecte. | Lorsque vous écrivez des données dans les fichiers OSS, veillez à ce qu'aucune ligne de données ne dépasse 3 Mo. |
Lorsque je crée une configuration d'importation de données, je ne peux pas sélectionner de bucket OSS. | Simple Log Service n'a pas été autorisé à endosser le rôle | Effectuez l'autorisation comme décrit dans les prérequis. |
Certains fichiers ne sont pas importés. | Les conditions de filtrage sont mal configurées ou certains fichiers dépassent la limite de taille de 5 Go. Pour plus d'informations, consultez la rubrique Limites de collecte. |
|
Les fichiers d'archive ne sont pas importés. | L'option Import Archive Files est désactivée. Pour plus d'informations, consultez la rubrique Limites de collecte. |
|
Les journaux texte multilignes sont analysés incorrectement. | L'expression régulière de première ligne ou de dernière ligne est mal configurée. | Corrigez les expressions régulières de première et de dernière ligne. |
La latence d'importation des nouveaux fichiers est élevée. | Il y a trop de fichiers existants correspondant au filtre de préfixe de chemin de fichier et l'option OSS Metadata Indexing est désactivée dans la configuration d'importation de données. | Si un grand nombre de fichiers (plus d'un million) correspondent au filtre de préfixe de chemin de fichier, vous devez activer l'option OSS Metadata Indexing dans la configuration d'importation de données. Sinon, la découverte des nouveaux fichiers devient très lente. |
Une erreur d'autorisation liée à STS se produit lors de la création. | L'utilisateur RAM ne dispose pas d'autorisations suffisantes. |
|
Gestion des erreurs
Erreur | Description |
Échec de lecture de l'objet | Si une tâche d'importation de données ne parvient pas à lire complètement un objet, par exemple en raison d'une exception réseau ou d'une corruption de l'objet, elle effectue automatiquement des nouvelles tentatives. Si l'opération de lecture échoue toujours après trois tentatives, la tâche ignore l'objet. L'intervalle entre les tentatives est identique au cycle de vérification des nouveaux fichiers. Si le cycle de vérification des nouveaux fichiers est défini sur Never Check, la tâche effectue une nouvelle tentative après 5 minutes. |
Erreur d'analyse du format de compression | Si une tâche d'importation de données rencontre un objet dont le format de compression est invalide, elle ignore l'objet. |
Erreur d'analyse du format de données |
|
Bucket OSS introuvable | La tâche d'importation de données effectue des nouvelles tentatives périodiques. La tâche reprend automatiquement l'importation après la recréation du bucket OSS. |
Erreur d'autorisation | Si une erreur d'autorisation se produit lors de la lecture depuis un bucket OSS ou de l'écriture dans un Logstore, la tâche d'importation de données effectue des nouvelles tentatives périodiques. La tâche reprend automatiquement une fois le problème d'autorisation résolu. La tâche d'importation de données n'ignore aucun objet en cas d'erreur d'autorisation. Par conséquent, après la correction des autorisations, la tâche traite tous les objets non traités dans le bucket OSS, en important leurs données dans le Logstore. |
API d'ingestion OSS
|
Actions |
API |
|
Créer une tâche d'importation de données OSS |
|
|
Mettre à jour une tâche d'importation de données OSS |
|
|
Obtenir une tâche d'importation de données OSS |
|
|
Supprimer une tâche d'importation de données OSS |
|
|
Démarrer une tâche d'importation de données OSS |
|
|
Arrêter une tâche d'importation de données OSS |