Stockage de data lake

Construisez un data lake avec Object Storage Service (OSS) d'Alibaba Cloud, offrant une disponibilité de 99,9999999999 % (12 neufs), un SLA de 99,995 % et une haute évolutivité

Aperçu

Le lac de données est une structure d'analyse de données de plus en plus répandue qui prend en charge les charges de travail massives. Alibaba Cloud Data Lake Storage s'appuie sur Object Storage Service (OSS) pour offrir un stockage centralisé des données structurées, semi-structurées et non structurées, ce qui en fait une solution idéale pour les secteurs de l'IoT, du jeu en ligne, de l'enseignement en ligne et de la publicité. OSS s'intègre parfaitement aux principaux écosystèmes big data tels que Hadoop, HIVE, Spark, Presto et Impala.

Points forts de la solution

  • Stockage des données brutes

    Ingérez et stockez centralisées les données de multiples sources dans votre data lake, quelles que soient les structures, le schéma et la taille des données.

  • Base robuste

    Durabilité garantie de 99,9999999999 % (12 neufs), SLA de 99,995 % et reprise après sinistre à distance performante contre les défaillances système.

  • Traitement des données haute performance

    Chargez et téléchargez des données en parallèle grâce à la fonctionnalité Append Object d'OSS, permettant une lecture en temps réel lors de l'ajout de nouvelles données et améliorant l'efficacité de l'analyse des charges de travail.

  • Architecture évolutive et élastique

    Ajustez séparément les ressources de stockage et de calcul selon les besoins métier grâce à une architecture découplée, pour réduire le coût total de possession (TCO).

En savoir plus sur Data Lake Storage

Contacter les ventes

Comment Data Lake Storage d'Alibaba Cloud prend en charge l'éducation, le jeu et la publicité

Vos défis

Les données nécessaires aux scénarios éducatifs, telles que les contenus audio et vidéo, les images, les journaux système et les messages en ligne, sont stockées séparément, créant des silos de données isolés et augmentant les coûts d'analyse et de maintenance.

Notre solution

  • Cette solution utilise OSS comme centre de stockage unifié pour des données structurées et non structurées, offrant un accès simplifié aux sources de données de formation en ligne à l'échelle mondiale pour le téléchargement de supports pédagogiques, notamment des images, des vidéos, ainsi que des fichiers audio et texte. Vous pouvez créer des clusters de calcul avec EMR afin de vous connecter de manière transparente aux services de traitement Big Data tels que Spark, Hive et Presto. Vous pouvez également analyser les résultats des évaluations en fonction des supports de cours, évaluer la qualité d'apprentissage de chaque étudiant et fournir des conseils personnalisés ainsi que des recommandations de contenu précises grâce à des algorithmes intelligents. Vous pouvez associer cette solution à Alibaba Cloud CDN pour diffuser des supports de cours à la demande aux étudiants du monde entier avec une latence ultra-faible.

Object Storage Service

Un service de stockage cloud chiffré et sécurisé permettant de stocker, traiter et accéder à des volumes massifs de données.

En savoir plus

File de messages pour Apache Kafka

Un service Apache Kafka entièrement géré pour vous aider à construire rapidement des pipelines de données pour votre analyse Big Data.

En savoir plus

Vos défis

L'industrie du jeu exige une analytique des données efficace pour ajuster rapidement les scénarios de jeu, ainsi qu'une forte capacité de montée en charge du stockage et de la puissance de calcul pour faire face aux pics de trafic et aux besoins de mise à niveau.

Notre solution

  • Cette solution exploite EMR pour déployer des clusters intégrant différentes plateformes et systèmes de traitement de données, tels que Hadoop et Hive, afin de répondre aux besoins d'analyse de données dans divers scénarios de jeu. Vous pouvez tirer parti d'OSS pour archiver les données froides dans un stockage plus économique et conserver les données chaudes sur des instances hautement disponibles, optimisant ainsi l'utilisation des ressources et les performances. L'architecture combinée OSS et EMR offre une rapidité, une fiabilité et une rentabilité cohérentes avec celles du Hadoop Distributed File System (HDFS). Les instances de stockage et de calcul découplées peuvent être dimensionnées indépendamment pour ajuster les performances du système et évoluer avec souplesse, simplifiant ainsi la gestion et l'exploitation tout en réduisant les coûts de mise à niveau.

Object Storage Service

Un service de stockage cloud chiffré et sécurisé capable de stocker, traiter et accéder à des volumes massifs de données.

En savoir plus

Message Queue for Apache Kafka

Un service Apache Kafka entièrement géré pour vous aider à construire rapidement des pipelines de données pour votre analytique big data.

En savoir plus

DataWorks

Un environnement sécurisé pour le développement de données hors ligne, avec des API ouvertes performantes, pour créer un écosystème de développement secondaire.

En savoir plus

Vos défis

Le secteur de la publicité fait face à un trafic de recherche et à des demandes de contenu en constante évolution, ce qui entraîne des performances insuffisantes ou un gaspillage de ressources en raison de clusters de calcul permanents.

Notre solution

  • Cette solution déploie des plateformes de traitement de données, telles que Hadoop, Hive et Presto, avec des clusters Kubernetes à haute élasticité constitués par ECS. Vous pouvez monter en charge pour absorber les pics de trafic lors d'événements et de promotions, ou réduire la capacité pour réaliser des économies en période de faible trafic. Les données de requêtes en divers formats sont stockées dans OSS ; les données froides sont archivées dans OSS Archive et les données régulièrement consultées sont stockées dans OSS Standard pour une haute disponibilité. Vous pouvez récupérer et gérer les données à l'aide de règles configurables, adapter la capacité de stockage aux besoins métier et optimiser facilement les coûts de stockage. Cette solution utilise Alibaba Cloud Elasticsearch pour une indexation rapide et une recherche précise des données du site web, ainsi que Message Queue for Apache Kafka pour surveiller les activités du site et collecter des statistiques en temps réel. Elle utilise également DLA pour traiter les requêtes interactives et EMR Druid pour les requêtes en temps réel et les requêtes ad hoc. Ces tâches sont traitées par les clusters de calcul (Hadoop, Hive, Presto, etc.) et les résultats sont stockés dans OSS Standard.

Elastic Compute Service (ECS)

Des serveurs cloud virtuels élastiques et sécurisés pour répondre à tous vos besoins d'hébergement cloud.

En savoir plus

Elasticsearch Alibaba Cloud

Un service cloud offrant des intégrations natives telles que Kibana, des fonctionnalités commerciales, ainsi qu'Alibaba Cloud VPC, Cloud Monitor et Resource Access Management.

En savoir plus

Analytique des lacs de données

Un service d'analyse interactive qui vous permet d'utiliser la syntaxe SQL standard et des outils de BI pour analyser vos données stockées dans le cloud à moindre coût.

En savoir plus

En savoir plus sur Data Lake Storage

Contacter les ventes

Sécurité et conformité

Nous nous engageons à fournir des services d'infrastructure de cloud computing stables, fiables, sécurisés et conformes dans les principales juridictions du monde.
En savoir plus
  • CSA STAR
  • ISO 27001
  • Rapport SOC 2 de type II
  • C5
  • MLPS 2.0
  • MTCS

Découvrir les solutions Alibaba Cloud

Découvrir la puissance d'Alibaba Cloud

Contacter les ventes