Todos os produtos
Search
Central de documentação

Object Storage Service:Usar o Spark em um cluster EMR para processar dados armazenados no OSS-HDFS

Última atualização: Jul 03, 2026

Este tópico descreve como usar o Spark em um cluster E-MapReduce (EMR) para processar dados armazenados no OSS-HDFS.

Pré-requisitos

Procedimento

  1. Execute o seguinte comando no terminal para iniciar o Spark Shell:

    spark-shell
  2. Use o Spark para acessar o OSS-HDFS.

    1. Crie uma tabela.

      spark.sql("CREATE TABLE test_oss (`c1` string) OPTIONS (PATH 'oss://examplebucket.cn-hangzhou.oss-dls.aliyuncs.com/dir')")
    2. Insira dados na tabela.

      spark.sql("INSERT INTO TABLE test_oss SELECT 'testdata' AS c1")
    3. Consulte os dados da tabela.

      spark.sql("SELECT c1 FROM test_oss")