Les jobs MaxCompute MapReduce lisent les données depuis des tables MaxCompute et y écrivent les résultats.
Types de données pris en charge
MapReduce prend en charge les types de données natifs MaxCompute suivants, tant en entrée qu'en sortie :
|
Catégorie |
Types |
|
Numérique |
BIGINT, DOUBLE |
|
Chaîne |
STRING |
|
Date et heure |
DATETIME |
|
Booléen |
BOOLEAN |
Les types de données définis par l'utilisateur (UDT) ne sont pas pris en charge.
Entrée
|
Fonctionnalité |
Détails |
|
Entrée multi-tables |
Un job peut lire plusieurs tables aux schémas différents. Utilisez la fonction map pour identifier la table d'origine de l'enregistrement actuel. |
|
Valeurs nulles |
Acceptées en entrée. |
|
Vues |
Non prises en charge en entrée. |
Sortie
Un job reduce peut écrire dans :
Plusieurs tables différentes
Plusieurs partitions au sein d'une même table
Les tables cibles peuvent avoir des schémas distincts. Utilisez des libellés pour distinguer les multiples sorties. La sortie par défaut ne comporte aucun libellé.
MapReduce ne prend pas en charge les fonctions qui ne produisent aucune sortie.
Exemple : entrées et sorties multiples
Pour un exemple fonctionnel illustrant l'entrée multi-tables et le routage des sorties basé sur des libellés, consultez l'exemple MultipleInOut.