La fonctionnalité de téléchargement fractionné vous permet de diviser un objet volumineux en plusieurs parties. Une fois ces parties téléchargées, vous pouvez appeler l'opération CompleteMultipartUpload pour les combiner en un objet complet.
Notes
Le point de terminaison public de la région est utilisé par défaut dans cette rubrique. Pour accéder à OSS depuis d'autres services Alibaba Cloud dans la même région, utilisez le point de terminaison interne correspondant. Pour plus d'informations sur la correspondance entre les régions et les points de terminaison d'OSS, reportez-vous à Régions et points de terminaison.
Le téléchargement fractionné nécessite l'autorisation
oss:PutObject. Pour plus d'informations, consultez la section Accorder des autorisations personnalisées à un utilisateur Resource Access Management (RAM).
Processus de téléchargement fractionné
Un téléchargement fractionné se déroule en trois étapes :
-
Initialisez un téléchargement fractionné.
Appelez la méthode Client.InitiateMultipartUpload pour obtenir un ID de téléchargement unique pour OSS.
-
Téléchargez les parties.
Appelez la méthode Client.UploadPart pour télécharger les données des parties.
RemarquePour un ID de téléchargement donné, le numéro de partie identifie chaque partie et sa position relative dans l'objet final. Si vous téléchargez une nouvelle partie en utilisant un numéro de partie existant, la partie d'origine est écrasée.
OSS inclut le hachage MD5 des données de la partie dans l'en-tête ETag de la réponse.
OSS calcule le hachage MD5 des données téléchargées et le compare au hachage calculé par le SDK.
-
Finalisez le téléchargement fractionné.
Appelez la méthode Client.CompleteMultipartUpload pour combiner ces parties en un objet complet.
Exemple de code
L'exemple de code suivant montre comment diviser un fichier local volumineux en plusieurs parties, télécharger les parties dans un bucket, puis les combiner en un objet complet :
import os
import argparse
import alibabacloud_oss_v2 as oss
# Create a command-line parameter parser for the multipart upload sample.
parser = argparse.ArgumentParser(description="multipart upload sample")
# The required --region parameter, which specifies the region in which the bucket is located.
parser.add_argument('--region', help='The region in which the bucket is located.', required=True)
# The required --bucket parameter, which specifies the name of the bucket.
parser.add_argument('--bucket', help='The name of the bucket.', required=True)
# The optional --endpoint parameter, which specifies the endpoint that other services can use to access OSS.
parser.add_argument('--endpoint', help='The domain names that other services can use to access OSS')
# The required --key parameter, which specifies the name of the object.
parser.add_argument('--key', help='The name of the object.', required=True)
# The required --file_path parameter, which specifies the path of the file to upload.
parser.add_argument('--file_path', help='The path of Upload file.', required=True)
def main():
# Parse the command-line parameters.
args = parser.parse_args()
# Obtain access credentials from environment variables for authentication.
credentials_provider = oss.credentials.EnvironmentVariableCredentialsProvider()
# Use the default configuration of the SDK and set the credentials provider.
cfg = oss.config.load_default()
cfg.credentials_provider = credentials_provider
# Specify the region in which the bucket is located.
cfg.region = args.region
# If an endpoint is provided, specify the endpoint in the configuration object.
if args.endpoint is not None:
cfg.endpoint = args.endpoint
# Use the configuration to create an OSSClient instance.
client = oss.Client(cfg)
# Initiate a multipart upload and get the upload ID.
result = client.initiate_multipart_upload(oss.InitiateMultipartUploadRequest(
bucket=args.bucket,
key=args.key,
))
# Define the size of each part as 5MB.
part_size = 5 * 1024 * 1024
# Obtain the total size of the object to upload.
data_size = os.path.getsize(args.file_path)
# Initialize the part number, starting from 1.
part_number = 1
# Store the uploaded part information.
upload_parts = []
# Open the file in binary mode for reading.
with open(args.file_path, 'rb') as f:
# Traverse the file and upload it in parts based on part_size.
for start in range(0, data_size, part_size):
n = part_size
if start + n > data_size: # Handle the case where the last part may be smaller than part_size.
n = data_size - start
# Create a SectionReader to read a specific portion of the file.
reader = oss.io_utils.SectionReader(oss.io_utils.ReadAtReader(f), start, n)
# Upload parts.
up_result = client.upload_part(oss.UploadPartRequest(
bucket=args.bucket,
key=args.key,
upload_id=result.upload_id,
part_number=part_number,
body=reader
))
# Output the upload result of each part.
print(f'status code: {up_result.status_code},'
f' request id: {up_result.request_id},'
f' part number: {part_number},'
f' content md5: {up_result.content_md5},'
f' etag: {up_result.etag},'
f' hash crc64: {up_result.hash_crc64},'
)
# Save the part upload result to the list.
upload_parts.append(oss.UploadPart(part_number=part_number, etag=up_result.etag))
# Increment the part number.
part_number += 1
# Sort the uploaded parts by part number.
parts = sorted(upload_parts, key=lambda p: p.part_number)
# Send a request to complete the multipart upload and combine all parts into a complete object.
result = client.complete_multipart_upload(oss.CompleteMultipartUploadRequest(
bucket=args.bucket,
key=args.key,
upload_id=result.upload_id,
complete_multipart_upload=oss.CompleteMultipartUpload(
parts=parts
)
))
# The following code is another approach that uses the server-side list method to merge all part data into a complete object.
# This method is suitable when you are not sure if all parts have been successfully uploaded.
# Merge fragmented data into a complete Object through the server-side List method
# result = client.complete_multipart_upload(oss.CompleteMultipartUploadRequest(
# bucket=args.bucket,
# key=args.key,
# upload_id=result.upload_id,
# complete_all='yes'
# ))
# Output the result information of the completed multipart upload.
print(f'status code: {result.status_code},'
f' request id: {result.request_id},'
f' bucket: {result.bucket},'
f' key: {result.key},'
f' location: {result.location},'
f' etag: {result.etag},'
f' encoding type: {result.encoding_type},'
f' hash crc64: {result.hash_crc64},'
f' version id: {result.version_id},'
)
if __name__ == "__main__":
main() # The entry point of the script. When the script is directly run, the main function is called.
Scénarios courants
Configurer des rappels de téléchargement pour les tâches de téléchargement fractionné
Afficher la barre de progression pour le téléchargement fractionné
Référence
Pour l'exemple de code complet relatif au téléchargement fractionné, consultez complete_multipart_upload.py.