Modifiez le paramètre Timeline de l'opération SubmitMediaProducingJob pour générer une vidéo intégrant les résultats du traitement intelligent, tels que la reconnaissance vocale, la synthèse vocale et le détourage d'arrière-plan.
Remarques relatives à l'utilisation
La production intelligente prend en charge le montage, la composition, le rendu des effets ainsi que les modèles pour les flux en direct, les fichiers VOD et les ressources issues d'Object Storage Service (OSS). Pour plus d'informations, consultez la section Présentation de la production intelligente.
Vous pouvez générer une vidéo à partir d'une ou plusieurs vidéos, de fichiers audio, d'images et de sous-titres en configurant les paramètres Timeline et en appelant l'opération SubmitMediaProducingJob.
Une timeline est créée lorsque vous ajoutez des ressources et configurez des effets pour créer une vidéo. Une timeline se compose de pistes, de ressources et d'effets. Pour plus d'informations, consultez la section Configurations de la timeline.
Pour savoir comment utiliser le SDK IMS afin de modifier des fichiers audio et vidéo, consultez la section Premiers pas.
Utiliser AI_ASR pour convertir la parole en texte et fusionner les sous-titres dans une vidéo
Définissez « Type » sur « AI_ASR » pour convertir la parole contenue dans un fichier audio ou vidéo en texte. Vous pouvez également définir le style des sous-titres, notamment la police et la couleur.
Le service de reconnaissance vocale est disponible uniquement dans les régions Chine (Shanghai), Chine (Pékin), Chine (Hangzhou) et Chine (Shenzhen).
|
Effet |
Exemple de timeline |
|
Utiliser AI_TTS pour convertir du texte en parole et fusionner l'audio dans une vidéo
Définissez « Type » sur « AI_TTS » pour convertir du texte en parole. Vous pouvez combiner cette fonction avec AI_ASR. Le paramètre Content spécifie le texte à convertir et vous pouvez configurer les propriétés vocales telles que Voice, SpeechRate, PitchRate et Format.
Les services de synthèse vocale et de reconnaissance vocale sont disponibles uniquement dans les régions Chine (Shanghai), Chine (Pékin) et Chine (Hangzhou).
Par défaut, AI_TTS découpe les phrases en fonction des signes de ponctuation chinois, tels que les virgules et les points. Les développeurs peuvent contrôler le style des sous-titres et le mode de saut de ligne pour chaque segment de phrase.
|
Effet |
Exemple de timeline |
|
Utiliser AI_TTS pour convertir du texte en parole et contrôler le rythme ou la prononciation avec SSML
Le champ Content de AI_TTS prend en charge le langage de balisage de synthèse vocale (SSML). Utilisez SSML pour corriger la prononciation des termes techniques, ajouter des pauses et inclure divers effets sonores émotionnels .
|
Effet |
Exemple de timeline |
|
AI_Matting : Détourage sur fond vert
Définissez « Type » sur « AI_Matting » pour extraire un sujet d'un arrière-plan vert et le superposer sur une vidéo ou une image d'arrière-plan spécifiée.
Le service de détourage sur fond vert est disponible uniquement dans les régions Chine (Hangzhou), Chine (Shanghai) et Chine (Pékin).
|
Effet |
Exemple de timeline |
|
AI_RealMatting : Remplacement d'arrière-plan
Définissez « Type » sur « AI_RealMatting » pour extraire une personne de n'importe quel arrière-plan réel et la superposer sur une vidéo ou une image d'arrière-plan spécifiée.
Le service de remplacement d'arrière-plan est disponible uniquement dans les régions Chine (Hangzhou), Chine (Shanghai) et Chine (Pékin).
|
Effet |
Exemple de timeline |
|
Mettre automatiquement en évidence le contenu clé des sous-titres avec AI_ASR
Définissez "NeedHighlighting": true dans l'effet AI_ASR et configurez le style de mise en évidence pour mettre automatiquement en valeur le contenu clé des sous-titres reconnus.
|
Effet |
Exemple de timeline |
|