Artikel ini memperkenalkan node fungsional yang saat ini didukung oleh solusi Media AI beserta fitur-fiturnya.
Nama Node | Deskripsi |
Face Recognition | Menerima beberapa gambar aktor, nama, dan informasi role sebagai input. Secara otomatis mendeteksi wajah dalam aliran video dan mengidentifikasi timestamp kemunculan karakter yang sesuai. |
Speech Extraction + ASR | Memisahkan suara manusia dari audio/video dan melakukan Automatic Speech Recognition (ASR) dengan akurasi tinggi, menghasilkan transkrip yang diatribusikan ke pembicara dengan timestamp yang presisi. |
Text Content Extraction | Memungkinkan pemilihan model AI, konfigurasi prompt kustom, dan format output. Mengekstraksi teks pada layar dari frame video dan menggabungkannya dengan transkrip ASR untuk memungkinkan pemahaman semantik yang komprehensif. |
Video Summary (OTT) | Menghasilkan ringkasan cerdas untuk video (misalnya, film, serial TV, video pendek) dengan menganalisis frame visual (rentang waktu/ambang batas kemiripan dapat dikonfigurasi) dan mengintegrasikan konten subtitle/transkrip ASR. |
Frame Extraction & Analysis (Custom) | Memungkinkan pengambilan sampel frame (rentang waktu/tingkat kemiripan dapat dikonfigurasi), pemilihan model, serta definisi prompt/output kustom untuk menganalisis frame video berdasarkan konten, kualitas, atau atribut visual lainnya. |