EMAGE 是一種音訊輸入來創造出包括頭部、嘴型、身體、手部以及整體運動的動作的 AI 模型。這項技術與Meta之前推出的audio2photoreal有著類似的概念,都是將音訊資料轉化為更加豐富的視覺表現形式。這種技術在虛擬實境、遊戲開發、動畫製作等領域具有廣泛的應用潛力,基於音訊生成逼真的人物動作,進而提升視覺內容的互動性和真實感。