The project tries to solve a speaker diarization problem using audio features, face recognition and video feature extraction from face image, mouth tracking.

郭新晨 / 2023-05-29 / 原文

https://github.com/valiakon/MultimodalAnalysis_SpeakerDiarization