Conference paper | Konferenzbeitrag

Speaker trait characterization in web videos: Uniting speech, language, and facial features

We present a multi-modal approach to speaker characterization using acoustic, visual and linguistic features. Full realism is provided by evaluation on a database of real-life web videos and automatic feature extraction including face and eye detection, and automatic speech recognition. Different segmentations are evaluated for the audio and video streams, and the statistical relevance of Linguistic Inquiry and Word Count (LIWC) features is confirmed. In the result, late multimodal fusion delivers 73, 92 and 73% average recall in binary age, gender and race classification on unseen test subjects, outperforming the best single modalities for age and race.

Speaker trait characterization in web videos: Uniting speech, language, and facial features

Urheber*in: Weninger, Felix; Wagner, Claudia; Wöllmer, Martin; Schuller, Björn; Morency, Louis-Philipp

Rechte vorbehalten - Freier Zugang

0
/
0

ISBN
978-1-4799-0356-6
ISSN
2379-190X
Umfang
Seite(n): 3647-3651
Sprache
Englisch
Anmerkungen
Status: Veröffentlichungsversion; begutachtet (peer reviewed)
38. International Conference on Acoustics, Speech and Signal Processing (ICASSP 2013). Vancouver, 2013

Erschienen in
Proceedings of the 38th International Conference on Acoustics, Speech and Signal Processing (ICASSP 2013)

Thema
Naturwissenschaften
Naturwissenschaften, Technik(wissenschaften), angewandte Wissenschaften
Video
Video-Clip
Aufzeichnung
Computerlinguistik
Internet
Evaluation
Soziale Medien
Experiment
audiovisuelle Medien

Ereignis
Geistige Schöpfung
(wer)
Weninger, Felix
Wagner, Claudia
Wöllmer, Martin
Schuller, Björn
Morency, Louis-Philipp
Ereignis
Veröffentlichung
(wer)
IEEE
(wo)
Vereinigte Staaten von Amerika
(wann)
2013

DOI
URN
urn:nbn:de:0168-ssoar-66084-2
Rechteinformation
GESIS - Leibniz-Institut für Sozialwissenschaften. Bibliothek Köln
Letzte Aktualisierung
21.06.2024, 16:26 MESZ

Datenpartner

Dieses Objekt wird bereitgestellt von:
GESIS - Leibniz-Institut für Sozialwissenschaften. Bibliothek Köln. Bei Fragen zum Objekt wenden Sie sich bitte an den Datenpartner.

Objekttyp

  • Konferenzbeitrag

Beteiligte

  • Weninger, Felix
  • Wagner, Claudia
  • Wöllmer, Martin
  • Schuller, Björn
  • Morency, Louis-Philipp
  • IEEE

Entstanden

  • 2013

Ähnliche Objekte (12)