Publication:
Adaptive classifier cascade for multimodal speaker identification

dc.conference.dateOCT 4–8, 2004
dc.conference.locationJeju Island, South Korea
dc.conference.organizerInternational Speech Communication Association (ISCA)
dc.contributor.departmentMVGL (Multimedia, Vision and Graphics Laboratory)
dc.contributor.facultymemberYes
dc.contributor.kuauthorErzin, Engin
dc.contributor.kuauthorTekalp, Ahmet Murat
dc.contributor.kuauthorYemez, Yücel
dc.contributor.schoolcollegeinstituteLaboratory
dc.date.accessioned2024-11-09T23:49:36Z
dc.date.issued2004
dc.description.abstractWe present a multimodal open-set speaker identification system that integrates information coming from audio, face and lip motion modalities. For fusion of multiple modalities, we propose a new adaptive cascade rule that favors reliable modality combinations through a cascade of classifiers. The order of the classifiers in the cascade is adaptively determined based on the reliability of each modality combination. A novel reliability measure, that genuinely fits to the open-set speaker identification problem, is also proposed to assess accept or reject decisions of a classifier. The proposed adaptive rule is more robust in the presence of unreliable modalities, and outperforms the hard-level max rule and soft-level weighted summation rule, provided that the employed reliability measure is effective in assessment of classifier decisions. Experimental results that support this assertion are provided.
dc.description.fulltextYes
dc.description.harvestedfromManual
dc.description.indexedbyScopus
dc.description.openaccessGreen OA
dc.description.peerreviewstatusPeer-Reviewed
dc.description.publisherscopeInternational
dc.description.readpublishN/A
dc.description.sponsoredbyTubitakEuN/A
dc.description.sponsorshipInternational Speech Communication Association (ISCA)
dc.description.studentonlypublicationNo
dc.description.studentpublicationNo
dc.description.versionAuthor’s Final Manuscript
dc.identifier.WoSQuartileN/A
dc.identifier.embargoNo
dc.identifier.filenameinventorynoIR08039
dc.identifier.isbn9784901036110
dc.identifier.scopus2-s2.0-85009151471
dc.identifier.urihttps://hdl.handle.net/20.500.14288/14394
dc.keywordsClassification (of information)
dc.keywordsLoudspeakers
dc.keywordsReliability
dc.keywordsAdaptive classifiers
dc.keywordsCascade of classifiers
dc.keywordsClassifier decisions
dc.keywordsMulti-modal speaker identification
dc.keywordsOpen-set speaker identification system
dc.keywordsReliability measure
dc.keywordsSpeaker identification
dc.keywordsWeighted summations
dc.keywordsSpeech recognition
dc.language.isoeng
dc.publisherInternational Speech Communication Association
dc.relation.affiliationKoç University
dc.relation.collectionKoç University Institutional Repository
dc.relation.ispartof8th International Conference on Spoken Language Processing, ICSLP 2004
dc.relation.openaccessYes
dc.rightsOther
dc.subjectElectrical electronics engineering
dc.subjectComputer engineering
dc.subjectSignal processing
dc.titleAdaptive classifier cascade for multimodal speaker identification
dc.typeConference Proceeding
dspace.entity.typePublication
local.contributor.kuauthorTekalp, Ahmet Murat
local.contributor.kuauthorErzin, Engin
local.contributor.kuauthorYemez, Yücel
relation.isOrgUnitOfPublicationcb6bbbf6-fd19-4052-b581-f591a9748d21
relation.isOrgUnitOfPublication.latestForDiscoverycb6bbbf6-fd19-4052-b581-f591a9748d21
relation.isParentOrgUnitOfPublication20385dee-35e7-484b-8da6-ddcc08271d96
relation.isParentOrgUnitOfPublication.latestForDiscovery20385dee-35e7-484b-8da6-ddcc08271d96

Files

Original bundle

Now showing 1 - 1 of 1
Thumbnail Image
Name:
IR08039.pdf
Size:
245.37 KB
Format:
Adobe Portable Document Format