CoMix: Collaborative filtering with mixup for implicit datasets

  • Moon, Jaewan
  • Jeong, Yoonki
  • Chae, Dong-Kyu
  • Choi, Jaeho
  • Shim, Hyunjung
  • 외 1명
Citations

WEB OF SCIENCE

15
Citations

SCOPUS

19

초록

Collaborative filtering (CF) is the prevalent solution to mitigate massive information overload in modern recommender systems. However, it usually suffers from data sparsity and popularity bias problems. Existing studies exploit auxiliary information or data augmentation, requiring additional data collection or expensive computational overheads. Inspired by Mixup used in the classification problem, we propose a simple-yet-effective data augmentation method for CF, namely Collaborative Mixup (CoMix), for implicit feedback datasets. The underlying idea of CoMix is to generate virtual users/items by logically combining random users/items. Unlike the original Mixup, we synthesize virtual users/items to complement weak collaborative signals by distinguishing the intersection and non-overlapping parts between two users/items. Despite its simplicity, extensive experimental results show that various CF models equipped with CoMix consistently improve the base models on four benchmark datasets.

키워드

Classification (of information)Additional datumAuxiliary dataAuxiliary informationBias problemsData augmentationData collectionData popularityData sparsityInformation overloadsVirtual usersCollaborative filtering
제목
CoMix: Collaborative filtering with mixup for implicit datasets
저자
Moon, JaewanJeong, YoonkiChae, Dong-KyuChoi, JaehoShim, HyunjungLee, Jongwuk
DOI
10.1016/j.ins.2023.01.110
발행일
2023-05
유형
Article
저널명
Information Sciences
628
페이지
254 ~ 268