Junchen Fu
Research title: Efficiently Adapting Multimodal Foundation Models for Recommendation
Publications
2026
Fu, Junchen, Deng, Wenhao, Zheng, Kaiwen, Arapakis, Ioannis, Ye, Yu, Ni, Yongxin, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Ge, Xuri
(2026)
Benchmarking Multimodal Large Language Models for missing modality completion in product catalogues.
Pattern Recognition, 180(A),
114020.
(doi: 10.1016/j.patcog.2026.114020)
Abukar, Abdisalam, Fu, Junchen, Zhai, Chengli and Jose, Joemon ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
Role of Personality in Conversational Information Seeking.
In: 35th ACM International Conference on Information and Knowledge Management (CIKM 2026), Rome, Italy, 07-11 Nov 2026,
(Accepted for Publication)
Yuan, Z. et al. (2026) Recommender System as Slow and Fast Thinkers. In: 35th ACM International Conference on Information and Knowledge Management (CIKM 2026), Rome, Italy, 07-11 Nov 2026, (Accepted for Publication)
Fu, Junchen, Ge, Xuri, Karatzoglou, Alexandros, Arapakis, Ioannis, Verberne, Suzan, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Ren, Zhaochun
(2026)
Differentiable Semantic ID for Generative Recommendation.
In: 49th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR 2026), Melbourne, Australia, 20–24 July 2026,
pp. 369-379.
ISBN 9798400725999
(doi: 10.1145/3805712.3809641)
Deng, Wenhao, Fu, Junchen, Du, Hanwen, Karatzoglou, Alexandros, Arapakis, Ioannis, Guo, Hangjun, Zheng, Kaiwen, Ni, Yongxin and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
RecRec: Latent Interests Recursive Reasoning for Sequential Recommendation.
In: 20th ACM Conference on Recommender Systems (RecSys 2026), Minneapolis, Minnesota, USA, 28 Sep - 02 Oct 2026,
(Accepted for Publication)
Fu, Junchen, Zheng, Kaiwen, Arapakis, Ioannis, Deng, Wenhao, Xin, Xin, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Ge, Xuri
ORCID: https://orcid.org/0000-0002-3925-4951
(2026)
Stream-aware Side Adaptation for Large Pre-trained Multimodal Embedding Models in Sequential Recommendation.
In: 34th ACM International Conference on Multimedia, Rio de Janeiro, Brazil, 10-14 November 2026,
(Accepted for Publication)
Zheng, Kaiwen, Fu, Junchen, Deng, Wenhao, Han, Hu, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Ge, Xuri
(2026)
Do We Really Need Multimodal Emotion Language Models Larger Than 1B Parameters?
In: 34th ACM International Conference on Multimedia, Rio de Janeiro, Brazil, 10-14 November 2026,
(Accepted for Publication)
Zheng, Kaiwen, Fu, Junchen, XU, Songpei, He, Yaoqin, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759, Han, Hu and Ge, Xuri
ORCID: https://orcid.org/0000-0002-3925-4951
(2026)
Focal-RegionFace: Generating Fine-Grained Multi-attribute Descriptions for Arbitrarily Selected Face Focal Regions.
In: 16th ACM International Conference on Multimedia Retrieval (ICMR 2026), Amsterdam, The Netherlands, 16-19 June 2026,
pp. 2656-2665.
ISBN 9798400726170
(doi: 10.1145/3805622.3810710)
Ye, Hui, Ge, Xuri, Wang, Junqi, Fu, Junchen, Xin, Xin, Xue, Jiao, Chen, Yao, Ren, Pengjie and Chen, Zhumin (2026) Beyond efficient fine-tuning: efficient hybrid fine-tuning of CLIP models guided by explainable ViT attention. Information Processing and Management, 63(4), 104628. (doi: 10.1016/j.ipm.2026.104628)
Ye, Yu, Fu, Junchen, Song, Yu, Zheng, Kaiwen and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
A reproducibility study of multimodal embeddings for recommender systems.
International Journal of Multimedia Information Retrieval, 15(2),
14.
(doi: 10.1007/s13735-026-00408-9)
Fu, Junchen, Ashok, Aravindhan, Zhai, Chengli, Zheng, Kaiwen, Song, Yu, Zhang, Ziyi, Zheng, Zhiwei, Ni, Yongxin and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
Do LLMs Have Stable Personalities? A Comprehensive Investigation into Big Five Profiling.
In: 35th International Conference on Artificial Neural Networks (ICANN 2026), Padua, Italy, 14-17 September 2026,
(Accepted for Publication)
Fu, Junchen, Ge, Xuri, Zheng, Kaiwen, Karatzoglou, Alexandros, Arapakis, Ioannis, Xin, Xin, Ni, Yongxin and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
LLMpopcorn: exploring LLMs as assistants for popular micro-video generation.
In: IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026), Barcelona, Spain, 04-08 May 2026,
pp. 12007-12011.
ISBN 9798331567026
(doi: 10.1109/ICASSP55912.2026.11463708)
Ge, Xuri, Zhang, Tianshuo, Li, Ruihan, Ye, Hui, Zheng, Kaiwen, Fu, Junchen, Huo, Da, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Han, Hu
(2026)
A Comprehensive Review of Multimodal Facial State Analysis: Tasks, Methods, and Resources.
In: IEEE International Conference on Multimedia and Expo (ICME 2026), Bangkok, Thailand, 05-09 July 2026,
(Accepted for Publication)
Fu, Junchen, Ge, Xuri, Xin, Xin, Karatzoglou, Alexandros, Arapakis, Ioannis, Wang, Xi, Liu, Qijiong, Li, Qian and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
The 2nd EReL@MIR Workshop on Efficient Representation Learning for Multimodal Information Retrieval.
In: 34th ACM International Conference on Multimedia, Rio de Janeiro, Brazil, 10-14 November 2026,
(Accepted for Publication)
Ye, Yu, Fu, Junchen, Song, Yu, Zheng, Kaiwen and Jose, Joemon ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
Are Multimodal Embeddings Truly Beneficial for Recommendation? A Deep Dive into Whole vs. Individual Modalities.
In: 48th European Conference on Information Retrieval (ECIR 2026), Delft, The Netherlands, 30 March - 1 April 2026,
pp. 66-81.
ISBN 9783032213235
(doi: 10.1007/978-3-032-21324-2_5)
2025
Yu, Haitao, Fang, Yubo, Ge, Xuri, Xin, Xin, Wang, Zihan, Fu, Junchen, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759, Ma, Weizhi and Ren, Zhaochun
(2025)
R3AG 2025: Workshop on Refined and Reliable Retrieval-Augmented Generation.
In: 3rd International ACM SIGIR Conference on Information Retrieval in the Asia Pacific, Xi'an, China, 7-10 December 2025,
pp. 461-464.
ISBN 9798400722189
(doi: 10.1145/3767695.3769524)
Zhuang, Ziyi, Li, Hongji, Fu, Junchen, Liu, Jiacheng, Jose, Joemon ORCID: https://orcid.org/0000-0001-9228-1759, Li, Youhua and Ni, Yongxin
(2025)
Frequency-Decoupled Distillation for Efficient Multimodal Recommendation.
In: 34th ACM International Conference on Information and Knowledge Management (CIKM 2025), Seoul, Korea, 10-14 November 2025,
pp. 4571-4581.
ISBN 9798400720406
Yuan, Z. et al. (2025) SOLAR: Serendipity Optimized Language Model Aligned for Recommendation. In: 2025 Conference on Empirical Methods in Natural Language Processing, Suzhou, China, 5–9 November 2025, pp. 10146-10169. (doi: 10.18653/v1/2025.findings-emnlp.538)
Zheng, Kaiwen, Ge, Xuri ORCID: https://orcid.org/0000-0002-3925-4951, Fu, Junchen, Peng, Jun and Jose, Joemon
ORCID: https://orcid.org/0000-0001-9228-1759
(2025)
Multimodal Representation Learning Techniques for Comprehensive Facial State Analysis.
In: 2025 IEEE International Conference on Multimedia and Expo (ICME), Nantes, France, 30 Jun - 04 Jul 2025,
ISBN 9798331594954
(doi: 10.1109/ICME59968.2025.11208908)
Fu, Junchen, Ge, Xuri, Xin, Xin, Karatzoglou, Alexandros, Arapakis, Ioannis, Zheng, Kaiwen, Ni, Yongxin and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2025)
Efficient and effective adaptation of multimodal foundation models in sequential recommendation.
IEEE Transactions on Knowledge and Data Engineering,
(doi: 10.1109/TKDE.2025.3608071)
(Early Online Publication)
He, Yaoqin, Fu, Junchen, Zheng, Kaiwen, Xu, Songpei, Chen, Fuhai, Li, Jie, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Ge, Xuri
(2025)
Double-Filter: Efficient Fine-tuning of Pre-trained Vision-Language Models via Patch&Layer Filtering.
In: ICML 2025, Vancouver, Canada, 13-19 July 2025,
Fu, Junchen, Ge, Xuri, Xin, Xin, Yu, Haitao, Feng, Yue, Karatzoglou, Alexandros, Arapakis, Ioannis and Jose, Joemon ORCID: https://orcid.org/0000-0001-9228-1759
(2025)
The 1st EReL@MIR Workshop on Efficient Representation Learning for Multimodal Information Retrieval.
In: WWW '25: The ACM Web Conference 2025, Sydney, Australia, 28 Apr - 02 May 2025,
pp. 2149-2152.
ISBN 9798400713316
(doi: 10.1145/3701716.3717559)
Ge, Xuri, Li, Linqing, Xu, Songpei, Zheng, Kaiwen, He, Yaoqin, Fu, Junchen and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2025)
The DenseCap-Guided Attention Network For Image-Text Matching.
In: ACM Web Conference 2025, Sydney, Australia, 28 April - 2 May 2025,
pp. 2153-2160.
ISBN 9798400713316
(doi: 10.1145/3701716.3717564)
Liu, Zhiyu, Fu, Junchen, Zheng, Kaiwen and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2025)
Exploring Multimodal Pre-trained Models for Speech Emotion Recognition.
In: ACM Web Conference 2025, Sydney, Australia, 28 April - 2 May 2025,
pp. 2176-2180.
ISBN 9798400713316
(doi: 10.1145/3701716.3717561)
Zhuang, Ziyi, Du, Hanwen, Han, Hui, Li, Youhua, Fu, Junchen, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Ni, Yongxin
(2025)
Bridging the Gap: Teacher-Assisted Wasserstein Knowledge Distillation for Efficient Multi-Modal Recommendation.
In: 2025 ACM Web Conference, Sydney, Australia, 28 Apr – 02 May 2025,
pp. 2464-2475.
ISBN 9798400712746
(doi: 10.1145/3696410.3714852)
2024
Ge, Xuri ORCID: https://orcid.org/0000-0002-3925-4951, Fu, Junchen, Chen, Fuhai, An, Shan, Sebe, Nicu and Jose, Joemon M.
ORCID: https://orcid.org/0000-0001-9228-1759
(2024)
Towards End-to-End Explainable Facial Action Unit Recognition via Vision-Language Joint Learning.
In: 32nd ACM Multimedia Conference (MM2024), Melbourne, Australia, 28 Oct - 01 Nov 2024,
pp. 8189-8198.
ISBN 9798400706868
(doi: 10.1145/3664647.3681443)
Fu, Junchen, Ge, Xuri ORCID: https://orcid.org/0000-0002-3925-4951, Xin, Xin, Karatzoglou, Alexandros, Arapakis, Ioannis, Wang, Jie and Jose, Joemon
ORCID: https://orcid.org/0000-0001-9228-1759
(2024)
IISAN: Efficiently Adapting Multimodal Representation for Sequential Recommendation with Decoupled PEFT.
In: 47th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR 2024), Washington D.C., USA, 14-18 July 2024,
pp. 687-697.
ISBN 9798400704314
(doi: 10.1145/3626772.3657725)
Articles
Fu, Junchen, Deng, Wenhao, Zheng, Kaiwen, Arapakis, Ioannis, Ye, Yu, Ni, Yongxin, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Ge, Xuri
(2026)
Benchmarking Multimodal Large Language Models for missing modality completion in product catalogues.
Pattern Recognition, 180(A),
114020.
(doi: 10.1016/j.patcog.2026.114020)
Ye, Hui, Ge, Xuri, Wang, Junqi, Fu, Junchen, Xin, Xin, Xue, Jiao, Chen, Yao, Ren, Pengjie and Chen, Zhumin (2026) Beyond efficient fine-tuning: efficient hybrid fine-tuning of CLIP models guided by explainable ViT attention. Information Processing and Management, 63(4), 104628. (doi: 10.1016/j.ipm.2026.104628)
Ye, Yu, Fu, Junchen, Song, Yu, Zheng, Kaiwen and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
A reproducibility study of multimodal embeddings for recommender systems.
International Journal of Multimedia Information Retrieval, 15(2),
14.
(doi: 10.1007/s13735-026-00408-9)
Fu, Junchen, Ge, Xuri, Xin, Xin, Karatzoglou, Alexandros, Arapakis, Ioannis, Zheng, Kaiwen, Ni, Yongxin and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2025)
Efficient and effective adaptation of multimodal foundation models in sequential recommendation.
IEEE Transactions on Knowledge and Data Engineering,
(doi: 10.1109/TKDE.2025.3608071)
(Early Online Publication)
Conference Proceedings
Abukar, Abdisalam, Fu, Junchen, Zhai, Chengli and Jose, Joemon ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
Role of Personality in Conversational Information Seeking.
In: 35th ACM International Conference on Information and Knowledge Management (CIKM 2026), Rome, Italy, 07-11 Nov 2026,
(Accepted for Publication)
Yuan, Z. et al. (2026) Recommender System as Slow and Fast Thinkers. In: 35th ACM International Conference on Information and Knowledge Management (CIKM 2026), Rome, Italy, 07-11 Nov 2026, (Accepted for Publication)
Fu, Junchen, Ge, Xuri, Karatzoglou, Alexandros, Arapakis, Ioannis, Verberne, Suzan, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Ren, Zhaochun
(2026)
Differentiable Semantic ID for Generative Recommendation.
In: 49th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR 2026), Melbourne, Australia, 20–24 July 2026,
pp. 369-379.
ISBN 9798400725999
(doi: 10.1145/3805712.3809641)
Deng, Wenhao, Fu, Junchen, Du, Hanwen, Karatzoglou, Alexandros, Arapakis, Ioannis, Guo, Hangjun, Zheng, Kaiwen, Ni, Yongxin and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
RecRec: Latent Interests Recursive Reasoning for Sequential Recommendation.
In: 20th ACM Conference on Recommender Systems (RecSys 2026), Minneapolis, Minnesota, USA, 28 Sep - 02 Oct 2026,
(Accepted for Publication)
Fu, Junchen, Zheng, Kaiwen, Arapakis, Ioannis, Deng, Wenhao, Xin, Xin, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Ge, Xuri
ORCID: https://orcid.org/0000-0002-3925-4951
(2026)
Stream-aware Side Adaptation for Large Pre-trained Multimodal Embedding Models in Sequential Recommendation.
In: 34th ACM International Conference on Multimedia, Rio de Janeiro, Brazil, 10-14 November 2026,
(Accepted for Publication)
Zheng, Kaiwen, Fu, Junchen, Deng, Wenhao, Han, Hu, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Ge, Xuri
(2026)
Do We Really Need Multimodal Emotion Language Models Larger Than 1B Parameters?
In: 34th ACM International Conference on Multimedia, Rio de Janeiro, Brazil, 10-14 November 2026,
(Accepted for Publication)
Zheng, Kaiwen, Fu, Junchen, XU, Songpei, He, Yaoqin, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759, Han, Hu and Ge, Xuri
ORCID: https://orcid.org/0000-0002-3925-4951
(2026)
Focal-RegionFace: Generating Fine-Grained Multi-attribute Descriptions for Arbitrarily Selected Face Focal Regions.
In: 16th ACM International Conference on Multimedia Retrieval (ICMR 2026), Amsterdam, The Netherlands, 16-19 June 2026,
pp. 2656-2665.
ISBN 9798400726170
(doi: 10.1145/3805622.3810710)
Fu, Junchen, Ashok, Aravindhan, Zhai, Chengli, Zheng, Kaiwen, Song, Yu, Zhang, Ziyi, Zheng, Zhiwei, Ni, Yongxin and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
Do LLMs Have Stable Personalities? A Comprehensive Investigation into Big Five Profiling.
In: 35th International Conference on Artificial Neural Networks (ICANN 2026), Padua, Italy, 14-17 September 2026,
(Accepted for Publication)
Fu, Junchen, Ge, Xuri, Zheng, Kaiwen, Karatzoglou, Alexandros, Arapakis, Ioannis, Xin, Xin, Ni, Yongxin and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
LLMpopcorn: exploring LLMs as assistants for popular micro-video generation.
In: IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026), Barcelona, Spain, 04-08 May 2026,
pp. 12007-12011.
ISBN 9798331567026
(doi: 10.1109/ICASSP55912.2026.11463708)
Ge, Xuri, Zhang, Tianshuo, Li, Ruihan, Ye, Hui, Zheng, Kaiwen, Fu, Junchen, Huo, Da, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Han, Hu
(2026)
A Comprehensive Review of Multimodal Facial State Analysis: Tasks, Methods, and Resources.
In: IEEE International Conference on Multimedia and Expo (ICME 2026), Bangkok, Thailand, 05-09 July 2026,
(Accepted for Publication)
Fu, Junchen, Ge, Xuri, Xin, Xin, Karatzoglou, Alexandros, Arapakis, Ioannis, Wang, Xi, Liu, Qijiong, Li, Qian and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
The 2nd EReL@MIR Workshop on Efficient Representation Learning for Multimodal Information Retrieval.
In: 34th ACM International Conference on Multimedia, Rio de Janeiro, Brazil, 10-14 November 2026,
(Accepted for Publication)
Ye, Yu, Fu, Junchen, Song, Yu, Zheng, Kaiwen and Jose, Joemon ORCID: https://orcid.org/0000-0001-9228-1759
(2026)
Are Multimodal Embeddings Truly Beneficial for Recommendation? A Deep Dive into Whole vs. Individual Modalities.
In: 48th European Conference on Information Retrieval (ECIR 2026), Delft, The Netherlands, 30 March - 1 April 2026,
pp. 66-81.
ISBN 9783032213235
(doi: 10.1007/978-3-032-21324-2_5)
Yu, Haitao, Fang, Yubo, Ge, Xuri, Xin, Xin, Wang, Zihan, Fu, Junchen, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759, Ma, Weizhi and Ren, Zhaochun
(2025)
R3AG 2025: Workshop on Refined and Reliable Retrieval-Augmented Generation.
In: 3rd International ACM SIGIR Conference on Information Retrieval in the Asia Pacific, Xi'an, China, 7-10 December 2025,
pp. 461-464.
ISBN 9798400722189
(doi: 10.1145/3767695.3769524)
Zhuang, Ziyi, Li, Hongji, Fu, Junchen, Liu, Jiacheng, Jose, Joemon ORCID: https://orcid.org/0000-0001-9228-1759, Li, Youhua and Ni, Yongxin
(2025)
Frequency-Decoupled Distillation for Efficient Multimodal Recommendation.
In: 34th ACM International Conference on Information and Knowledge Management (CIKM 2025), Seoul, Korea, 10-14 November 2025,
pp. 4571-4581.
ISBN 9798400720406
Yuan, Z. et al. (2025) SOLAR: Serendipity Optimized Language Model Aligned for Recommendation. In: 2025 Conference on Empirical Methods in Natural Language Processing, Suzhou, China, 5–9 November 2025, pp. 10146-10169. (doi: 10.18653/v1/2025.findings-emnlp.538)
Zheng, Kaiwen, Ge, Xuri ORCID: https://orcid.org/0000-0002-3925-4951, Fu, Junchen, Peng, Jun and Jose, Joemon
ORCID: https://orcid.org/0000-0001-9228-1759
(2025)
Multimodal Representation Learning Techniques for Comprehensive Facial State Analysis.
In: 2025 IEEE International Conference on Multimedia and Expo (ICME), Nantes, France, 30 Jun - 04 Jul 2025,
ISBN 9798331594954
(doi: 10.1109/ICME59968.2025.11208908)
He, Yaoqin, Fu, Junchen, Zheng, Kaiwen, Xu, Songpei, Chen, Fuhai, Li, Jie, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Ge, Xuri
(2025)
Double-Filter: Efficient Fine-tuning of Pre-trained Vision-Language Models via Patch&Layer Filtering.
In: ICML 2025, Vancouver, Canada, 13-19 July 2025,
Fu, Junchen, Ge, Xuri, Xin, Xin, Yu, Haitao, Feng, Yue, Karatzoglou, Alexandros, Arapakis, Ioannis and Jose, Joemon ORCID: https://orcid.org/0000-0001-9228-1759
(2025)
The 1st EReL@MIR Workshop on Efficient Representation Learning for Multimodal Information Retrieval.
In: WWW '25: The ACM Web Conference 2025, Sydney, Australia, 28 Apr - 02 May 2025,
pp. 2149-2152.
ISBN 9798400713316
(doi: 10.1145/3701716.3717559)
Ge, Xuri, Li, Linqing, Xu, Songpei, Zheng, Kaiwen, He, Yaoqin, Fu, Junchen and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2025)
The DenseCap-Guided Attention Network For Image-Text Matching.
In: ACM Web Conference 2025, Sydney, Australia, 28 April - 2 May 2025,
pp. 2153-2160.
ISBN 9798400713316
(doi: 10.1145/3701716.3717564)
Liu, Zhiyu, Fu, Junchen, Zheng, Kaiwen and Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759
(2025)
Exploring Multimodal Pre-trained Models for Speech Emotion Recognition.
In: ACM Web Conference 2025, Sydney, Australia, 28 April - 2 May 2025,
pp. 2176-2180.
ISBN 9798400713316
(doi: 10.1145/3701716.3717561)
Zhuang, Ziyi, Du, Hanwen, Han, Hui, Li, Youhua, Fu, Junchen, Jose, Joemon M. ORCID: https://orcid.org/0000-0001-9228-1759 and Ni, Yongxin
(2025)
Bridging the Gap: Teacher-Assisted Wasserstein Knowledge Distillation for Efficient Multi-Modal Recommendation.
In: 2025 ACM Web Conference, Sydney, Australia, 28 Apr – 02 May 2025,
pp. 2464-2475.
ISBN 9798400712746
(doi: 10.1145/3696410.3714852)
Ge, Xuri ORCID: https://orcid.org/0000-0002-3925-4951, Fu, Junchen, Chen, Fuhai, An, Shan, Sebe, Nicu and Jose, Joemon M.
ORCID: https://orcid.org/0000-0001-9228-1759
(2024)
Towards End-to-End Explainable Facial Action Unit Recognition via Vision-Language Joint Learning.
In: 32nd ACM Multimedia Conference (MM2024), Melbourne, Australia, 28 Oct - 01 Nov 2024,
pp. 8189-8198.
ISBN 9798400706868
(doi: 10.1145/3664647.3681443)
Fu, Junchen, Ge, Xuri ORCID: https://orcid.org/0000-0002-3925-4951, Xin, Xin, Karatzoglou, Alexandros, Arapakis, Ioannis, Wang, Jie and Jose, Joemon
ORCID: https://orcid.org/0000-0001-9228-1759
(2024)
IISAN: Efficiently Adapting Multimodal Representation for Sequential Recommendation with Decoupled PEFT.
In: 47th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR 2024), Washington D.C., USA, 14-18 July 2024,
pp. 687-697.
ISBN 9798400704314
(doi: 10.1145/3626772.3657725)