Search results

Publication date Communities Collections Article title Author(s) Journal/Conference
16 Jun 2026 SERC Institute of Advanced Intelligence and Computing Plug-and-Adapt: Multimodal Coreference Resolution at First Sight with a Pretrained Alignment Model (Pending publish) Jinghan Wu, Jing Li, Ivor Tsang, Xuetao Zhang IEEE Transactions on Multimedia
4 Oct 2025 SERC Institute for Infocomm Research SODA: Out-of-Distribution Detection in Domain-Shifted Point Clouds via Neighborhood Propagation Adam Goodge, Xun Xu, Bryan Hooi, Wee Siong Ng, Jingyi Liao, Yongyi Su, Yang Xulei European Conference on Machine Learning (ECML-PKDD)
13 Aug 2025 SERC Institute for Infocomm Research MedUnifier: Unifying Vision-and-Language Pre-training on Medical Data with Vision Generation Task using Discrete Visual Representations Ziyang Zhang, Yang Yu, Yucheng Chen, Xulei Yang, Si Yong Yeo Computer Vision and Pattern Recognition Conference (CVPR)
4 Aug 2025 SERC Institute for Infocomm Research SPHERE: Unveiling Spatial Blind Spots in Vision-Language Models Through Hierarchical Evaluation Wenyu Zhang, Wei En Ng, Lixin Ma, Yuwen Wang, Junqi Zhao, Allison Koenecke, Boyang Li, Lu Wang Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)
29 Jul 2025 SERC Singapore Institute of Manufacturing Technology Leveraging Vision-Language Models for Manufacturing Feature Recognition in Computer-Aided Designs Muhammad Tayyab Khan, Lequn Chen, Ye Han Ng, Wenhe Feng, Nicholas Yew Jin Tan, Seung Ki Moon Journal of Computing and Information Science in Engineering
20 Aug 2024 SERC Institute for Infocomm Research Source-Free Domain Adaptation Guided by Vision and Vision-Language Pre-training Wenyu Zhang, Li Shen, Chuan-Sheng Foo International Journal of Computer Vision
17 Jun 2024 SERC Institute for Infocomm Research PeVL: Pose-Enhanced Vision-Language Model for Fine-Grained Human Action Recognition Haosong Zhang, Mei Chee Leong, Liyuan Li, Weisi Lin CVPR 2024