Chia-Hsuan Hsu, Hsin-Chun Lin, Sin-Ye Jhong, Hui-Che Hsu,
Ming-Xian Hong, Yung-Yao Chen.
VSTFusion-VO: Monocular Visual Odometry with Video Swin Transformer Multimodal Fusion. Accepted at the International Conference on Advanced Robotics and Intelligent Systems (ARIS), 2025. Best Conference Paper Award: Honorary Mention.
Hsin-Ling Hsu, Zizheng Wang, Donghua Zhang, Nai-Chia Chen, Jerry Wang,
Jun-En Ding, Chia-Hsuan Hsu, et al.
MedAction: Towards Active Multi-turn Clinical Diagnostic LLMs. Accepted at Conference on Language Modeling (COLM), 2026.
Pin-Yen Chiu, Dai-Jie Wu, Po-Hsun Chu, Chia-Hsuan Hsu,
Hsiang-Chen Chiu, Chih-Yu Wang, Jun-Cheng Chen.
StyleDiT: A Unified Framework for Diverse Child and Partner Faces Synthesis with Style Latent Diffusion Transformer. Accepted to the IEEE International Conference on Automatic Face and Gesture Recognition (FG), 2026.