Journal / Conference / Workshop Papers
VLN-NF: Feasibility-Aware Vision-and-Language Navigation with False-Premise Instructions
Hung-Ting Su, Ting-Jun Wang, Jia-Fong Yeh, Min Sun, and Winston H. Hsu
Annual Meeting of the Association for Computational Linguistics (ACL 2026)
paper project page
ADAPT: Benchmarking Commonsense Planning under Unspecified Affordance Constraints
Pei-An Chen, Yong-Ching Liang, Jia-Fong Yeh, Hung-Ting Su, Yi-Ting Chen, Min Sun, and Winston H. Hsu
Annual Meeting of the Association for Computational Linguistics (ACL 2026)
paper
Affordance-Guided Coarse-to-Fine Exploration for Base Placement in Open-Vocabulary Mobile Manipulation
Tzu-Jung Lin, Jia-Fong Yeh, Hung-Ting Su, Chung-Yi Lin, Yi-Ting Chen, and Winston H. Hsu
AAAI Conference on Artificial Intelligence (AAAI 2026)
paper
MovieCORE: COgnitive REasoning in Movies
Gueter Josmy Faure, Min-Hung Chen, Jia-Fong Yeh, Ying Cheng, Hung-Ting Su, Yung-Hao Tang, Shang-Hong Lai, and Winston H. Hsu
Empirical Methods in Natural Language Processing (EMNLP 2025)
paper project page
HERMES: temporal-coHERent long-forM understanding with Episodes and Semantics
Gueter Josmy Faure, Jia-Fong Yeh, Min-Hung Chen, Hung-Ting Su, Shang-Hong Lai, and Winston H. Hsu
International Conference on Computer Vision (ICCV 2025)
paper project page
AED: Adaptable Error Detection for Few-shot Imitation Policy
Jia-Fong Yeh, Kuo-Han Hung, Pang-Chi Lo, Chi-Ming Chung, Tsung-Han Wu, Hung-Ting Su, Yi-Ting Chen and Winston H. Hsu
Neural Information Processing Systems (NeurIPS 2024)
paper
Unveiling Narrative Reasoning Limits of Large Language Models with Trope in Movie Synopses
Hung-Ting Su*, Ya-Ching Hsu*, Xudong Lin, Xiang-Qian Shi, Yulei Niu, Han-Yuan Hsu, Hung-yi Lee, Winston H. Hsu
Findings of Empirical Methods in Natural Language Processing (EMNLP 2024)
paper code
Context-Aware Replanning with Pre-Explored Semantic Map for Object Navigation
Po-Chen Ko*, Hung-Ting Su*, Ching-Yuan Chen*, Jia-Fong Yeh, Min Sun, Winston H. Hsu
Conference on Robot Learning (CoRL 2024)
paper code
Tracking-Assisted Object Detection with Event Cameras
Ting-Kang Yen, Igor Morawski, Shusil Dangi, Kai He, Chung-Yi Lin, Jia-Fong Yeh, Hung-Ting Su, and Winston H. Hsu
European Conference on Computer Vision Workshops (ECCVW 2024)
Enhancing Sustainable Urban Mobility Prediction with Telecom Data: A Spatio-Temporal Framework Approach
Chung-Yi Lin, Shen-Lung Tung, Hung-Ting Su, and Winston H. Hsu
Proceedings of the Thirty-Third International Joint Conference on Artificial Intelligence (IJCAI 2024)
Tel2Veh: Fusion of Telecom Data and Vehicle Flow to Predict Camera-Free Traffic via a Spatio-Temporal Framework
Chung-Yi Lin, Shen-Lung Tung, Hung-Ting Su, and Winston H. Hsu
The Web Conference (WWW 2024)
TelTrans: Applying Multi-Type Telecom Data to Transportation Evaluation and Prediction via Multifaceted Graph Modeling
Chung-Yi Lin, Shen-Lung Tung, Hung-Ting Su, and Winston H. Hsu
AAAI Conference on Artificial Intelligence (AAAI 2024)
Fair Robust Active Learning by Joint Inconsistency
Tsung-Han Wu, Hung-Ting Su, Shang-Tse Chen, and Winston H. Hsu
International Conference on Computer Vision Workshops (ICCVW 2023)
Unsupervised Adversarial Detection without Extra Model: Training Loss Should Change
Chien Cheng Chyou, Hung-Ting Su, and Winston H. Hsu
ICML AdvML Workshop (ICMLW 2023)
CTCam: Enhancing Transportation Evaluation through Fusion of Cellular Traffic and Camera-Based Vehicle Flows
Chung-Yi Lin, Shen-Lung Tung, Hung-Ting Su, and Winston H. Hsu
The Conference on Information and Knowledge Management (CIKM 2023)
Language Models are Causal Knowledge Extractors for Zero-shot Video Question Answering
Hung-Ting Su, Yulei Niu, Xudong Lin, Winston H. Hsu and Shih-Fu Chang
CVPR Workshop on Learning with Limited Labelled Data for Image and Video Understanding (CVPRW 2023)
paper
BIRD-PCC: Bi-directional Range Image-based Deep LiDAR Point Cloud Compression
Chia-Sheng Liu, Jia-Fong Yeh, Hao Hsu, Hung-Ting Su, Ming-Sui Lee and Winston H. Hsu
IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP 2023)
Learning Fine-Grained Visual Understanding for Video Question Answering via Decoupling Spatial-Temporal Modeling
Hsin-Ying Lee, Hung-Ting Su, Bing-Chen Tsai, Tsung-Han Wu, Jia-Fong Yeh, and Winston H. Hsu
British Machine Vision Conference (BMVC 2022)
paper code
SEQDNET: Improving Missing Value by Sequential Depth Network
Hao Hsu, Hung-Ting Su, Jia-Fong Yeh, Chi-Ming Chung and Winston H. Hsu
International Conference in Image Processing (ICIP 2022)
MonoDTR: Monocular 3D Object Detection with Depth-Aware Transformer
Kuan-Chih Huang, Tsung-Han Wu, Hung-Ting Su and Winston H. Hsu
Computer Vision and Pattern Recognition (CVPR 2022)
paper code
Stage Conscious Attention Network (SCAN) : A Demonstration-Conditioned Policy for Few-Shot Imitation
Jia-Fong Yeh*, Chi-Ming Chung*, Hung-Ting Su, Yi-Ting Chen and Winston H. Hsu
AAAI Conference on Artificial Intelligence (AAAI 2022)
paper
Multivariate and Propagation Graph Attention Network for Spatial-Temporal Prediction with Outdoor Cellular Traffic
Chung-Yi Lin, Hung-Ting Su, Shen-Lung Tung and Winston H. Hsu
ACM International Conference on Information and Knowledge Management (CIKM 2021)
paper
TrUMAn: Trope Understanding in Movies and Animations
Hung-Ting Su*, Po-Wei Shen*, Bing-Chen Tsai, Wen-Feng Cheng, Ke-Jyun Wang and Winston H. Hsu
ACM International Conference on Information and Knowledge Management (CIKM 2021)
paper dataset
ReDAL: Region-based and Diversity-aware Active Learning for Point Cloud Semantic Segmentation
Tsung-Han Wu, Yueh-Cheng Liu*, Yu-Kai Huang*, Hsin-Ying Lee, Hung-Ting Su, Ping-Chia Huang and Winston H. Hsu
International Conference on Computer Vision (ICCV 2021)
paper code
Dual-Awareness Attention for Few-Shot Object Detection
Tung-I Chen, Yueh-Cheng Liu, Hung-Ting Su, Yu-Cheng Chang, Yu-Hsiang Lin, Jia-Fong Yeh, Wen-Chin Chen and Winston H. Hsu
IEEE Transactions on Multimedia (TMM) · 2021
paper code
End-to-End Video Question-Answer Generation with Generator-Pretester Network
Hung-Ting Su, Chen-Hsi Chang, Po-Wei Shen, Yu-Siang Wang, Ya-Liang Chang, Yu-Cheng Chang, Pu-Jen Cheng and Winston H. Hsu
IEEE Transactions on Circuits and Systems for Video Technology (TCSVT) · 2021
paper
OCID-Ref: A 3D Robotic Dataset With Embodied Language for Clutter Scene Grounding
Ke-Jyun Wang*, Yun-Hsuan Liu*, Hung-Ting Su, Jen-Wei Wang, Yu-Siang Wang, Winston H. Hsu and Wen-Chin Chen
North American Chapter of the Association for Computational Linguistics (NAACL 2021)
paper dataset
S^3: Learnable Sparse Signal Superdensity for Guided Depth Estimation
Yu-Kai Huang, Yueh-Cheng Liu, Tsung-Han Wu, Hung-Ting Su, Yu-Cheng Chang, Tsung-Lin Tsou, Yu-An Wang and Winston H. Hsu
Computer Vision and Pattern Recognition (CVPR 2021)
paper
Role Aware Multi-Party Dialogue Question Answering
Jui-Heng Hsu*, Po-Wei Shen*, Hung-Ting Su, Chen-Hsi Chang, Jia-Fong Yeh and Winston H. Hsu
IEEE Conference on Acoustics, Speech, and Signal Processing (ICASSP 2021)
Situation and Behavior Understanding by Trope Detection on Films
Chen-Hsi Chang*, Hung-Ting Su*, Jui-Heng Hsu, Yu-Siang Wang, Yu-Cheng Chang, Zhe Yu Liu, Ya-Liang Chang, Wen-Feng Cheng, Ke-Jyun Wang and Winston H. Hsu
The Web Conference (WWW 2021)
paper dataset
Learn from the past: sequentially one-to-one video deblurring network
Chih-Hung Liang, Hung-Ting Su and Winston H. Hsu
Journal of Visual Communication and Image Representation (JVCIR) · 2021
Class-agnostic Few-shot Object Counting
Shuo-Diao Yang, Hung-Ting Su, Winston H. Hsu and Wen-Chin Chen
Workshop on Applications of Computer Vision (WACV 2021)
A Coarse-To-Fine (C2F) Representation for End-To-End 6-DoF Grasp Detection
Kuang-Yu Jeng, Yueh-Cheng Liu, Zhe-Yu Liu, Jen-Wei Wang, Ya-Liang Chang, Hung-Ting Su and Winston H. Hsu
The Conference on Robot Learning (CoRL 2020)
paper
Video Question Generation via Semantic Rich Cross-Modal Self-Attention Networks Learning
Yu-Siang Wang*, Hung-Ting Su*, Chen-Hsi Chang, Zhe-Yu Liu and Winston H. Hsu
IEEE Conference on Acoustics, Speech, and Signal Processing (ICASSP 2020)
paper
DECCNet: Depth Enhanced Crowd Counting
Shuo-Diao Yang, Hung-Ting Su, Winston H. Hsu and Wen-Chin Chen
International Conference on Computer Vision Workshops (ICCVW 2019))
Cross-Domain Hallucination Network for Fine-Grained Object Recognition
Jin-Fu Lin, Yen-Liang Lin, Erh-Kan King, Hung-Ting Su and Winston H. Hsu
Computer Vision and Pattern Recognition Workshops (CVPRW 2018)