Publications

A complete list of journal, conference, workshop, and preprint publications.

Journal / Conference / Workshop Papers

VLN-NF: Feasibility-Aware Vision-and-Language Navigation with False-Premise Instructions

Hung-Ting Su, Ting-Jun Wang, Jia-Fong Yeh, Min Sun, and Winston H. Hsu

Annual Meeting of the Association for Computational Linguistics (ACL 2026)

ADAPT: Benchmarking Commonsense Planning under Unspecified Affordance Constraints

Pei-An Chen, Yong-Ching Liang, Jia-Fong Yeh, Hung-Ting Su, Yi-Ting Chen, Min Sun, and Winston H. Hsu

Annual Meeting of the Association for Computational Linguistics (ACL 2026)

Affordance-Guided Coarse-to-Fine Exploration for Base Placement in Open-Vocabulary Mobile Manipulation

Tzu-Jung Lin, Jia-Fong Yeh, Hung-Ting Su, Chung-Yi Lin, Yi-Ting Chen, and Winston H. Hsu

AAAI Conference on Artificial Intelligence (AAAI 2026)

MovieCORE: COgnitive REasoning in Movies

Gueter Josmy Faure, Min-Hung Chen, Jia-Fong Yeh, Ying Cheng, Hung-Ting Su, Yung-Hao Tang, Shang-Hong Lai, and Winston H. Hsu

Empirical Methods in Natural Language Processing (EMNLP 2025)

HERMES: temporal-coHERent long-forM understanding with Episodes and Semantics

Gueter Josmy Faure, Jia-Fong Yeh, Min-Hung Chen, Hung-Ting Su, Shang-Hong Lai, and Winston H. Hsu

International Conference on Computer Vision (ICCV 2025)

AED: Adaptable Error Detection for Few-shot Imitation Policy

Jia-Fong Yeh, Kuo-Han Hung, Pang-Chi Lo, Chi-Ming Chung, Tsung-Han Wu, Hung-Ting Su, Yi-Ting Chen and Winston H. Hsu

Neural Information Processing Systems (NeurIPS 2024)

Unveiling Narrative Reasoning Limits of Large Language Models with Trope in Movie Synopses

Hung-Ting Su*, Ya-Ching Hsu*, Xudong Lin, Xiang-Qian Shi, Yulei Niu, Han-Yuan Hsu, Hung-yi Lee, Winston H. Hsu

Findings of Empirical Methods in Natural Language Processing (EMNLP 2024)

Context-Aware Replanning with Pre-Explored Semantic Map for Object Navigation

Po-Chen Ko*, Hung-Ting Su*, Ching-Yuan Chen*, Jia-Fong Yeh, Min Sun, Winston H. Hsu

Conference on Robot Learning (CoRL 2024)

Tracking-Assisted Object Detection with Event Cameras

Ting-Kang Yen, Igor Morawski, Shusil Dangi, Kai He, Chung-Yi Lin, Jia-Fong Yeh, Hung-Ting Su, and Winston H. Hsu

European Conference on Computer Vision Workshops (ECCVW 2024)

Enhancing Sustainable Urban Mobility Prediction with Telecom Data: A Spatio-Temporal Framework Approach

Chung-Yi Lin, Shen-Lung Tung, Hung-Ting Su, and Winston H. Hsu

Proceedings of the Thirty-Third International Joint Conference on Artificial Intelligence (IJCAI 2024)

Tel2Veh: Fusion of Telecom Data and Vehicle Flow to Predict Camera-Free Traffic via a Spatio-Temporal Framework

Chung-Yi Lin, Shen-Lung Tung, Hung-Ting Su, and Winston H. Hsu

The Web Conference (WWW 2024)

TelTrans: Applying Multi-Type Telecom Data to Transportation Evaluation and Prediction via Multifaceted Graph Modeling

Chung-Yi Lin, Shen-Lung Tung, Hung-Ting Su, and Winston H. Hsu

AAAI Conference on Artificial Intelligence (AAAI 2024)

Fair Robust Active Learning by Joint Inconsistency

Tsung-Han Wu, Hung-Ting Su, Shang-Tse Chen, and Winston H. Hsu

International Conference on Computer Vision Workshops (ICCVW 2023)

Unsupervised Adversarial Detection without Extra Model: Training Loss Should Change

Chien Cheng Chyou, Hung-Ting Su, and Winston H. Hsu

ICML AdvML Workshop (ICMLW 2023)

CTCam: Enhancing Transportation Evaluation through Fusion of Cellular Traffic and Camera-Based Vehicle Flows

Chung-Yi Lin, Shen-Lung Tung, Hung-Ting Su, and Winston H. Hsu

The Conference on Information and Knowledge Management (CIKM 2023)

Language Models are Causal Knowledge Extractors for Zero-shot Video Question Answering

Hung-Ting Su, Yulei Niu, Xudong Lin, Winston H. Hsu and Shih-Fu Chang

CVPR Workshop on Learning with Limited Labelled Data for Image and Video Understanding (CVPRW 2023)

BIRD-PCC: Bi-directional Range Image-based Deep LiDAR Point Cloud Compression

Chia-Sheng Liu, Jia-Fong Yeh, Hao Hsu, Hung-Ting Su, Ming-Sui Lee and Winston H. Hsu

IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP 2023)

Learning Fine-Grained Visual Understanding for Video Question Answering via Decoupling Spatial-Temporal Modeling

Hsin-Ying Lee, Hung-Ting Su, Bing-Chen Tsai, Tsung-Han Wu, Jia-Fong Yeh, and Winston H. Hsu

British Machine Vision Conference (BMVC 2022)

SEQDNET: Improving Missing Value by Sequential Depth Network

Hao Hsu, Hung-Ting Su, Jia-Fong Yeh, Chi-Ming Chung and Winston H. Hsu

International Conference in Image Processing (ICIP 2022)

MonoDTR: Monocular 3D Object Detection with Depth-Aware Transformer

Kuan-Chih Huang, Tsung-Han Wu, Hung-Ting Su and Winston H. Hsu

Computer Vision and Pattern Recognition (CVPR 2022)

Stage Conscious Attention Network (SCAN) : A Demonstration-Conditioned Policy for Few-Shot Imitation

Jia-Fong Yeh*, Chi-Ming Chung*, Hung-Ting Su, Yi-Ting Chen and Winston H. Hsu

AAAI Conference on Artificial Intelligence (AAAI 2022)

Multivariate and Propagation Graph Attention Network for Spatial-Temporal Prediction with Outdoor Cellular Traffic

Chung-Yi Lin, Hung-Ting Su, Shen-Lung Tung and Winston H. Hsu

ACM International Conference on Information and Knowledge Management (CIKM 2021)

TrUMAn: Trope Understanding in Movies and Animations

Hung-Ting Su*, Po-Wei Shen*, Bing-Chen Tsai, Wen-Feng Cheng, Ke-Jyun Wang and Winston H. Hsu

ACM International Conference on Information and Knowledge Management (CIKM 2021)

ReDAL: Region-based and Diversity-aware Active Learning for Point Cloud Semantic Segmentation

Tsung-Han Wu, Yueh-Cheng Liu*, Yu-Kai Huang*, Hsin-Ying Lee, Hung-Ting Su, Ping-Chia Huang and Winston H. Hsu

International Conference on Computer Vision (ICCV 2021)

Dual-Awareness Attention for Few-Shot Object Detection

Tung-I Chen, Yueh-Cheng Liu, Hung-Ting Su, Yu-Cheng Chang, Yu-Hsiang Lin, Jia-Fong Yeh, Wen-Chin Chen and Winston H. Hsu

IEEE Transactions on Multimedia (TMM) · 2021

End-to-End Video Question-Answer Generation with Generator-Pretester Network

Hung-Ting Su, Chen-Hsi Chang, Po-Wei Shen, Yu-Siang Wang, Ya-Liang Chang, Yu-Cheng Chang, Pu-Jen Cheng and Winston H. Hsu

IEEE Transactions on Circuits and Systems for Video Technology (TCSVT) · 2021

OCID-Ref: A 3D Robotic Dataset With Embodied Language for Clutter Scene Grounding

Ke-Jyun Wang*, Yun-Hsuan Liu*, Hung-Ting Su, Jen-Wei Wang, Yu-Siang Wang, Winston H. Hsu and Wen-Chin Chen

North American Chapter of the Association for Computational Linguistics (NAACL 2021)

S^3: Learnable Sparse Signal Superdensity for Guided Depth Estimation

Yu-Kai Huang, Yueh-Cheng Liu, Tsung-Han Wu, Hung-Ting Su, Yu-Cheng Chang, Tsung-Lin Tsou, Yu-An Wang and Winston H. Hsu

Computer Vision and Pattern Recognition (CVPR 2021)

Role Aware Multi-Party Dialogue Question Answering

Jui-Heng Hsu*, Po-Wei Shen*, Hung-Ting Su, Chen-Hsi Chang, Jia-Fong Yeh and Winston H. Hsu

IEEE Conference on Acoustics, Speech, and Signal Processing (ICASSP 2021)

Situation and Behavior Understanding by Trope Detection on Films

Chen-Hsi Chang*, Hung-Ting Su*, Jui-Heng Hsu, Yu-Siang Wang, Yu-Cheng Chang, Zhe Yu Liu, Ya-Liang Chang, Wen-Feng Cheng, Ke-Jyun Wang and Winston H. Hsu

The Web Conference (WWW 2021)

Learn from the past: sequentially one-to-one video deblurring network

Chih-Hung Liang, Hung-Ting Su and Winston H. Hsu

Journal of Visual Communication and Image Representation (JVCIR) · 2021

Class-agnostic Few-shot Object Counting

Shuo-Diao Yang, Hung-Ting Su, Winston H. Hsu and Wen-Chin Chen

Workshop on Applications of Computer Vision (WACV 2021)

A Coarse-To-Fine (C2F) Representation for End-To-End 6-DoF Grasp Detection

Kuang-Yu Jeng, Yueh-Cheng Liu, Zhe-Yu Liu, Jen-Wei Wang, Ya-Liang Chang, Hung-Ting Su and Winston H. Hsu

The Conference on Robot Learning (CoRL 2020)

Video Question Generation via Semantic Rich Cross-Modal Self-Attention Networks Learning

Yu-Siang Wang*, Hung-Ting Su*, Chen-Hsi Chang, Zhe-Yu Liu and Winston H. Hsu

IEEE Conference on Acoustics, Speech, and Signal Processing (ICASSP 2020)

DECCNet: Depth Enhanced Crowd Counting

Shuo-Diao Yang, Hung-Ting Su, Winston H. Hsu and Wen-Chin Chen

International Conference on Computer Vision Workshops (ICCVW 2019))

Cross-Domain Hallucination Network for Fine-Grained Object Recognition

Jin-Fu Lin, Yen-Liang Lin, Erh-Kan King, Hung-Ting Su and Winston H. Hsu

Computer Vision and Pattern Recognition Workshops (CVPRW 2018)

Preprint / Under Review

Egocentric Coordinated Mobile Manipulation from Human Videos

submitted to CoRL 2026

TropeBench: Narrative Schema Verification in Movies

submitted to COLM 2026