My research focuses on multi-modal action composition — building generalizable robot behaviors by composing specialized models across sensory modalities and time scales.
Multisensory Learning: Integrating vision, touch, audio, and language for fine-grained, contact-rich manipulation.
Action Composition: Composing specialized models — skills, action abstractions, and physics-inspired world models — across diverse data and time scales to generalize to complex tasks.
I'm always excited to explore new collaborations in robotics and machine learning! If you're interested, please drop me an email. I'd love to chat!
haonan_chen [at] seas (dot) harvard (dot) edu /
haonan [at] cs (dot) stanford (dot) edu
ARGUS: Aligning Robot Scene Geometry Under Shifting Views with Large 3D Vision Models Rishik Sathua,
Haonan Chen,
Katherine Driggs-Campbell 2026 Preprint, [Project][Paper][BibTeX]@misc{sathua2026argusaligningrobotscene,
title={ARGUS: Aligning Robot Scene Geometry Under Shifting Views with Large 3D Vision Models},
author={Rishik Sathua and Haonan Chen and Katherine Driggs-Campbell},
year={2026},
eprint={2608.05579},
archivePrefix={arXiv},
primaryClass={cs.RO},
url={https://arxiv.org/abs/2608.05579}
}
DriftWorld: Fast World Modeling through Drifting Susie Lu,
Haonan Chen,
Weirui Ye,
Yilun Du 2026 Preprint, [Project][Paper][Code][BibTeX]@misc{driftworld2026,
title={DriftWorld: Fast World Modeling through Drifting},
author={Susie Lu and Haonan Chen and Weirui Ye and Yilun Du},
year={2026},
eprint={2607.15065},
archivePrefix={arXiv},
url={https://arxiv.org/abs/2607.15065}
}
B-spline Policy: Accelerating Manipulation Policies via B-spline Action Representations Xiaoshen Han*,
Haoyu Xiong*,
Haonan Chen,
Chaoqi Liu,
Antonio Torralba,
Yuke Zhu,
Yilun Du * Equal contribution 2026 Preprint, [Project][Paper][Code][BibTeX]@article{han2026b,
title={B-spline Policy: Accelerating Manipulation Policies via B-spline Action Representations},
author={Han, Xiaoshen and Xiong, Haoyu and Chen, Haonan and Liu, Chaoqi and Torralba, Antonio and Zhu, Yuke and Du, Yilun},
journal={arXiv preprint arXiv:2607.09648},
year={2026}
}
You Only Touch Once: 6-DoF Object Pose Estimation from Single Tactile Contact
Pengfei Ye,
Yuxiang Ma,
Haonan Chen,
Guangming Wang,
Yixiong Jing,
Brian Sheil,
Yilun Du,
Edward Adelson 2026 Preprint, [Paper][BibTeX]@misc{ye2026youonlytouchonce,
title={You Only Touch Once: 6-DoF Object Pose Estimation from Single Tactile Contact},
author={Pengfei Ye and Yuxiang Ma and Haonan Chen and Guangming Wang and Yixiong Jing and Brian Sheil and Yilun Du and Edward Adelson},
year={2026},
eprint={2606.28899},
archivePrefix={arXiv},
primaryClass={cs.RO},
url={https://arxiv.org/abs/2606.28899}
}
MemoBench: Benchmarking World Modeling in Dynamically Changing Environments Haoyu Chen,
Kaichen Zhou,
Hang Hua,
Kaile Zhang,
Jingwen Qian,
Wufei Ma,
Haonan Chen,
Chunjiang Liu,
Yizhou Zhao,
Xiaoyuan Wang,
Weiyue Li,
Alan Yuille,
Paul Pu Liang,
Yilun Du 2026 European Conference on Computer Vision, [Project][Paper][Code][BibTeX]@inproceedings{chen2026memobench,
title={MemoBench: Benchmarking World Modeling in Dynamically Changing Environments},
author={Haoyu Chen and Kaichen Zhou and Hang Hua and Kaile Zhang and Jingwen Qian and Wufei Ma and Haonan Chen and Chunjiang Liu and Yizhou Zhao and Xiaoyuan Wang and Weiyue Li and Alan Yuille and Paul Pu Liang and Yilun Du},
booktitle={European Conference on Computer Vision},
year={2026},
url={https://arxiv.org/abs/2606.27537}
}
CoStream: Composing Simple Behaviors for Generalizable Complex Manipulation
Haonan Chen*,
Yuxiang Ma*,
Stephen Tian,
Xiaoshen Han,
Wenlong Huang,
Feiyang Wu,
Yunzhu Li,
Jiajun Wu,
Edward H. Adelson,
Yilun Du * Equal contribution 2026 Conference on Robot Learning, [Project][Paper][BibTeX]@inproceedings{costream2026,
title={CoStream: Composing Simple Behaviors for Generalizable Complex Manipulation},
author={Chen, Haonan and Ma, Yuxiang and Tian, Stephen and Han, Xiaoshen and Huang, Wenlong and Wu, Feiyang and Li, Yunzhu and Wu, Jiajun and Adelson, Edward H. and Du, Yilun},
booktitle={Conference on Robot Learning},
year={2026}
}
OAT: Ordered Action Tokenization
Chaoqi Liu,
Xiaoshen Han,
Jiawei Gao,
Yue Zhao,
Haonan Chen,
Yilun Du 2026 Robotics: Science and Systems, [Project][Paper][Code][Blog][BibTeX] Finalist - Best/Outstanding Paper Awards Media Coverage:[MarkTechPost]@misc{liu2026orderedactiontokenization,
title={OAT: Ordered Action Tokenization},
author={Chaoqi Liu and Xiaoshen Han and Jiawei Gao and Yue Zhao and Haonan Chen and Yilun Du},
year={2026},
eprint={2602.04215},
archivePrefix={arXiv},
primaryClass={cs.RO},
url={https://arxiv.org/abs/2602.04215},
}
IMPACT: Learning Internal-Model Predictive Control for Forceful Robotic Manipulation
Jiawei Gao,
Chaoqi Liu,
Peilin Wu,
Haonan Chen,
Yilun Du 2026 Preprint, [Project][Paper][Code][Video][BibTeX]@article{gao2024impact,
title={Learning Internal-Model Predictive Control for Forceful Robotic Manipulation},
author={Gao, Jiawei and Liu, Chaoqi and Wu, Peilin and Chen, Haonan and Du, Yilun},
journal={arXiv preprint arXiv:2406.14558},
year={2024}
}
SIMPACT: Simulation-Enabled Action Planning using Vision-Language Models
Haowen Liu*,
Shaoxiong Yao*,
Haonan Chen,
Jiawei Gao,
Jiayuan Mao,
Jia-Bin Huang,
Yilun Du * Equal contribution 2026 IEEE/CVF Conference on Computer Vision and Pattern Recognition, [Project][Paper][BibTeX]@article{simpact2025,
title={SIMPACT: Simulation-Enabled Action Planning using Vision-Language Models},
author={Liu, Haowen and Yao, Shaoxiong and Chen, Haonan and Gao, Jiawei and Mao, Jiayuan and Huang, Jia-Bin and Du, Yilun},
journal={arXiv preprint arXiv:2512.05955},
year={2025}
}
Multi-Modal Manipulation via Multi-Modal Policy Consensus
Haonan Chen,
Jiaming Xu*,
Hongyu Chen*,
Kaiwen Hong,
Binghao Huang,
Chaoqi Liu,
Jiayuan Mao,
Yunzhu Li,
Yilun Du+,
Katherine Driggs-Campbell+ * Equal contribution; + Equal advising 2026 IEEE International Conference on Robotics and Automation, [Project][Paper][Code][Dataset][Video][Audio][Blog][Deepwiki][BibTeX]@inproceedings{chen2026multimodal,
title={Multi-Modal Manipulation via Multi-Modal Policy Consensus},
author={Chen, Haonan and Xu, Jiaming and Chen, Hongyu and Hong, Kaiwen and Huang, Binghao and Liu, Chaoqi and Mao, Jiayuan and Li, Yunzhu and Du, Yilun and Driggs-Campbell, Katherine},
booktitle={2026 IEEE International Conference on Robotics and Automation (ICRA)},
year={2026}
} Best Paper Award at CVPR 2026 Workshop on Multi-Sensory Modeling for Embodied Intelligence [Link] Media Coverage: Featured in Video Friday on [IEEE Spectrum]