← Homepage

Curriculum Vitae

Hang Zhao

Assistant Professor, IIIS, Tsinghua University · Principal Investigator, MARS Lab · Co-founder & Chief Scientist, Galaxea

Tsinghua University Science Park, Beijing, China ZhaoHang0124@gmail.com hangzhaomit.github.io Google Scholar Updated July 2026

My research advances embodied intelligence through multimodal learning, robot learning, and autonomous driving, with a focus on foundation models and scalable perception, prediction, and control.

Work Experience

Tsinghua University · Beijing, China

Assistant Professor, Institute for Interdisciplinary Information Sciences; Principal Investigator, MARS Lab

  • Fast-WAM — efficient world action modeling without test-time imagination.
  • DriveVLM — vision-language reasoning for autonomous driving.
  • Robot Parkour — vision-based whole-body skills for legged and humanoid robots.
  • VCAD — an open platform for vision-centric autonomous driving.
Jan 2021 – Present

Galaxea · Beijing, China

Co-founder & Chief Scientist

  • Embodied Foundation Models — generalist policies for real-world robots.
  • G0.5 — unified reasoning and action in one autoregressive stream.
Sep 2023 – Present

Waymo · Mountain View, California

Research Scientist

  • Waymo Open Datasets — large-scale perception and motion data for autonomous driving.
  • VectorNet and TNT — scalable motion prediction from vectorized scenes and goals.
Jul 2019 – Dec 2020

MIT CSAIL · Cambridge, Massachusetts

Graduate Research Assistant

  • ADE20K — large-scale scene parsing and semantic understanding.
  • The Sound of Pixels — self-supervised audio-visual source separation.
  • RF-Pose and RF-Pose3D — through-wall human sensing with radio signals.
Jan 2016 – Jun 2019

MIT Media Lab · Cambridge, Massachusetts

Graduate Research Assistant

  • Modulo Camera — unbounded HDR imaging; ICCP 2015 Best Paper Runner-up.
Sep 2013 – Jan 2016

Education

Massachusetts Institute of Technology

Ph.D. in Computer Science

  • Advisor: Professor Antonio Torralba
  • Computer Science and Artificial Intelligence Laboratory (CSAIL)
Sep 2013 – Jun 2019

Zhejiang University

B.Eng. in Information Engineering

  • Chu Kochen Honors College; with honors, top 1%
Sep 2009 – Jun 2013

Selected Honors & Awards

Teaching

Open-source Projects

Professional Service

Selected Invited Talks

Most recent first

Selected Press Coverage

Publications

Google Scholar
[158]
Galaxea Team
G0.5: One Autoregressive Stream for Reasoning and Action
Technical Report 2026
[157]
Gen Li, Nan Wang, YunLong Li, Ziyang Yan, Yinghao Shuai, Saining Zhang, Shu Han, Shaocong Xu, Baijun Ye, Lu Zhang, Luan Zhang, Paul Barsch, Zebang Shen, Chaojian Li, Hang Zhao, Ya-Qin Zhang, Hao Zhao
Gen-NCAP: A Generative Simulator for Corner Case Benchmarking in End-to-End Autonomous Driving
IASEAI 2026
[156]
Zongzheng Zhang, Zi Lin, Jiawen Yang, Ziqiao Peng, Junyan Lao, Lin Cheng, Huazhe Xu, Hang Zhao, Hao Zhao
Automated Synthesis of Facial Mechanisms for Conversational Animatronic Robots
Preprint 2026
[155]
Junru Gu, Lijin Yang, Jianing Huang, Shu Liu, Zhongzhan Huang, Hang Zhao
Agent-driven Long-tail Simulation for Autonomous Driving
Preprint 2026
[154]
Ziwen Zhuang*, Shaoting Zhu*, Mengjie Zhao, Hang Zhao
Deep Whole-body Parkour
In Submission
[153]
Weibang Wang, Kenan Li, Zhuoguang Chen, Yijun Yuan, Hang Zhao
Complet4R: Geometric Complete 4D Reconstruction
CVPR 2026
[152]
Gu Zhang, Qicheng Xu, Haozhe Zhang, Jianhan Ma, Long He, Yiming Bao, Zeyu Ping, Zhecheng Yuan, Chenhao Lu, Chengbo Yuan, Tianhai Liang, Xiaoyu Tian, Maanping Shao, Feihong Zhang, Mingyu Ding, Yang Gao, Hao Zhao, Hang Zhao, Huazhe Xu
UniDex: A Robot Foundation Suite for Universal Dexterous Hand Control from Egocentric Human Videos
CVPR 2026
[151]
Xiuyu Yang, Bohan Li, Shaocong Xu, Nan Wang, Chongjie Ye, Zhaoxi Chen, Minghan Qin, Yikang Ding, Zheng Zhu, Xin Jin, Hang Zhao, Hao Zhao
ORV: 4D Occupancy-centric Robot Video Generation
CVPR 2026
[150]
Tianyuan Yuan, Yicheng Liu, Chenhao Lu, Zixiang Chen, Tao Jiang, Hang Zhao
DepthVLA: Enhancing Vision-Language-Action Models with Depth-Aware Spatial Reasoning
ICRA 2026
[149]
Tao Jiang, Tianyuan Yuan, Yicheng Liu, Chenhao Lu, Jianning Cui, Xiao Liu, Shuiqi Cheng, Jiyang Gao, Huazhe Xu, Hang Zhao
Galaxea Open-World Dataset and G0 Dual-System VLA Model
ICRA 2026
[148]
Zongzheng Zhang, Jingrui Pang, Zhuo Yang, Kun Li, Minwen Liao, Saining Zhang, Guoxuan Chi, jinbang Guo, Huan-ang Gao, Modi Shi, Dongyun Ge, Yao Mu, Jiayuan Gu, Rui Chen, Hao Dong, Huazhe Xu, Li Yi, Yixin Zhu, Hang Zhao, Pengwei Wang, Shanghang Zhang, Guocai Yao, Jianyu Chen, Hongyang Li, Hao Zhao
Dexora: Open-Source VLA for High-DoF Bimanual Dexterity
ICRA 2026
[147]
Qiao Sun, Weicheng Zheng, Yixin Huang, Hang Zhao
Is Your Trajectory Displacement Safe in Long-tail?
Preprint 2026
[146]
Yicheng Liu, Shiduo Zhang, Zibin Dong, Baijun Ye, Tianyuan Yuan, Xiaopeng Yu, Linqi Yin, Chenhao Lu, Junhao Shi, Luca Jiang-Tao Yu, Liangtao Zheng, Tao Jiang, Jingjing Gong, Xipeng Qiu, Hang Zhao
FASTer: Toward Efficient Autoregressive Vision Language Action Modeling via Neural Action Tokenization
ICLR 2026
[145]
Weicheng Zheng, Xiaofei Mao, Nanfei Ye, Pengxiang Li, Kun Zhan, XianPeng Lang, Hang Zhao
DriveAgent-R1: Advancing VLM-based Autonomous Driving with Active Perception and Hybrid Thinking
ICLR 2026
[144]
Jingzhe Shi, Qinwei Ma, Hongyi Liu, Hang Zhao, Jenq-Neng Hwang, Lei Li
Intrinsic Entropy of Context Length Scaling in LLMs
ICLR 2026
[143]
Pengxiang Li, Yilong Zheng, Yiming Wang, Haoyu Wang, Hang Zhao, Jun Liu, Xing Zhan, Kaicheng Zhan, Xiao Lang
Discrete Diffusion for Reflective Vision-Language-Action Models in Autonomous Driving
ICLR 2026
[142]
Weicheng Zheng, Yixin Huang, Qiao Sun, Derun Li, Hang Zhao
DriveMA: Driving Vision-Language-Action Models with Verifiable Meta-Actions
Preprint 2026
[141]
Tianyuan Yuan, Zibin Dong, Yicheng Liu, Hang Zhao
Fast-WAM: Do World Action Models Need Test-time Future Imagination?
Preprint 2026
[140]
Zunzhe Zhang, Runhan Huang, Yicheng Liu, Shaoting Zhu, Linzhan Mou, Hang Zhao
Generative Control as Optimization: Time Unconditional Flow Matching for Adaptive and Robust Robotic Control
Preprint 2026
[139]
Tianxing Zhou, Feiyang Xue, Zhangchen Ye, Tianyuan Yuan, Hang Zhao, Tao Jiang
VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning
Preprint 2026
[138]
Zibin Dong, Yicheng Liu, Shiduo Zhang, Baijun Ye, Yifu Yuan, Fei Ni, Jingjing Gong, Xipeng Qiu, Hang Zhao, Yinchuan Li, Jianye Hao
ActionCodec: What Makes for Good Action Tokenizers
Preprint 2026
[137]
Shaoting Zhu, Baijun Ye, Jiaxu Wang, Jiaqi Chen, Ziwen Zhuang, Linxin Mou, Runhan Huang, Hang Zhao
TTT-Parkour: Rapid Test-Time Training for Perceptive Robot Parkour
Preprint 2026
[136]
Shaoting Zhu, Ziwen Zhuang, Mengjie Zhao, Kun-Ying Lee, Hang Zhao
Hiking in the Wild: A Scalable Perceptive Parkour Framework for Humanoids
Preprint 2026
[135]
Kai Xu, Hang Zhao, Ruizhen Hu, Yuhang Huang, Ziqiao Zhou, Wancheng Feng, Li Yi, Sida Peng, Xing Liu, Zihao Liu, Jin Zhang, Chenyang Zhu, Renjiao Yi, Qin Zou, Bo Du, Haibin Yu
From Specialist to Generalist: A Comprehensive Survey on World Models
TechRxiv 2026
[134]
Haohan Chi, Huan-ang Gao, Ziming Liu, Jianing Liu, Chenyu Liu, Jinwei Li, Kaisen Yang, Yangcheng Yu, Zeda Wang, Wenyi Li, Leichen Wang, Xingtao Hu, Hao Sun, Hang Zhao, Hao Zhao
Impromptu VLA: Open Weights and Open Data for Driving Vision-Language-Action Models
NeurIPS 2025
[133]
Zibin Dong, Yicheng Liu, Yinchuan Li, Hang Zhao, Jianye Hao
Conditioning Matters: Training Diffusion Policies is Faster Than You Think
NeurIPS 2025
[132]
RoboCOIN Team
RoboCOIN: An Open-Sourced Bimanual Robotic Data Collection for Integrated Manipulation
Preprint 2025
[131]
Bowen Ye, Bin Zhang, Hang Zhao
DAP: A Discrete-token Autoregressive Planner for Autonomous Driving
Preprint 2025
[130]
Zhuoguang Chen, Minghui Qin, Tianyuan Yuan, Zhe Liu, Hang Zhao
LONG3R: Long Sequence Streaming 3D Reconstruction
ICCV 2025
[129]
Baijun Ye, Minghui Qin, Saining Zhang, Moonjun Gong, Shaoting Zhu, Hao Zhao, Hang Zhao
GS-Occ3D: Scaling Vision-only Occupancy Reconstruction for Autonomous Driving with Gaussian Splatting
ICCV 2025
[128]
Ziwen Zhuang, Hang Zhao
Embrace Contacts: Humanoid Shadowing for Deployable Contact-Agnostics Motions
CoRL 2025
[127]
Runhan Huang, Shaoting Zhu, Yilun Du, Hang Zhao
MoE-Loco: Mixture of Experts for Multitask Locomotion
IROS 2025
[126]
Xin Duan, Ziwen Zhuang, Hang Zhao, Sören Schwertfeger
Playful DoggyBot: Learning Agile and Precise Quadrupedal Locomotion
IROS 2025
[125]
Haoran Xu, Saining Zhang, Peishuo Li, Baijun Ye, Xiaoxue Chen, Huan-ang Gao, Jv Zheng, Xiaowei Song, Ziqiao Peng, Run Miao, Jia Jinrang, YIFENG SHI, Guangqi Yi, Hang Zhao, Hao Tang, Hongyang Li, Kaicheng Yu, Hao Zhao
CRUISE: Cooperative Reconstruction and Editing in V2X Scenarios Using Gaussian Splatting
IROS 2025
[124]
Chengbo Yuan, Suraj Joshi, Shaoting Zhu, Hang Su, Hang Zhao, Yang Gao
RoboEngine: Plug-And-Play Robot Data Augmentation with Semantic Robot Segmentation and Background Generation
IROS 2025
[123]
CYang Li, Zongzheng Zhang, Xuchong Qiu, Xinrun Li, Ziming Liu, LeiChen Wang, Ruikai Li, Zhenxin Zhu, Huan-ang Gao, Xiaojian Lin, Zhiyong Cui, Hang Zhao, Hao Zhao
Reusing Attention for One-Stage Lane Topology Understanding
IROS 2025
[122]
Zongzheng Zhang, Xuchong Qiu, Boran Zhang, Guantian Zheng, Xunjiang Gu, Guoxuan Chi, Huan-ang Gao, LeiChen Wang, Ziming Liu, Xinrun Li, Igor Gilitschenski, Hongyang Li, Hang Zhao, Hao Zhao
Delving into Mapping Uncertainty for Mapless Trajectory Prediction
IROS 2025
[121]
Yijun Yuan, Zhuoguang Chen, Kenan Li, Weibang Wang, Hang Zhao
SLAM-Former: Putting SLAM into One Transformer
Preprint 2025
[120]
Ruixun Liu, Lingyu Kong, Derun Li, Hang Zhao
OccVLA: Vision-Language-Action Model with Implicit 3D Occupancy Supervision
Preprint 2025
[119]
Zongzheng Zhang, Jiawen Yang, Ziqiao Peng, Meng Yang, Jianzhu Ma, Lin Cheng, Huazhe Xu, Hang Zhao, Hao Zhao
Morpheus: A Neural-driven Animatronic Face with Hybrid Actuation and Diverse Emotion Control
RSS 2025
[118]
Chuanhao Yan, Fengdi Che, Xuhan Huang, Xu Xu, Xin Li, Yizhi Li, Xingwei Qu, Jingzhe Shi, Chenghua Lin, Yaodong Yang, Binhang Yuan, Hang Zhao, Yu Qiao, Bowen Zhou, Jie Fu
Re:Form -- Reducing Human Annotations in Scalable Formal Software Verification with RL in LLMs: A Preliminary Study on Dafny
Preprint 2025
[117]
Anna Min, Ziyang Chen, Hang Zhao, Andrew Owens
Supervising Sound Localization Using In-the-wild Ego-motion
CVPR 2025 Spotlight
[116]
Zhuoguang Chen, Kenan Li, Xiuyu Yang, Tao Jiang, Yiming Li, Hang Zhao
TrackOcc: Camera-Based 4D Panoptic Occupancy Tracking
ICRA 2025
[115]
Qiao Sun, Huimin Wang, Jiahao Zhan, Fan Nie, Xin Wen, Leimeng Xu, Kun Zhan, Peng Jia, Xianpeng Lang, Hang Zhao
Generalizing Motion Planners with Mixture of Experts for Autonomous Driving
ICRA 2025
[114]
Shaoting Zhu, Runhan Huang, Linzhan Mou, Hang Zhao
Robust Robot Walker: Learning Agile Locomotion Over Tiny Traps
ICRA 2025
[113]
Shaoting Zhu, Derun Li, Linzhan Mou, Yong Liu, Ningyi Xu, Hang Zhao
SARO: Space-Aware Robot System for Terrain Crossing via Vision-Language Model
ICRA 2025
[112]
Zongzheng Zhang, Xinrun Li, Sizhe Zou, Guoxuan Chi, Siqi Li, Xuchong Qiu, Guoliang Wang, Guantian Zheng, Leichen Wang, Hang Zhao, Hao Zhao
Chameleon: Fast-Slow Neuro-Symbolic Lane Topology Extraction
ICRA 2025
[111]
Yunshen Wang, Yicheng Liu, Tianyuan Yuan, Yucheng Mao, Yingshi Liang, Xiuyu Yang, Honggang Zhang, Hang Zhao
Diffusion-Based Generative Models for 3D Occupancy Prediction in Autonomous Driving
ICRA 2025
[110]
Shaoting Zhu, Linzhan Mou, Derun Li, Baijun Ye, Runhan Huang, Hang Zhao
VR-Robo: A Real-to-Sim-to-Real Framework for Visual Robot Navigation and Locomotion
IEEE RA-L 2025
[109]
Running Zhao, Luca Jiang-Tao Yu, Tingle Li, Zhihan Jiang, Chenwei Zhang, Chenshu Wu, Hang Zhao, Edith C.H. Ngai
SPACE: Speaker Adaptation for Acoustic Eavesdropping using mmWave Radio Signals
IEEE TMC 2025
[108]
Zhiyuan Xu, Bohan Li, Huan-ang Gao, Mingju Gao, Yong Chen, Ming Liu, Chenxu Yan, Hang Zhao, Shuo Feng, Hao Zhao
Challenger: Affordable Adversarial Driving Video Generation
Preprint 2025
[107]
Derun Li, Changye Li, Yue Wang, Jianwei Ren, Xin Wen, Pengxiang Li, Leimeng Xu, Kun Zhan, Peng Jia, Xianpeng Lang, Ningyi Xu, Hang Zhao
Learning Personalized Driving Styles via Reinforcement Learning from Human Feedback
Preprint 2025
[106]
Jingzhe Shi, Qinwei Ma, Hongyi Liu, Hang Zhao, Jeng-Neng Hwang, Serge Belongie, Lei Li
Explaining Context Length Scaling and Bounds for Language Models
Preprint 2025
[105]
Yunsheng Ma, Wenqian Ye, Can Cui, Haiming Zhang, Shuo Xing, Fucai Ke, Jinhong Wang, Chenglin Miao, Jintai Chen, Hamid Rezatofighi, Zhen Li, Guangtao Zheng, Chao Zheng, Tianjiao He, Manmohan Chandraker, Burhaneddin Yaman, Xin Ye, Hang Zhao, Xu Cao
Position: Prospective of Autonomous Driving — Multimodal LLMs, World Models, Embodied Intelligence
WACV 2025
[104]
Ziwen Zhuang, Shenzhe Yao, Hang Zhao
Humanoid Parkour Learning
CoRL 2024
[103]
Xiaoyu Tian*, Junru Gu*, Bailin Li*, Yicheng Liu*, Yang Wang, Zhiyong Zhao, Kun Zhan, Peng Jia, Xianpeng Lang, Hang Zhao
DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models
CoRL 2024
[102]
Zenan Li, Fan Nie, Qiao Sun, Fang Da, Hang Zhao
Uncertainty-Aware Decision Transformer for Stochastic Driving Environments
CoRL 2024
[101]
Xinhao Liu, Moonjun Gong, Qi Fang, Haoyu Xie, Yiming Li, Hang Zhao, Chen Feng
LiDAR-Based 4D Occupancy Completion and Forecasting
IROS 2024
[100]
Yiming Li*, Sihang Li*, Xinhao Liu*, Moonjun Gong*, Kenan Li, Nuo Chen, Zijun Wang, Zhiheng Li, Tao Jiang, Fisher Yu, Yue Wang, Hang Zhao, Zhiding Yu, Chen Feng
SSCBench: A Large-Scale 3D Semantic Scene Completion Benchmark for Autonomous Driving
IROS 2024
[99]
Tianyuan Yuan, Yucheng Mao, Jiawei Yang, Yicheng Liu, Yue Wang, Hang Zhao
PreSight: Enhancing Autonomous Vehicle Perception with City-Scale NeRF Priors
ECCV 2024
[98]
Zhangchen Ye*, Tao Jiang*, Chenfeng Xu, Yiming Li, Hang Zhao
CVT-Occ: Cost Volume Temporal Fusion for 3D Occupancy Prediction
ECCV 2024
[97]
Anna Min, Chenxu Hu, Yi Ren, Hang Zhao
A Unit-based System and Dataset for Expressive Direct Speech-to-Speech Translation
Interspeech 2024
[96]
Zenan Li, Fan Nie, Qiao Sun, Fang Da, Hang Zhao
Boosting Offline Reinforcement Learning for Autonomous Driving with Hierarchical Latent Skills
ICRA 2024
[95]
Zhou Jiang, Zhenxin Zhu, Pengfei Li, Huan-ang Gao, Tianyuan Yuan, Yongliang Shi, Hang Zhao, Hao Zhao
P-MapNet: Far-seeing Map Generator Enhanced by both SDMap and HDMap Priors
IEEE RA-L 2024
[94]
Wenyu Han, Congcong Wen, Lazarus Chok, Yan Liang Tan, Sheung Lung Chan, Hang Zhao, Chen Feng
Autoencoding Tree for City Generation and Applications
ISPRS Journal 2024
[93]
Tianyuan Yuan, Yicheng Liu, Yue Wang, Yilun Wang, Hang Zhao
StreamMapNet: Streaming Mapping Network for Vectorized Online HD Map Construction
WACV 2024
[92]
Junsong Chen, Yue Wu, Simian Luo, Enze Xie, Sayak Paul, Ping Luo, Hang Zhao, Zhenguo Li
PixArt-δ: Fast and Controllable Image Generation with Latent Consistency Models
Preprint 2024
[91]
Simian Luo, Chuanhao Yan, Chenxu Hu, Hang Zhao
Diff-Foley: Synchronized Video-to-Audio Synthesis with Latent Diffusion Models
NeurIPS 2023
[90]
Xiaoyu Tian*, Tao Jiang*, Longfei Yun, Yucheng Mao, Huitong Yang, Yue Wang, Yilun Wang, Hang Zhao
Occ3D: A Large-Scale 3D Occupancy Prediction Benchmark for Autonomous Driving
NeurIPS 2023
[89]
Simian Luo, Yiqin Tan, Suraj Patil, Daniel Gu, Patrick von Platen, Apolinário Passos, Longbo Huang, Jian Li, Hang Zhao
LCM-LoRA: A Universal Stable-Diffusion Acceleration Module
Preprint 2023
[88]
Simian Luo*, Yiqin Tan*, Longbo Huang†, Jian Li†, Hang Zhao
Latent Consistency Models: Synthesizing High-Resolution Images With Few-Step Inference
Preprint
[87]
Ziwen Zhuang, Zipeng Fu, Jianren Wang, Christopher G. Atkeson, Sören Schwertfeger, Chelsea Finn, Hang Zhao
Robot Parkour Learning
CoRL 2023 Oral Best System Paper Finalist (Top 3)
[86]
Liangtao Zheng, Yicheng Liu, Yue Wang, Hang Zhao
Cross-dataset Sensor Alignment: Making Visual 3D Object Detector Generalize
CoRL 2023
[85]
Tong Zhang, Yingdong Hu, Hanchen Cui, Hang Zhao, Yang Gao
A Universal Semantic-Geometric Representation for Robotic Manipulation
CoRL 2023
[84]
Bowen Li, Ziyuan Huang, Junjie Ye, Yiming Li, Sebastian Scherer, Hang Zhao, Changhong Fu
PVT++: A Simple End-to-End Latency-Aware Visual Tracking Framework
ICCV 2023
[83]
Zhijie Yan, et al.
INT2: Interactive Trajectory Prediction at Intersections
ICCV 2023
[82]
Qiao Sun, Xin Huang, Brian C. Williams, Hang Zhao
P4P: Conflict-Aware Motion Prediction for Planning in Autonomous Driving
IROS 2023
[81]
Running Zhao*, Jiangtao Yu*, Hang Zhao†, Edith C.H. Ngai†
Radio2Text: Streaming Speech Recognition Using mmWave Radio Signals
UbiComp 2023
[80]
Jiageng Mao, Yuxi Qian, Junjie Ye, Hang Zhao, Yue Wang
GPT-Driver: Learning to Drive with GPT
Preprint 2023
[79]
Qiao Sun, Shiduo Zhang, Danjiao Ma, Jingzhe Shi, Derun Li, Simian Luo, Yu Wang, Ningyi Xu, Guangzhi Cao, Hang Zhao
Large Trajectory Models are Scalable Motion Predictors and Planners
Preprint 2023
[78]
Chenxu Hu*, Jie Fu*†, Chenzhuang Du, Simian Luo, Junbo Zhao, Hang Zhao
ChatDB: Augmenting LLMs with Databases as Their Symbolic Memory
LLM@IJCAI 2023
[77]
Yicheng Liu, Yue Wang, Yilun Wang, Hang Zhao
VectorMapNet: End-to-end Vectorized HD Map Learning
ICML 2023
[76]
Chenzhuang Du, Jiaye Teng, Tingle Li, Yichen Liu, Tianyuan Yuan, Yue Wang, Yang Yuan, Hang Zhao
On Uni-Modal Feature Learning in Supervised Multi-Modal Learning
ICML 2023
[75]
Zhengxiao Han, Zhijie Yan, Yang Li, Pengfei Li, Yifeng Shi, Nairui Luo, Xu Gao, Yongliang Shi, Pengfei Huang, Jiangtao Gong, Guyue Zhou, Yilun Chen, Hang Zhao, Hao Zhao
Long-Term Interactive Driving Simulation: MPC to the Rescue
CICAI 2023
[74]
Zitian Tang, Wenjie Ye, Wei-Chiu Ma, Hang Zhao
What Happened 3 Seconds Ago? Inferring the Past with Thermal Imaging
CVPR 2023
[73]
Xuan Xiong, Yicheng Liu, Tianyuan Yuan, Yilun Wang, Yue Wang, Hang Zhao
Neural Map Prior for Autonomous Driving
CVPR 2023
[72]
Junru Gu*, Chenxu Hu*, Tianyuan Zhang, Xuanyao Chen, Yilun Wang, Yue Wang, Hang Zhao
ViP3D: End-to-end Visual Trajectory Prediction via 3D Agent Queries
CVPR 2023
[71]
Xiaoyu Tian, Haoxi Ran, Yue Wang, Hang Zhao
GeoMAE: Masked Geometric Target Prediction for Self-supervised Point Cloud Pre-Training
CVPR 2023
[70]
Xuanyao Chen, Zhijian Liu, Haotian Tang, Li Yi, Hang Zhao, Song Han
SparseViT: Revisiting Activation Sparsity for Efficient High-Resolution Vision Transformer
CVPR 2023
[69]
Xuanyao Chen, Tianyuan Zhang, Yue Wang, Yilun Wang, Hang Zhao
FUTR3D: A Unified Sensor Fusion Framework for 3D Detection
CVPR 2023
[68]
Hang Zhao, Zherong Pan, Yang Yu, Kai Xu
Learning Physically Realizable Skills for Online Packing of General 3D Shapes
ACM TOG 2023
[67]
Yucheng Mao, Ruowen Zhao, Tianbao Zhang, Hang Zhao
BEVScope: Enhancing Self-Supervised Depth Estimation Leveraging Bird's-Eye-View
Preprint 2023
[66]
Zihui Xue, Zhengqi Gao, Sucheng Ren, Hang Zhao
The Modality Focusing Hypothesis: Towards Understanding Crossmodal Knowledge Distillation
ICLR 2023 Oral Top 5%
[65]
Renhao Wang, Jiayuan Mao, Joy Hsu, Hang Zhao, Jiajun Wu, Yang Gao
Programmatically Grounded, Compositionally Generalizable Robotic Manipulation
ICLR 2023 Oral Top 25%
[64]
Tianyu Hua, Yonglong Tian, Sucheng Ren, Michalis Raptis, Hang Zhao, Leonid Sigal
Self-supervision through Random Segments with Autoregressive Coding (RandSAC)
ICLR 2023
[63]
Qiao Sun, Xin Huang, Brian C. Williams, Hang Zhao
InterSim: Interactive Traffic Simulation via Explicit Relation Modeling
IROS 2022
[62]
Renhao Wang, Hang Zhao, Yang Gao
CYBORGS: Contrastively Bootstrapping Object Representations by Grounding in Segmentation
ECCV 2022
[61]
Tingle Li, Yichen Liu, Andrew Owens, Hang Zhao
Learning Visual Styles from Audio-Visual Associations
ECCV 2022
[60]
Running Zhao, Jiangtao Yu, Tingle Li, Hang Zhao, Edith Ngai
Radio2Speech: High Quality Speech Recovery from Radio Frequency Signals
INTERSPEECH 2022
[59]
Zui Chen, Yansen Jing, Shengcheng Yuan, Yifei Xu, Jian Wu, Hang Zhao
Sound2Synth: Interpreting Sound via FM Synthesizer Parameters Estimation
IJCAI 2022
[58]
Zehui Chen, Zhenyu Li, Shiquan Zhang, Liangji Fang, Qinghong Jiang, Feng Zhao, Bolei Zhou, Hang Zhao
AutoAlign: Pixel-Instance Feature Aggregation for Multi-Modal 3D Object Detection
IJCAI 2022
[57]
Xin Huang, Xiaoyu Tian, Junru Gu, Qiao Sun, Hang Zhao
VectorFlow: Combining Images and Vectors for Traffic Occupancy and Flow Prediction
Preprint 2022
[56]
Lingyu Zhu, Esa Rahtu, Hang Zhao
Beyond Visual Field of View: Perceiving 3D Environment with Echoes and Vision
Preprint 2022
[55]
Zhengxi Liu, Qiao Tian, Chenxu Hu, Xudong Liu, Menglin Wu, Yuping Wang, Hang Zhao, Yuxuan Wang
Controllable and Lossless Non-autoregressive End-to-end Text-to-Speech
Preprint 2022
[54]
Tianyuan Zhang, Xuanyao Chen, Yue Wang, Yilun Wang, Hang Zhao
MUTR3D: A Multi-camera Tracking Framework via 3D-to-2D Queries
CVPRW 2022
[53]
Qiao Sun, Xin Huang, Junru Gu, Brian C. Williams, Hang Zhao
M2I: From Factored Marginal Trajectory Prediction to Interactive Prediction
CVPR 2022
[52]
Sucheng Ren, Zhengqi Gao, Tianyu Hua, Zihui Xue, Yonglong Tian, Shengfeng He, Hang Zhao
Co-advise: Cross Inductive Bias Distillation
CVPR 2022
[51]
Lue Fan, Ziqi Pang, Tianyuan Zhang, Yu-Xiong Wang, Hang Zhao, Feng Wang, Naiyan Wang, Zhaoxiang Zhang
Embracing Single Stride 3D Object Detector with Sparse Transformer
CVPR 2022
[50]
Yiming Li, Ziang Cao, Andrew Liang, Benjamin Liang, Luoyao Chen, Hang Zhao, Chen Feng
Egocentric Prediction of Action Target in 3D
CVPR 2022
[49]
Qi Li, Yue Wang, Yilun Wang, Hang Zhao
HDMapNet: An Online HD Map Construction and Evaluation Framework
ICRA 2022 CVPR 2021 Workshop Best Paper Nominee
[48]
Jianren Wang*, Ziwen Zhuang*, Hang Zhao
SEMI: Self-supervised Exploration via Multisensory Incongruity
ICRA 2022
[47]
Longlong Jing, Ruichi Yu, Henrik Kretzschmar, Kang Li, Ruizhongtai Qi, Hang Zhao, Alper Ayvaci, Xu Chen, Dillon Cower, Yingwei Li, Yurong You, Han Deng, Congcong Li, Dragomir Anguelov
Depth Estimation Matters Most: Improving Per-Object Depth Estimation for Monocular 3D Detection and Tracking
ICRA 2022
[46]
Yue Zhao, Chenzhuang Du, Hang Zhao, Tiejun Li
Intrinsically Motivated Self-supervised Learning in Reinforcement Learning
ICRA 2022
[45]
Yingwei Li, Tiffany Chen, Maya Kabkab, Ruichi Yu, Longlong Jing, Yurong You, Hang Zhao
R4D: Utilizing Reference Objects for Long-Range Distance Estimation
ICLR 2022
[44]
Qi Li, Kaichun Mo, Yanchao Yang, Hang Zhao, Leonidas Guibas
IFR-Explore: Learning Inter-object Functional Relationships in 3D Indoor Scenes
ICLR 2022
[43]
Zhengqi Gao, Sucheng Ren, Zihui Xue, Siting Li, Hang Zhao
Training-free Robust Multimodal Learning via Sample-wise Jacobian Regularization
Preprint 2022
[42]
Zhenyu Li, Zehui Chen, Ang Li, Liangji Fang, Qinhong Jiang, Xianming Liu, Junjun Jiang, Bolei Zhou, Hang Zhao
SimIPU: Simple 2D Image and 3D Point Cloud Unsupervised Pre-Training for Spatial-Aware Visual Representations
AAAI 2022
[41]
Chenxu Hu, Qiao Tian, Tingle Li, Yuping Wang, Yuxuan Wang, Hang Zhao
Neural Dubber: Dubbing for Videos According to Scripts
NeurIPS 2021
[40]
Yu Huang, Chenzhuang Du, Zihui Xue, Xuanyao Chen, Hang Zhao, Longbo Huang
What Makes Multi-Modal Learning Better than Single (Provably)
NeurIPS 2021
[39]
Yue Wang, Vitor Campagnolo Guizilini, Tianyuan Zhang, Yilun Wang, Hang Zhao, Justin Solomon
DETR3D: 3D Object Detection from Multi-view Images via 3D-to-2D Queries
CoRL 2021
[38]
Jianren Wang, Ziwen Zhuang, Yuyang Wang, Hang Zhao
Adversarially Robust Imitation Learning
CoRL 2021
[37]
Xiaosong Jia, Liting Sun, Hang Zhao, Masayoshi Tomizuka, Wei Zhan
Multi-Agent Trajectory Prediction by Combining Egocentric and Allocentric Views
CoRL 2021
[36]
Tianyu Hua, Wenxiao Wang, Zihui Xue, Yue Wang, Sucheng Ren, Hang Zhao
On Feature Decorrelation in Self-Supervised Learning
ICCV 2021 Oral
[35]
Scott Ettinger, Shuyang Cheng, Benjamin Caine, Chenxi Liu, Hang Zhao, Sabeek Pradhan, Yuning Chai, Ben Sapp, Charles Qi, Yin Zhou, Zoey Yang, Aurelien Chouard, Pei Sun, Jiquan Ngiam, Vijay Vasudevan, Alexander McCauley, Jonathon Shlens, Dragomir Anguelov
Large Scale Interactive Motion Forecasting for Autonomous Driving: The Waymo Open Motion Dataset
ICCV 2021 Oral
[34]
Zihui Xue, Sucheng Ren, Zhengqi Gao, Hang Zhao
Multimodal Knowledge Expansion
ICCV 2021
[33]
Junru Gu, Chen Sun, Hang Zhao
DenseTNT: End-to-end Trajectory Prediction from Dense Goal Sets
ICCV 2021
[32]
Tingle Li, Yichen Liu, Chenxu Hu, Hang Zhao
CVC: Contrastive Learning for Non-parallel Voice Conversion
Interspeech 2021 ISCA Travel Grant Award
[31]
Junru Gu, Qiao Sun, Hang Zhao
DenseTNT: Waymo Open Dataset Motion Prediction Challenge 1st Place Solution
CVPRW 2021 Waymo Open Dataset Challenge Winner
[30]
Lu Mi, Hang Zhao, Charlie Nash, Xiaohan Jin, Jiyang Gao, Chen Sun, Cordelia Schmid, Nir Shavit, Yuning Chai, Dragomir Anguelov
HDMapGen: A Hierarchical Graph Generative Model of High Definition Maps
CVPR 2021
[29]
Hang Zhao, Yang Yu, Kai Xu
Learning Efficient Online 3D Bin Packing on Packing Configuration Trees
ICLR 2021
[28]
Shuo Gao, Shuo Yan, Hang Zhao, Arokia Nathan
Touch-Based Human-Machine Interaction: Principles and Applications
Springer 2021
[27]
Chu Zhou, Hang Zhao, Jin Han, Chang Xu, Chao Xu, Tiejun Huang, Boxin Shi
UnModNet: Learning to Unwrap a Modulo Image for High Dynamic Range Imaging
NeurIPS 2020
[26]
Hang Zhao*, Jiyang Gao*, Tian Lan, Chen Sun, Benjamin Sapp, Balakrishnan Varadarajan, Yue Shen, Yi Shen, Yuning Chai, Cordelia Schmid, Congcong Li, Dragomir Anguelov
TNT: Target-driveN Trajectory Prediction
CoRL 2020
[25]
Jianren Wang, Yujie Lu, Hang Zhao
CLOUD: Contrastive Learning of Unsupervised Dynamics
CoRL 2020
[24]
Hanhan Li, Ariel Gordon, Hang Zhao, Vincent Casser, Anelia Angelova
Unsupervised Monocular Depth Learning in Dynamic Scenes
CoRL 2020
[23]
Yunchao Wei, Shuai Zheng, Ming-Ming Cheng, Hang Zhao, Liwei Wang, Errui Ding, Yi Yang, Antonio Torralba, Ting Liu, Guolei Sun, Wenguan Wang, Luc Van Gool, Wonho Bae, Junhyug Noh, Jinhwan Seo, Gunhee Kim, Hao Zhao, Ming Lu, Anbang Yao, Yiwen Guo, Yurong Chen, Li Zhang, Chuangchuang Tan, Tao Ruan, Guanghua Gu, Shikui Wei, Yao Zhao, Mariia Dobko, Ostap Viniavskyi, Oles Dobosevych, Zhendong Wang, Zhenyuan Chen, Chen Gong, Huanqing Yan, Jun He
LID 2020: The Learning from Imperfect Data Challenge Results
Preprint 2020
[22]
Jiyang Gao, Chen Sun, Hang Zhao, Yi Shen, Dragomir Anguelov, Congcong Li, Cordelia Schmid
VectorNet: Encoding HD Maps and Agent Dynamics from Vectorized Representation
CVPR 2020
[21]
Pei Sun, Henrik Kretzschmar, Xerxes Dotiwalla, Aurelien Chouard, Vijaysai Patnaik, Paul Tsui, James Guo, Yin Zhou, Yuning Chai, Benjamin Caine, Vijay Vasudevan, Wei Han, Jiquan Ngiam, Hang Zhao, Aleksei Timofeev, Scott Ettinger, Maxim Krivokon, Amy Gao, Aditya Joshi, Sheng Zhao, Shuyang Cheng, Yu Zhang, Jonathon Shlens, Zhifeng Chen, Dragomir Anguelov
Scalability in Perception for Autonomous Driving: Waymo Open Dataset
CVPR 2020
[20]
Chuang Gan, Deng Huang, Hang Zhao, Joshua B. Tenenbaum, Antonio Torralba
Music Gesture for Visual Sound Separation
CVPR 2020
[19]
Jianren Wang, Zhaoyuan Fang, Hang Zhao
AlignNet: A Unifying Approach to Audio-visual Alignment
WACV 2020
[18]
Hang Zhao, Chuang Gan, Wei-Chiu Ma, Antonio Torralba
The Sound of Motions
ICCV 2019
[17]
Chuang Gan, Hang Zhao, Peihao Chen, David Cox, Antonio Torralba
Self-supervised Moving Vehicle Tracking with Stereo Sound
ICCV 2019
[16]
Mingmin Zhao, Yingcheng Liu, Aniruddh Raghu, Hang Zhao, Tianhong Li, Antonio Torralba, Dina Katabi
Through-Wall Human Mesh Recovery Using Radio Signals
ICCV 2019
[15]
Hang Zhao, Zhicheng Yan, Lorenzo Torresani, Antonio Torralba
HACS: Human Action Clips and Segments Dataset for Recognition and Temporal Localization
ICCV 2019
[14]
Andrew Rouditchenko, Hang Zhao, Chuang Gan, Josh McDermott, Antonio Torralba
Self-Supervised Segmentation and Source Separation on Videos
CVPRW 2019
[13]
Andrew Rouditchenko*, Hang Zhao*, Chuang Gan, Josh McDermott, Antonio Torralba
Self-Supervised Audio-visual Co-segmentation
ICASSP 2019
[12]
Hang Zhao, Chuang Gan, Andrew Rouditchenko, Carl Vondrick, Josh McDermott, Antonio Torralba
The Sound of Pixels
ECCV 2018
[11]
Mingmin Zhao, Yonglong Tian, Hang Zhao, Mohammad Alsheikh, Tianhong Li, Rumen Hristov, Zachary Kabelac, Dina Katabi, Antonio Torralba
RF-Based 3D Skeletons
SIGCOMM 2018
[10]
Mingmin Zhao, Tianhong Li, Mohammad Alsheikh, Yonglong Tian, Hang Zhao, Antonio Torralba, Dina Katabi
Through-Wall Human Pose Estimation Using Radio Signals
CVPR 2018
[9]
Bolei Zhou, Hang Zhao, Xavier Puig, Tete Xiao, Sanja Fidler, Adela Barriuso, Antonio Torralba
Semantic Understanding of Scenes through the ADE20K Dataset
IJCV 2018
[8]
Hang Zhao, Xavier Puig, Bolei Zhou, Sanja Fidler, Antonio Torralba
Open Vocabulary Scene Parsing
ICCV 2017
[7]
Bolei Zhou, Hang Zhao, Xavier Puig, Sanja Fidler, Adela Barriuso, Antonio Torralba
Scene Parsing through ADE20K Dataset
CVPR 2017
[6]
Hang Zhao, Orazio Gallo, Iuri Frosio, Jan Kautz
Loss Functions for Neural Networks for Image Processing
IEEE TCI 2017
[5]
Liam Paul, et al.
Duckietown: an Open, Inexpensive and Flexible Platform for Autonomy Education and Research
ICRA 2017
[4]
Christy Fernandez-Cull, Hang Zhao, Boxin Shi, Brian M. Tyrrell, Joseph Lin, Ramesh Raskar
Snapshot on-chip HDR ROIC architectures
COSI 2015
[3]
Achuta Kadambi, Hang Zhao, Boxin Shi, Ramesh Raskar
Occluded imaging with time of flight sensors
ACM TOG 2015
[2]
Hang Zhao, Boxin Shi, Christy Fernandez-Cull, Sai-Kit Yeung, Ramesh Raskar
Unbounded High Dynamic Range Photography using a Modulo Camera
ICCP 2015 Best Paper Runner-up
[1]
Boxin Shi, Hang Zhao, Moshe Ben-Ezra, Sai-Kit Yeung, Christy Fernandez-Cull, R. Hamilton Shepard, Christopher Barsi, Ramesh Raskar
Sub-pixel layout for super-resolution with images in an octic group
ECCV 2014