Gen Li

Full Professor @ HNU

prof_pic.jpg

Email: ligen [at] g.skku.edu

李根,拟入职湖南大学人工智能与机器人学院教授、博士生导师、国家级高层次青年人才。致力于构建可靠、高效、以人为本的具身智能系统,使机器人能够在复杂物理环境中实现感知、推理与自主行动。研究方向包括机器人学习、多模态基础模型、高效人工智能及人机交互等。

曾任新加坡南洋理工大学担任博士后研究员,合作导师为杨剑飞。博士毕业于英国爱丁堡大学,师从 Laura Sevilla,并由 Timothy Hospedales 教授共同指导。

📢 长期招收博士生、硕士生、博士后、科研助理/实习生及访问学者。欢迎对具身智能、机器人学习及多模态人工智能感兴趣的同学通过邮件联系!



动态

Sep 2026 🎉 UCA-Flow and ADAPT are accepted to CoRL 2026!
Aug 2026 🎉 PhyFilter is accepted by Nature Portfolio Robotics!
Aug 2026 🎉 World Model for Robot Learning: A Comprehensive Survey is accepted by IJRR!
May 2026 🚩 Our latest survey, World Model for Robot Learning, is now out on arXiv!
Apr 2026 🎉 A2A Flow Matching is accepted to RSS 2026!
Mar 2026 📖 Invited to serve as an Area Chair for NeurIPS 2026.
Feb 2026 🎉 Evo-1 and PALM are accepted to CVPR 2026!
Feb 2026 📖 Invited to serve as an Area Chair for BMVC 2026.


代表论文

*/† 表示共同贡献/共同指导 完整论文列表请见 Google Scholar

  1. npj Robotics
    phyfilter.gif
    Physics Filtering Favors the Generalization of Robot Learning
    Jindou Jia, Shixuan Han, Meng Wang, Gen Li, Zihan Yang, Sicheng Zhou, Kexin Guo, Jianfei Yang, Xiang Yu, Wei Wang, and Lei Guo
    npj Robotics, 2026
  2. CoRL’26
    uca-flow.gif
    Unified Condition-Action Modeling for Accurate One-Step Action Generation
    Xinyu Zhou, Zikun Cai, Kuangji Zuo, Gen Li, Boyu Ma, Yanshuo Lu, Yutong Song, Mingqi Yuan, Jiayu Chen, and Jianfei Yang
    In Conference on Robot Learning, 2026
  3. Preprint
    omega0.gif
    ω-0: A Latent Predictive World Action Model for Concurrent Humanoid Loco-Manipulation
    Zhe Li, Zhenzhe Zhang, Yangyang Wei, Wenjie Zhang, Xichen Yuan, Peiyuan Zhi, Gen Li, Xinying Guo, Fengjie Gao, Jianfei Yang, and Shanghang Zhang
    arXiv, 2026
  4. Preprint
    la4vla.png
    LA4VLA: Learning to Act without Seeing via Language-Action Pretraining
    Tao Lin, Yuxin Du, Yiran Mao, Zewei Ye, Yilei Zhong, Bing Cheng, Yiming Wang, Jiting Liu, Yang Tian, Junchi Yan, Feiran Wu, Zenan Meng, Hu Wei, Yuqian Fu, Gen Li, and Bo Zhao
    arXiv, 2026
  5. CoRL’26
    adapt.gif
    ADAPT: Analytical Disturbance-Aware Policy Training for Humanoid Locomotion
    Bofan Lyu, Jindou Jia, Kuangji Zuo, Yanshuo Lu, Shijia Han, Gen Li, Boyu Ma, Jingliang Li, Geng Li, and Jianfei Yang
    Conference on Robot Learning, 2026
  6. Preprint
    give.gif
    GIVE: Grounding Human Gestures in Vision-Language-Action Models
    Pengfei Liu*, Gen Li*, Junqiao Fan, Boyu Ma, Jindou Jia, Yang Xiao, and Jianfei Yang
    arXiv, 2026
  7. Preprint
    occamtoken.png
    OccamToken: Efficient VLM Inference with Training-Free and Budget-Adaptive Token Pruning
    Geng Li, Guohao Chen, Ting Chen, Shilin Shan, Kuangji Zuo, Bofan Lyu, Tuo An, Gen Li, and Jianfei Yang
    arXiv, 2026
  8. Preprint
    mars-policy.gif
    MARS Policy: Multimodality Only When It Matters
    Jindou Jia, Tuo An, Yuxuan Hu, Gen Li, Jingliang Li, Bohan Hou, Xiangyu Chen, Jiaqi Bai, Bofan Lyu, and Jianfei Yang
    arXiv, 2026
  9. Preprint
    gaze2act.gif
    Gaze2Act: Gaze-Conditioned Vision-Language-Action Policies for Interactive Robot Manipulation
    Kuangji Zuo*, Gen Li*, Bofan Lyu, Yanshuo Lu, Boyu Ma, Shijia Han, Xinyu Zhou, Xichen Yuan, Chuhao Zhou, Jiaqi Bai, Geng Li, and Jianfei Yang
    arXiv, 2026
  10. Preprint
    fb-wm.gif
    Feedback World Model Enables Precise Guidance of Diffusion Policy
    Tuo An, Jindou Jia, Gen Li, Jingliang Li, Chuhao Zhou, Pengfei Liu, Bofan Lyu, Jiaqi Bai, Xinying Guo, Geng Li, and Jianfei Yang
    arXiv, 2026
  11. Preprint
    flash.gif
    FLASH: Efficient Visuomotor Policy via Sparse Sampling
    Jiaqi Bai, Jindou Jia, Yuxuan Hu, Gen Li, Xiangyu Chen, Tuo An, Kuangji Zuo, and Jianfei Yang
    arXiv, 2026
  12. Preprint
    evo-depth.png
    Evo-Depth: A Lightweight Depth-Enhanced Vision-Language-Action Model
    Tao Lin, Yuxin Du, Jiting Liu, Nuobei Zhu, Yunhe Li, Yuqian Fu, Yinxinyu Chen, Hongyi Cai, Zewei Ye, Bing Cheng, Kai Ye, Yiran Mao, Yilei Zhong, MingKang Dong, Junchi Yan, Gen Li, and Bo Zhao
    arXiv, 2026
  13. IJRR
    wm-survey.png
    World Model for Robot Learning: A Comprehensive Survey
    Bohan Hou*, Gen Li*, Jindou Jia*, Tuo An*, Xinying Guo*, Sicong Leng, Haoran Geng, Yanjie Ze, Tatsuya Harada, Philip Torr, Oier Mees, Marc Pollefeys, Zhuang Liu, Jiajun Wu, Pieter Abbeel, Jitendra Malik, Yilun Du, and Jianfei Yang
    International Journal of Robotics Research, 2026
  14. Preprint
    compassad.png
    CompassAD: Intent-Driven 3D Affordance Grounding in Functionally Competing Objects
    Jingliang Li, Jindou Jia, Tuo An, Chuhao Zhou, Xiangyu Chen, Shilin Shan, Boyu Ma, Bofan Lyu, Gen Li, and Jianfei Yang
    arXiv, 2026
  15. Preprint
    roboforge.gif
    RoboForge: Physically Optimized Text-Guided Whole-Body Locomotion for Humanoids
    Xichen Yuan, Zhe Li, Bofan Lyu, Kuangji Zuo, Yanshuo Lu, Gen Li, and Jianfei Yang
    arXiv, 2026
  16. RSS’26
    a2a.gif
    Action-to-Action Flow Matching
    Jindou Jia*, Gen Li*, Xiangyu Chen, Tuo An, Yuxuan Hu, Jingliang Li, Xinying Guo, and Jianfei Yang
    In Robotics: Science and Systems, 2026
  17. CVPR’26
    evo1.gif
    Evo-1: Lightweight Vision-Language-Action Model with Preserved Semantic Alignment
    Tao Lin, Yilei Zhong, Yuxin Du, Jingjing Zhang, Jiting Liu, Yinxinyu Chen, Encheng Gu, Ziyan Liu, Hongyi Cai, Yanwen Zou, Lixing Zou, Zhaoye Zhou, Gen Li, and Bo Zhao
    In IEEE/CVF Conference on Computer Vision and Pattern Recognition, 2026
  18. CVPR’26
    palm.png
    PALM: Progress-Aware Policy Learning via Affordance Reasoning for Long-Horizon Robotic Manipulation
    Yuanzhe Liu, Jingyuan Zhu, Yuchen Mo, Gen Li, Xu Cao, Jin Jin, Yifan Shen, Zhengyuan Li, Tianjiao Yu, Wenzhen Yuan, Fangqiang Ding, and Ismini Lourentzou
    In IEEE/CVF Conference on Computer Vision and Pattern Recognition, 2026
  19. Preprint
    evo0.png
    Evo-0: Vision-Language-Action Model with Implicit Spatial Understanding
    Tao Lin*, Gen Li*, Yilei Zhong, Yanwen Zou, Yuxin Du, Jiting Liu, Encheng Gu, and Bo Zhao
    arXiv, 2026
  20. AAAI’26
    mask2iv-gif.gif
    Mask2IV: Interaction-Centric Video Generation via Mask Trajectories
    Gen Li, Bo Zhao, Jianfei Yang, and Laura Sevilla-Lara
    In AAAI Conference on Artificial Intelligence, 2026
  21. ICCV’25
    affgrasp-gif.gif
    Learning Precise Affordances from Egocentric Videos for Robotic Manipulation
    Gen Li, Nikolaos Tsagkas, Jifei Song, Ruaridh Mon-Williams, Sethu Vijayakumar, Kun Shao, and Laura Sevilla-Lara
    In IEEE/CVF International Conference on Computer Vision, 2025
  22. ICCV’25
    LITE.png
    Principles of Visual Tokens for Efficient Video Understanding
    Xinyue Hao, Gen Li, Shreyank N Gowda, Robert B Fisher, Jonathan Huang, Anurag Arnab, and Laura Sevilla-Lara
    In IEEE/CVF International Conference on Computer Vision, 2025
  23. NMI
    ellmer.gif
    Embodied Large Language Models Enable Robots to Complete Complex Tasks in Unpredictable Environments
    Ruaridh Mon-Williams, Gen Li, Ran Long, Wenqian Du, and Chris Lucas
    Nature Machine Intelligence, 2025
  24. CVPR’24
    ooal.png
    One-Shot Open Affordance Learning with Foundation Models
    Gen Li, Deqing Sun, Laura Sevilla-Lara, and Varun Jampani
    In IEEE/CVF Conference on Computer Vision and Pattern Recognition, 2024
  25. CVPR’23
    LOCATE.png
    LOCATE: Localize and Transfer Object Parts for Weakly Supervised Affordance Grounding
    Gen Li, Varun Jampani, Deqing Sun, and Laura Sevilla-Lara
    In IEEE/CVF Conference on Computer Vision and Pattern Recognition, 2023
  26. CVPR’21
    ASGNet.png
    Adaptive Prototype Learning and Allocation for Few-Shot Segmentation
    Gen Li, Varun Jampani, Laura Sevilla-Lara, Deqing Sun, Jonghyun Kim, and Joongkyu Kim
    In IEEE/CVF Conference on Computer Vision and Pattern Recognition, 2021


学术服务

  • 领域主席: NeurIPS 2026, BMVC 2026
  • 期刊审稿人: Nature Machine Intelligence, Nature Reviews Computing, TIP, etc.
  • 会议审稿人: CVPR, ICCV, ECCV, NeurIPS, ICLR, RSS, CoRL, ICRA, IROS, AAAI, etc.