Skill-based Safe Reinforcement Learning with Risk Planning
Hanping Zhang, Yuhong Guo. Reinforcement Learning Conference (RLC), 2026.
人工智能 · 强化学习
我是卡尔顿大学计算机科学博士研究生,研究方向为人工智能。我主要在 Yuhong Guo 教授的指导下,在人工智能与机器学习实验室(AIML Lab)从事强化学习(RL)研究。我的博士论文主要围绕安全强化学习。
我最近已完成博士阶段的学习,并将很快加入中国的一所研究机构。
关于
我的研究主要围绕强化学习(RL)算法的开发。我的主要研究兴趣是安全强化学习,同时也关注强化学习泛化、自然语言指导的强化学习、基于技能的强化学习以及跨领域强化学习。同时,我也对将强化学习技术应用于其他机器学习问题感兴趣,包括半监督学习和噪声标签学习。
近期,我们研究了如果根据自然语言指导来改进强化学习智能体,从而提升决策效率、并在有限交互条件下增强泛化能力。同时,我依然对研究安全强化学习方法有兴趣,并希望能够使其应用于真实世界的决策场景中。
论文
Hanping Zhang, Yuhong Guo. Reinforcement Learning Conference (RLC), 2026.
Hanping Zhang, Adam Koziak, Yuhong Guo. European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases (ECML PKDD), 2026.
Hanping Zhang, Yuhong Guo. Conference on Robots and Vision (CRV), 2026.
Marzi Heidari, Hanping Zhang, Hao Yan, Yuhong Guo. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) Findings Track, 2026.
Hanping Zhang, Yuhong Guo. European Conference on Artificial Intelligence (ECAI), 2025.
Marzi Heidari, Hanping Zhang, Yuhong Guo. Advances in Neural Information Processing Systems (NeurIPS), 2025.
Abdullah Alchihabi*, Hanping Zhang*, Yuhong Guo. International Conference on Artificial Intelligence and Statistics (AISTATS), 2025. *Equal contribution
Marzi Heidari, Hanping Zhang, Yuhong Guo. Advances in Neural Information Processing Systems (NeurIPS), 2024.
Daning Cheng, Shigang Li, Hanping Zhang, Fen Xia, Yunquan Zhang. IEEE Transactions on Parallel and Distributed Systems (TPDS), 2021.
Daning Cheng, Hanping Zhang, Fen Xia, Shigang Li, Yunquan Zhang. IEEE International Conference on Tools with Artificial Intelligence (ICTAI), 2019.
Hanping Zhang, Yuhong Guo. Aligning Reinforcement Learning Experimentalists and Theorists Workshop (NeurIPS), 2025.
Hanping Zhang, Yuhong Guo. Decision Awareness in Reinforcement Learning Workshop (ICML), 2022.
背景
计算机科学博士
渥太华,加拿大安大略省
导师:Yuhong Guo 教授。
计算机科学工程硕士
布法罗,美国纽约州
计算机科学理学学士,数学辅修
帕克,美国马里兰州
计算机科学理学学士
成都,中国四川省
后转入马里兰大学帕克分校。
学术服务