
- 张利军
- 最终学位:博士
- 电子邮箱:lijun-zhang@sxu.edu.cn
- 导师类型:
- 联系电话:0351-7010566
- 所在院所:智能信息处理研究所
- 研究方向:强化学习、大模型对齐
- 个人简介
- 发表论文
- 科研项目
张利军,博士,讲师,研究兴趣包括强化学习、大模型对齐、安全策略优化等。2026年博士毕业于j9九游国际站集团。先后在NeurIPS、ICML、IEEE Sensors Journal、《计算机学报》等国际国内重要期刊和会议上发表多篇论文;获得国家发明专利授权1项;主持中国科协青年人才托举工程博士生专项计划项目一项;主持山西省研究生教育创新项目1项。
[1] Lijun Zhang, Lin Li, Yajie Qi, Huizhong Song, Yaodong Yang, Jun Wang, Wei Wei*. Risk-aware direct preference optimization under nested risk measure. Proceedings of the Annual Conference on Neural Information Processing Systems (NeurIPS), 2025, 38: 73591-73625. (CCF A类会议)
[2] Lijun Zhang, Lin Li, Wei Wei*, Huizhong Song, Yaodong Yang, Jiye Liang. Scalable constrained policy optimization for safe multi-agent reinforcement learning. Proceedings of the Annual Conference on Neural Information Processing Systems (NeurIPS), 2024, 37: 138698-138730. (CCF A类会议)
[3] Wei Wei, Lijun Zhang, Lin Li, Huizhong Song, Jiye Liang*. Set-membership belief state-based reinforcement learning for POMDPs. Proceedings of the International Conference on Machine Learning (ICML), 2023: 36856-36867. (CCF A类会议)
[4] Lijun Zhang, Bo Yang*, Xiu You. Received signal strength indicator-based recursive set-membership localization with unknown transmit power and path loss exponent. IEEE Sensors Journal, 2021, 21(22): 26175-26185. (SCI 2区)
[5] 魏巍, 宋慧忠, 李琳*, 张利军, 马亿, 郝建业, 梁吉业. 基于互信息引导信息聚合的多智能体强化学习方法. 计算机学报, 2026, 49(7): 1514-1526. (CCF A类中文科技期刊)
[6] Wei Wei, Binchao Ma, Lin Li*, Huizhong Song, Lijun Zhang, and Fengjiao Li. AGOD: Enhancing multi-agent generalization via attribution-guided observation dropout. Proceedings of the 2025 7th International Conference on Distributed Artificial Intelligence (DAI), 2025: 48-57. (CCF C类会议, oral)
[1] 中国科协青年人才托举工程博士生专项计划. 2024-06至2026-06, 主持
[2] 研究生教育创新项目. 2023KY034, 部分可观测条件下的安全多智能体强化学习研究. 2023-06 至 2024-12, 主持
[3] 山西省自然科学基金面上项目, 202203021211294, 面向深度强化学习的值函数估计方法研究. 2023-01 至 2025-12, 参与
[4] 山西省留学人员科技活动择优资助项目, 20240002, 基于强化学习的智能网联汽车协同控制关键技术研究. 2024-06 至 2026-06, 参与