论文发表

完整列表 · 287 篇 · 默认显示 19 篇代表作

Google Scholar ↗
★ 代表作 19 多智能体 RL 109对齐 RLHF 82具身 RL 54RL4Sci 34智能体 RL 33 预印本 72 全部 287
2026 62 篇
ACL
A Game-Theoretic Negotiation Framework for Cross-Cultural Consensus *
Guoxi Zhang, Jiawei Chen, Tianzhuo Yang, Jiaming Ji, Yaodong Yang#, Juntao Dai
ACL 2026
ICML
Are Your Agents Upward Deceivers?
Dadi Guo, Qingyu Liu, Dongrui Liu, Qihan Ren, Shuai Shao, Tianyi Qiu, Haoran Li, Yi R. Fung, Zhongjie Ba, Juntao Dai, Jiaming Ji, Zhikai Chen, Jialing Tao, Yaodong Yang, Jing Shao, Xia Hu
ICML 2026
AAMAS
Beyond Self-Interest: Simulating Human-like Social Behavior via Modeling Social Value Orientation in Agent Motivation
Jingzhe Lin, Ceyao Zhang, Yaodong Yang, Yizhou Wang, Song-Chun Zhu, Fangwei Zhong
AAMAS 2026
ACL
Communication-Efficient Desire Alignment for Proactive Embodied Human–Agent Interaction *
Yuanfei Wang, Xinju Huang, Fangwei Zhong, Yaodong Yang#, Yizhou Wang, Yuanpei Chen, Hao Dong
ACL 2026
ICML
FormalJudge: A Neuro-Symbolic Paradigm for Agentic Oversight *
Jiayi Zhou, Yang Sheng, Hantao Lou, Yaodong Yang#, Jie Fu
ICML 2026
arXiv
PILA: Plug-and-Play Insertion for LLM-native Advertising
Zhaowei Zhang, Yuhan Fu, Yihang Zhang, Xiaohan Liu, Ceyao Zhang, Xiaoyuan Zhang, Yipeng Kang, Tonghan Wang, Yaodong Yang
arXiv 2026
ICLR
PoliCon: Evaluating LLMs on Achieving Diverse Political Consensus Objectives *
Zhaowei Zhang, Xiaobo Wang, Minghua Yi, Mengmeng Wang, Fengshuo Bai, Zilong Zheng, Yipeng Kang, Yaodong Yang#
ICLR 2026
ACL
SIV-Bench: A Video Benchmark for Social Interaction Understanding and Reasoning
Fanqi Kong, Weiqin Zu, Xinyu Chen, Yaodong Yang, Song-Chun Zhu, Xue Feng
ACL 2026
ACL
Uncovering Strategic Egoism Behaviors in Large Language Models
Yaoyuan Zhang, Zonghao Ying, Aishan Liu, Jian Yang, Tianlin Li, Yaodong Yang, Xianglong Liu
ACL 2026 (Findings) Findings
EMNLP
When Lower Privileges Suffice: Investigating Over-Privileged Tool Selection in LLM Agents *
Kaiyue Yang, Yuyan Bu, Jingwei Yi, Yuchi Wang, Biyu Zhou, Juntao Dai, Songlin Hu, Yaodong Yang#
EMNLP 2026 (Findings) Findings
npj DM
Development and prospective shadow evaluation of a domain-specific large language model
Yibing Guo, Xiangbin Meng, Erlan Yu, Wanwan Zhang, Yaodong Yang, Hongrui Ma, Chunli Shao, Wenyao Wang, Rongjie Wang, Haofei Wang, Ran Meng, Wenbo Zhao, Zhen Song, Xunming Ji, Chuanjie Wu
npj Digital Medicine
SSRN
Post-Trade Order-Flow Decoding and Strategic Camouflage *
Zhigang Zhang, Qiang Zhang, Shancun Liu, Yaodong Yang#
SSRN 2026
TMLR
Re:Form - Reducing Human Priors in Scalable Formal Software Verification with RL in LLMs: A Preliminary Study on Dafny
Chuanhao Yan, Fengdi Che, Xuhan Huang, Xu Xu, Xin Li, Yizhi Li, Xingwei Qu, Jingzhe Shi, Chenghua Lin, Yaodong Yang, Binhang Yuan, Hang Zhao, Yu Qiao, Bowen Zhou, Jie Fu
Transactions on Machine Learning Research (TMLR)
COLM
A Blind Spot in Alignment: Quantifying Biosecurity Risks in Large Language Models *
Shu Quan, Tianfang Hao, Sitong Fang, He Geng, Jiayi Zhou, Boyuan Chen, Kaile Wang, Donghai Hong, Juntao Dai, Yaodong Yang#, Jiaming Ji
COLM 2026
ICLR
Align Once, Benefit Multilingually: Enforcing Multilingual Consistency for LLM Safety Alignment *
Yuyan Bu, Xiaohao Liu, ZhaoXing Ren, Yaodong Yang#, Juntao Dai
ICLR 2026
ICML
Debate with Images: Detecting Deceptive Behaviors in Multimodal Large Language Models *
Sitong Fang, Shiyi Hou, Kaile Wang, Boyuan Chen, Donghai Hong, Jiayi Zhou, Juntao Dai, Yaodong Yang#, Jiaming Ji
ICML 2026
arXiv
Policy Improvement Reinforcement Learning
Huaiyang Wang, Xiaojie Li, Deqing Wang, Haoyi Zhou, Zixuan Huang, Yaodong Yang, Jianxin Li, Yikun Ban
arXiv 2026
ACM MM
Reading Between the Pixels: An Inscriptive Jailbreak Attack on Text-to-Image Models
Zonghao Ying, Haowen Dai, Lianyu Hu, Zonglei Jing, Quanchen Zou, Yaodong Yang, Aishan Liu, Xianglong Liu
ACM MM 2026
ACL
SafeMCP: Proactive Power Regulation for LLM Agents Defense via Environment-Grounded Look-Ahead Reasoning *
Lichao Wang, ZhaoXing Ren, Tianzhuo Yang, Jiaming Ji, Chi Harold Liu, Yaodong Yang#, Juntao Dai
ACL 2026
ACL
SafeMT: Multi-turn Safety for Multimodal Language Models
Han Zhu, Juntao Dai, Jiaming Ji, Haoran Li, Chengkun Cai, Pengcheng Wen, Chi-Min Chan, Boyuan Chen, Yaodong Yang, Sirui Han, Yike Guo
ACL 2026 (Findings) Findings
EMNLP
Stable Reasoning, Unstable Responses: Mitigating LLM Deception via Stability Asymmetry *
Guoxi Zhang, Jiawei Chen, Tianzhuo Yang, Lang Qin, Juntao Dai, Yaodong Yang#, Jingwei Yi
EMNLP 2026
ICML
UniCode: Augmenting Evaluation for Code Reasoning
Xinyue Zheng, Haowei Lin, Shaofei Cai, Zilong Zheng, Yaodong Yang, Yitao Liang
ICML 2026
EMNLP
VISA: Value Injection via Shielded Adaptation for Personalized LLM Alignment *
Jiawei Chen, Tianzhuo Yang, Guoxi Zhang, Jiaming Ji, Yaodong Yang#, Juntao Dai
EMNLP 2026
ACL
When Slower Isn’t Truer: Inverse Scaling Law of Truthfulness in Multimodal Reasoning *
Jiaming Ji, Sitong Fang, Wenjing Cao, Jiahao Li, Xuyao Wang, Chi-Min Chan, Sirui Han, Juntao Dai, Yike Guo, Yaodong Yang#
ACL 2026 (Findings) Findings
arXiv
Accelerating Robotic Reinforcement Learning with Agent Guidance *
Haojun Chen, Zili Zou, Chengdong Ma, Yaoxiang Pu, Haotong Zhang, Yuanpei Chen, Yaodong Yang#
arXiv 2026
AAAI
CABTO: Context-Aware Behavior Tree Grounding for Robot Manipulation
Xinglin Chen, Yishuai Cai, Yuanpei Chen, Minglong Li, Wenjing Yang, Ji Wang, Yaodong Yang
AAAI 2026
ICRA
CDF-Glove: A Cable-Driven Force Feedback Glove for Dexterous Teleoperation
Huayue Liang*, Ruochong Li, Yuanpei Chen, Yaodong Yang, Long Zeng, Xueqian Wang
ICRA 2026
AAAI
DexGraspVLA: A Vision-Language-Action Framework Towards General Dexterous Grasping *
Yifan Zhong, Xuchuan Huang, Ruochong Li, Ceyao Zhang, Zhang Chen, Tianrui Guan, Fanlian Zeng, Ka Nam Lui, Yuyao Ye, Yitao Liang, Yaodong Yang#, Yuanpei Chen
AAAI 2026 Oral
ICRA
DexKnot: Generalizable Visuomotor Policy Learning for Dexterous Bag-Knotting Manipulation *
Jiayuan Zhang, Ruihai Wu, Haojun Chen, Yuran Wang, Yifan Zhong, Ceyao Zhang, Yaodong Yang#, Yuanpei Chen*
ICRA 2026
arXiv
EgoSteer: A Full-Stack System Towards Steerable Dexterous Manipulation from Egocentric Videos
Yifan Zhong, Zhang Chen, Tianrui Guan, Fanlian Zeng, Yuyao Ye, Tianjia He, Ka Nam Lui, Jiayi Li, Tingrui Zhang, Ruilin Yan, Xinhao Ji, Guangyu Zhao, Wenjie Lou, Jiayuan Zhang, Yuanpei Chen, Yaodong Yang
arXiv 2026
arXiv
Frequency-Aware Flow Matching for Continuous and Consistent Robotic Action Generation
Jianing Guo, Fangzheng Chen, Zihao Mao, Wong Lik Hang Kenny, Zhenhong Wu, Yu Li, Yishuai Cai, Yuanpei Chen, Yikun Ban, Kai Chen, Qi Dou, Yaodong Yang, Xianglong Liu, Huijie Zhao, Simin Li
arXiv 2026
arXiv
LAMP: Latent Motion Prior-Guided Real-World Learning for Dexterous Hand Manipulation
Xinye Yang, Zhiyuan Ma, Hongze Yu, Yuanpei Chen, Yaodong Yang, Xiaojie Chai, Xinlei Chen, Chao Yu
arXiv 2026
ICLR
MVR: Multi-view Video Reward Shaping for Reinforcement Learning
Lirui Luo, Guoxi Zhang, Hongming Xu, Yaodong Yang, Cong Fang, Qing Li
ICLR 2026
ICLR
On Robustness of Vision-Language-Action Model against Multi-Modal Perturbations *
Jianing Guo, Zhenhong Wu, Chang Tu, Yiyao Ma, Xiangqi Kong, Zhiqian Liu, Jiaming Ji, Shuning Zhang, Yuanpei Chen, Kai Chen, Xianglong Liu, Qi Dou, Yaodong Yang#, Huijie Zhao, Weifeng Lv, Simin Li
ICLR 2026
ECCV
One Demonstration Is Enough for Real-World Robotic Reinforcement Learning *
Yuwan Liu, Hongze Yu, Song Liu, Yuhan Wang, Junge Zhang, Yaodong Yang#, Yuanpei Chen, Ceyao Zhang
ECCV 2026
arXiv
RMBench: Memory-Dependent Robotic Manipulation Benchmark with Insights into Policy Design
Tianxing Chen, Yuran Wang, Mingleyang Li, Yan Qin, Hao Shi, Zixuan Li, Yifan Hu, Yingsheng Zhang, Kaixuan Wang, Yue Chen, Hongcheng Wang, Renjing Xu, Ruihai Wu, Yao Mu, Yaodong Yang, Hao Dong, Ping Luo
arXiv 2026
IROS
RetrDex: Efficient Object Retrieval in Cluttered Scenes with a Dexterous Hand *
Fengshuo Bai*, Yu Li, Jie Chu, Tawei Chou, Runchuan Zhu, Ying Wen, Yaodong Yang#, Yuanpei Chen
IROS 2026
ICLR
RoboSafe: Safeguarding Embodied Agents via Executable Safety Logic
Le Wang, Zonghao Ying, Xiao Yang, Quanchen Zou, Zhenfei Yin, Tianlin Li, Jian Yang, Yaodong Yang, Lu Sheng, Aishan Liu, Xianglong Liu
ICLR 2026 WorkshopOutstanding Paper
ICML
SafeLab: An Interactive High-Fidelity Benchmark for Embodied Safety in Scientific Robotics *
Fengshuo Bai, Yufeng Li, Ruihai Wu, Peishuo Wang, Yuhan Wang, Bernie Hao Zhu, Yuanfei Wang, Tawei Chou, Jing Gao, Runchuan Zhu, Ying Wen, Yaodong Yang#, Yuanpei Chen
ICML 2026
ICML
VLA-Arena: An Open-Source Framework for Benchmarking Vision-Language-Action Models *
Borong Zhang, Jiahao Li, Jiachen Shen, Yishuai Cai, Yuhao Zhang, Yuanpei Chen, Juntao Dai, Jiaming Ji, Yaodong Yang#
ICML 2026
TPAMI
Evolving Diverse Red-team Language Models in Multi-round Multi-agent Games *
Chengdong Ma, Ziran Yang, Hai Ci, Jun Gao, Minquan Gao, Xuehai Pan, Yaodong Yang#
IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)
ICML
Fault Tolerant Multi-Agent Learning with Adversarial Budget Constraints
David Henry Mguni, Yaqi Sun, Haojun Chen, Wanrong Yang, Amir Darabi, Larry Olanrewaju Orimoloye, Yaodong Yang
ICML 2026
arXiv
Heterogeneous Agent Collaborative Reinforcement Learning
Zhixia Zhang, Zixuan Huang, Gongxun Li, Huaiyang Wang, Chengyi Yuan, Xin Xia, Deqing Wang, Fuzhen Zhuang, Shuai Ma, Ning Ding, Yaodong Yang, Jianxin Li, Yikun Ban
arXiv 2026
UAI
Learning Expressive Random Feature Models via Parametrized Activations *
Zailin Ma, Jiansheng Yang, Yaodong Yang#
UAI 2026
JMLR
Sample-Efficient Regret-Minimizing Double Oracle in Two-Player Zero-Sum Extensive-Form Games *
Xiaohang Tang, Chiyuan Wang, Chengdong Ma, Ilija Bogunovic, Stephen McAleer, Yaodong Yang#
Journal of Machine Learning Research (JMLR)
ICML
Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning *
Simin Li, Zihao Mao, Zheng Yuwei, Linhao Wang, Ruixiao Xu, Chengdong Ma, Zhiqian Liu, Xin Yu, Yuqing Ma, Xin Wang, Jie Luo, Bo An, Yaodong Yang#, Weifeng Lv, Xianglong Liu
ICML 2026
OpenReview
Adversarial Policy Transfer in Mixed Cooperative-Competitive Games
Ruixiao Xu, Zhiqian Liu, Zhixia Zhang, Simin Li, Qi Dou, Yaodong Yang, Xianglong Liu
OpenReview 2026
arXiv
AgentVisor: Defending LLM Agents Against Prompt Injection via Semantic Virtualization
Zonghao Ying, Haozheng Wang, Jiangfan Liu, Quanchen Zou, Aishan Liu, Jian Yang, Yaodong Yang, Xianglong Liu
arXiv 2026
arXiv
Does LLM Alignment Really Need Diversity?
Zhaowei Zhang, Xiaohan Liu, Xuekai Zhu, Junchao Huang, Ceyao Zhang, Zhiyuan Feng, Yaodong Yang, Xiaoyuan Yi, Xing Xie
arXiv 2026
arXiv
Enhance the Safety in Reinforcement Learning by ADRC Lagrangian Methods
Mingxu Zhang, Huicheng Zhang, Jiaming Ji, Yaodong Yang, Ying Sun
arXiv 2026
SSRN
Epistemic Exploration Toward Artificial General Intelligence
Yikun Ban, Fengkai Yang, Fangzheng Chen, Yibo Wang, Zhijun Chen, Zhongyi Li, Zixuan Huang, Xiaoyuan Zhang, Gongxun Li, Zehao Chen, Huaiyang Wang, Xiaodong Lu, Yaocheng Yang, Pengcheng Wei, Wan Tian, Zherui Chen, Zhixia Zhang, Hongyan Xie, Lingyu Lv, Xiaohan Wang, Jiajun Chai, Guojun Yin, Wei Lin, Tianxiang Ai, Ruijie Wang, Haoyi Zhou, Chaochao Lu, Wanxiang Che, Fuzhen Zhuang, Ning Ding, Qianqian Xu, Deqing Wang, Yaodong Yang, Jianxin Li
SSRN 2026
arXiv
Evolving Deception: When Agents Evolve, Deception Wins
Zonghao Ying, Haowen Dai, Tianyuan Zhang, Yisong Xiao, Quanchen Zou, Aishan Liu, Jian Yang, Yaodong Yang, Xianglong Liu
arXiv 2026
arXiv
GuardAD: Safeguarding Autonomous Driving MLLMs via Markovian Safety Logic
Tianyuan Zhang, Peng Yue, Zihao Peng, Jiangfan Liu, Zonghao Ying, Jiakai Wang, Tianlin Li, Jian Yang, Yaodong Yang, Aishan Liu, Xianglong Liu
arXiv 2026
OpenReview
Mesa and Mask: A Benchmark for Detecting and Classifying Deceptive Behaviors in LLMs
Boren Zheng, Mengying Yuan, Kexin Chen, Baihui Zheng, Zhendong Liu, Boyuan Chen, Jiaming Ji, Yingshui Tan, Xiaoyong Zhu, Yaodong Yang, Bo Zheng
OpenReview 2026
arXiv
MiraBench: Evaluating Action-Conditioned Reliability in Robotic World Models *
Tianzhuo Yang, Zihan Shen, Zirui Mi, Zhaoyi Zhang, Jiayi Zhou, Jiaming Ji, Juntao Dai, Jiawei Chen, Boyuan Chen, Yaodong Yang#
arXiv 2026
arXiv
RedVLA: Physical Red Teaming for Vision-Language-Action Models *
Yuhao Zhang, Borong Zhang, Jiaming Fan, Jiachen Shen, Yishuai Cai, Yaodong Yang#, Jiaming Ji#
arXiv 2026
arXiv
SPADE-Bench: Evaluating Spontaneous Strategic Deception in Agents via Plan-Action Divergence
Yuyan Bu, Haowei Li, Qirui Zheng, Bowen Dong, Kaiyue Yang, Jiaming Ji, Yingshui Tan, Wenxin Li, Yaodong Yang, Juntao Dai
arXiv 2026
OpenReview
ScaleMoE: Mixture-of-Experts for Scalable Continuous Control in Actor-Critic Reinforcement Learning
Yi Ma, Chenjun Xiao, Hongyao Tang, Yaodong Yang, Jing Liang, Jiye Liang
OpenReview 2026
arXiv
ShuttleEnv: An Interactive Data-Driven RL Environment for Badminton Strategy Modeling
Ang Li, Xinyang Gong, Bozhou Chen, Yunlong Lu, Jiaming Ji, Yongyi Wang, Yaodong Yang, Wenxin Li
arXiv 2026
arXiv
System Design for Maintaining Internal State Consistency in Long-Horizon Robotic Games
Guangyu Zhao, Ceyao Zhang, Chengdong Ma, Tao Wu, Yiyang Song, Haoxuan Ru, Yifan Zhong, Ruilin Yan, Lingfeng Li, Ruochong Li, Yu Li, Xuyuan Han, Yun Ding, Ruizhang Jiang, Xiaochuan Zhang, Yichao Li, Yuanpei Chen, Yaodong Yang, Yitao Liang
arXiv 2026
arXiv
TwinGate: Stateful Defense against Decompositional Jailbreaks
Bowen Sun, Chaozhuo Li, Yaodong Yang, Yiwei Wang, Chaowei Xiao
arXiv 2026
arXiv
Your Group-Relative Advantage Is Biased
Fengkai Yang, Zherui Chen, Xiaohan Wang, Xiaodong Lu, Jiajun Chai, Guojun Yin, Wei Lin, Shuai Ma, Fuzhen Zhuang, Deqing Wang, Yaodong Yang, Jianxin Li, Yikun Ban
arXiv 2026
2025 62 篇
EMNLP
Enhancing LLM-Based Social Bot via an Adversarial Learning Framework
Fanqi Kong, Xiaoyuan Zhang, Xinyu Chen, Yaodong Yang, Song-Chun Zhu, Xue Feng
EMNLP 2025
AAMAS
Hierarchical Multi-Agent Framework for Dynamic Macroeconomic Modelling Using Large Language Models
Zhixun Chen, Zijing Shi, Yaodong Yang, Meng Fang, Yali Du
AAMAS 2025 Extended
NeurIPS
Social World Model-Augmented Mechanism Design Policy Learning *
Xiaoyuan Zhang, Yizhe Huang, Chengdong Ma, Zhixun Chen, Long Ma, Yali Du, Song-Chun Zhu, Yaodong Yang#, Xue Feng
NeurIPS 2025
NeurIPS
World Models Should Prioritize the Unification of Physical and Social Dynamics *
Xiaoyuan Zhang, Chengdong Ma, Yizhe Huang, Weidong Huang, Siyuan Qi, Song-Chun Zhu, Xue Feng, Yaodong Yang#
NeurIPS 2025 Position
NeurIPS
PHYBench: Holistic Evaluation of Physical Perception and Reasoning in Large Language Models
Shi Qiu, Shaoyang Guo, Zhuo-Yang Song, Yunbo Sun, Zeyu Cai, Jiashen Wei, Tianyu Luo, Yixuan Yin, Haoxu Zhang, Yi Hu, Chenyang Wang, Chencheng Tang, Haoling Chang, Qi Liu, Ziheng Zhou, Tianyu Zhang, Jingtian Zhang, Zhangyi Liu, Minghao Li, Yuku Zhang, Boxuan Jing, Xianqi Yin, Yutong Ren, Zizhuo Fu, Jiaming Ji, Weike Wang, Xudong Tian, Anqi Lv, Laifu Man, Jianxiang Li, Feiyu Tao, Qihua Sun, Zhou Liang, Yushu Mu, Zhongxuan Li, Jing-Jun Zhang, Shutao Zhang, Xiaotian Li, Xingqi Xia, Jiawei Lin, Zheyu Shen, Jiahang Chen, Qiuhao Xiong, Binran Wang, Fengyuan Wang, Ziyang Ni, Bohan Zhang, Fan Cui, Changkun Shao, Qing-Hong Cao, Ming-xing Luo, Yaodong Yang, Muhan Zhang, Hua Xing Zhu
NeurIPS 2025 Dataset
arXiv
AI Deception: Risks, Dynamics, and Controls
Boyuan Chen, Sitong Fang, Jiaming Ji, Yanxu Zhu, Pengcheng Wen, Jinzhou Wu, Yingshui Tan, Boren Zheng, Mengying Yuan, Wenqi Chen, Donghai Hong, Alex Qiu, Xin Chen, Jiayi Zhou, Kaile Wang, Juntao Dai, Borong Zhang, Tianzhuo Yang, Saad Siddiqui, Isabella Duan, Yawen Duan, Brian Tse, Jen-Tse Huang, Kun Wang, Baihui Zheng, Jiaheng Liu, Jian Yang, Yiming Li, Wenting Chen, Dongrui Liu, Lukas Vierling, Zhiheng Xi, Haobo Fu, Wenxuan Wang, Jitao Sang, Zhengyan Shi, Chi-Min Chan, Eugenie Shi, Simin Li, Juncheng Li, Wei Ji, Dong Li, Jinglin Yang, Jun Song, Yinpeng Dong, Jie Fu, Bo Zheng, Min Yang, Yike Guo, Philip Torr, Robert Trager, Yi Zeng, Zhongyuan Wang, Yaodong Yang, Tiejun Huang, Ya-Qin Zhang, Hongjiang Zhang, Andrew Yao
arXiv 2025
ICLR
Amulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMs *
Zhaowei Zhang, Fengshuo Bai, Qizhi Chen, Chengdong Ma, Mingzhi Wang, Haoran Sun, Zilong Zheng, Yaodong Yang#
ICLR 2025
ACL
Benchmarking Multi-National Value Alignment for Large Language Models
Chengyi Ju, Weijie Shi, Chengzhong Liu, Jiaming Ji, Jipeng Zhang, Ruiyuan Zhang, Jiajie Xu, Yaodong Yang, Sirui Han, Yike Guo
ACL 2025 (Findings) Findings
ACL
Boosting Policy and Process Reward Models with Monte Carlo Tree Search in Open-Domain QA
Chi-Min Chan, Chunpu Xu, Junqi Zhu, Jiaming Ji, Donghai Hong, Pengcheng Wen, Chunyang Jiang, Zhen Ye, Yaodong Yang, Wei Xue, Sirui Han, Yike Guo
ACL 2025 (Findings) Findings
ICLR
Emerging Safety Attack and Defense in Federated Instruction Tuning of Large Language Models
Rui Ye, Jingyi Chai, Xiangrui Liu, Yaodong Yang, Yanfeng Wang, Siheng Chen
ICLR 2025
AGI
Heterogeneous Value Alignment Evaluation for Large Language Models *
Zhaowei Zhang, Ceyao Zhang, Nian Liu, Siyuan Qi, Ziqi Rong, Song-Chun Zhu, Yaodong Yang#
AGI 2025
ICLR
In-Context Editing: Learning Knowledge from Self-Induced Distributions
Siyuan Qi, Bangcheng Yang, Kailin Jiang, Xiaobo Wang, Jiaqi Li, Yifan Zhong, Yaodong Yang, Zilong Zheng
ICLR 2025
NeurIPS
InterMT: Multi-Turn Interleaved Preference Alignment with Human Feedback *
Boyuan Chen, Donghai Hong, Jiaming Ji, Jiacheng Zheng, Bowen Dong, Rui Pan, Xuyao Wang, Juntao Dai, Chi-Min Chan, Yaodong Yang#
NeurIPS 2025 SpotlightDataset
arXiv
J1: Exploring Simple Test-Time Scaling for LLM-as-a-Judge
Chi-Min Chan, Chunpu Xu, Jiaming Ji, Zhen Ye, Pengcheng Wen, Chunyang Jiang, Yaodong Yang, Wei Xue, Sirui Han, Yike Guo
arXiv 2025
NeurIPS
Learning Principles from Multi-modal Human Preference *
Jiayi Zhou, Jiaming Ji, Boyuan Chen, Jiapeng Sun, Wenqi Chen, Donghai Hong, Sirui Han, Yike Guo, Yaodong Yang#
NeurIPS 2025
NAACL
Libra-Leaderboard: Towards Responsible AI through a Balanced Leaderboard of Safety and Capability
Haonan Li, Xudong Han, Zenan Zhai, Honglin Mu, Hao Wang, Zhenxuan Zhang, Yilin Geng, Shom Lin, Renxi Wang, Artem Shelmanov, Xiangyu Qi, Yuxia Wang, Donghai Hong, Youliang Yuan, Meng Chen, Haoqin Tu, Fajri Koto, Cong Zeng, Tatsuki Kuribayashi, Rishabh Bhardwaj, Bingchen Zhao, Yawen Duan, Yi Liu, Emad A. Alghamdi, Yaodong Yang, Yinpeng Dong, Soujanya Poria, Pengfei Liu, Zhengzhong Liu, Xuguang Ren, Eduard H. Hovy, Iryna Gurevych, Preslav Nakov, Monojit Choudhury, Timothy Baldwin
NAACL 2025 (Demo)
ICLR
Magnetic Preference Optimization: Achieving Last-iterate Convergence for Language Model Alignment *
Mingzhi Wang, Chengdong Ma, Qizhi Chen, Linjian Meng, Yang Han, Jiancong Xiao, Zhaowei Zhang, Jing Huo, Weijie J. Su, Yaodong Yang#
ICLR 2025
ICLR
Mitigating Reward Over-Optimization in RLHF via Behavior-Supported Regularization *
Juntao Dai, Taiye Chen, Yaodong Yang#, Qian Zheng
ICLR 2025
ACL
PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference *
Jiaming Ji, Donghai Hong, Borong Zhang, Boyuan Chen, Josef Dai, Boren Zheng, Tianyi Qiu, Boxun Li, Yaodong Yang#
ACL 2025
AAAI
RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors *
Fengshuo Bai, Runze Liu, Yali Du, Ying Wen, Yaodong Yang#
AAAI 2025 Oral
ACL
Reward Generalization in RLHF: A Topological Perspective *
Tianyi Qiu, Fanzhi Zeng, Jiaming Ji, Dong Yan, Kaile Wang, Jiayi Zhou, Yang Han, Josef Dai, Xuehai Pan, Yaodong Yang#
ACL 2025 (Findings) Findings
NeurIPS
Risk-aware Direct Preference Optimization under Nested Risk Measure
Lijun Zhang, Lin Li, Yajie Qi, Huizhong Song, Yaodong Yang, Jun Wang, Wei Wei
NeurIPS 2025
AGI
Roadmap on Incentive Compatibility for AI Alignment and Governance in Sociotechnical Systems *
Zhaowei Zhang, Fengshuo Bai, Mingzhi Wang, Haoyang Ye, Chengdong Ma, Yaodong Yang#
AGI 2025 Oral
ICML
SAE-V: Interpreting Multimodal Models for Enhanced Alignment *
Hantao Lou, Changye Li, Jiaming Ji, Yaodong Yang#
ICML 2025
NeurIPS
STAR: Efficient Preference-based Reinforcement Learning via Dual Regularization *
Fengshuo Bai, Rui Zhao, Hongming Zhang, Sijia Cui, Shao Zhang, Ying Wen, Yaodong Yang#, Bo Xu, Lei Han
NeurIPS 2025
NeurIPS
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback *
Jiaming Ji, Xinyu Chen, Rui Pan, Han Zhu, Conghui Zhang, Jiahao Li, Donghai Hong, Boyuan Chen, Jiayi Zhou, Kaile Wang, Juntao Dai, Chi-Min Chan, Sirui Han, Yike Guo, Yaodong Yang#
NeurIPS 2025
arXiv
SafeEditor: Unified MLLM for Efficient Post-hoc T2I Safety Editing *
Ruiyang Zhang, Jiahao Luo, Xiaoru Feng, Qiufan Pang, Yaodong Yang#, Juntao Dai#
arXiv 2025
ACL
SafeLawBench: Towards Safe Alignment of Large Language Models
Chuxue Cao, Han Zhu, Jiaming Ji, Qichao Sun, Zhenghao Zhu, Yinyu Wu, Josef Dai, Yaodong Yang, Sirui Han, Yike Guo
ACL 2025 (Findings) Findings
AAAI
Sequence to Sequence Reward Modeling: Improving RLHF by Language Feedback *
Jiayi Zhou, Jiaming Ji, Juntao Dai, Yaodong Yang#
AAAI 2025 Oral
AAAI
Stream Aligner: Efficient Sentence-Level Alignment via Distribution Induction *
Hantao Lou, Jiaming Ji, Kaile Wang, Yaodong Yang#
AAAI 2025
arXiv
Super Co-alignment of Human and AI for Sustainable Symbiotic Society
Yi Zeng, Feifei Zhao, Yuwei Wang, Enmeng Lu, Yaodong Yang, Lei Wang, Chao Liu, Yitao Liang, Dongcheng Zhao, Bing Han, Haibo Tong, Yao Liang, Dongqi Liang, Kang Sun, Boyuan Chen, Jinyu Fan
arXiv 2025
CASE
A Unified Framework for Multi-Stage Decision Optimization with Deep Reinforcement Learning and Foundation Models *
Qinghao Wang, Jinyang Jiang, Xiaotian Liu, Tao Ren, Yi Zheng, Cheng Zhang, Yaodong Yang#, Yijie Peng
2025 IEEE 21st International Conference on Automation Science and Engineering (CASE)
IROS
Adaptive Visual-Tactile Fusion with Predictive Force Attention for Dexterous Manipulation
Jinzhou Li, Tianhao Wu*, Jiyao Zhang, Zeyuan Chen, Haotian Jin, Aaron Mingdong Wu, Yujun Shen, Yaodong Yang, Hao Dong
IROS 2025
CoRL
ClutterDexGrasp: A Sim-to-Real System for General Dexterous Grasping in Cluttered Scenes
Zeyuan Chen, Qiyang Yan, Yuanpei Chen, Tianhao Wu, Jiyao Zhang, Zihan Ding, Jinzhou Li, Yaodong Yang, Hao Dong
CoRL 2025
NeurIPS
DexFlyWheel: A Scalable and Self-improving Data Generation Framework for Dexterous Manipulation *
Kefei Zhu, Fengshuo Bai, YuanHao Xiang, Yishuai Cai, Xinglin Chen, Ruochong Li, Xingtao Wang, Hao Dong, Yaodong Yang#, Xiaopeng Fan, Yuanpei Chen
NeurIPS 2025 Spotlight
arXiv
Dexterous Non-Prehensile Manipulation for Ungraspable Object via Extrinsic Dexterity *
Yuhan Wang, Yu Li, Yaodong Yang#, Yuanpei Chen#
arXiv 2025
AAAI
Differentiable Information Enhanced Model-Based Reinforcement Learning *
Xiaoyuan Zhang, Xinyan Cai, Bo Liu, Weidong Huang, Song-Chun Zhu, Siyuan Qi, Yaodong Yang#
AAAI 2025 Oral
ICML
Falcon: Fast visuomotor policy via partial denoising *
Haojun Chen, Minghao Liu, Xiaojian Ma, Zailin Ma, Huimin Wu, Chengdong Ma, Yuanpei Chen, Yifan Zhong, Mingzhi Wang, Qing Li, Yaodong Yang#
ICML 2025
ACM MM
Learning Uniformly Distributed Embedding Clusters of Stylistic Skills for Physically Simulated Characters *
Nian Liu, Zilong Zhang, Zi Wang, Tengyu Liu, Hongzhao Xie, Xinyi Tong, Libin Liu, Yaodong Yang#, Zhaofeng He
ACM MM 2025
ACL
Language Models Resist Alignment: Evidence From Data Compression *
Jiaming Ji, Kaile Wang, Tianyi Qiu, Boyuan Chen, Jiayi Zhou, Changye Li, Hantao Lou, Josef Dai, Yunhuai Liu, Yaodong Yang#
ACL 2025 ★ Best Paper
NeurIPS
Safe VLA: Towards Safety Alignment of Vision-Language-Action Model via Safe Reinforcement Learning *
Borong Zhang, Yuhao Zhang, Jiaming Ji, Yingshan Lei, Josef Dai, Yuanpei Chen, Yaodong Yang#
NeurIPS 2025 Spotlight
TNNLS
Distributed Policy Space Response Oracles in Two-Player Zero-Sum Games
Hongsong Tang, Yingzhuo Liu, Letian Ni, Liuyu Xiang, Yaodong Yang, Ke Bi, Zhaofeng He
IEEE Transactions on Neural Networks and Learning Systems (TNNLS)
NeurIPS
Empirical Study on Robustness and Resilience in Cooperative Multi-Agent Reinforcement Learning *
Simin Li, Zihao Mao, Hanxiao Li, Zonglei Jing, Zhuohang Bian, Jun Guo, Li Wang, Zhuoran Han, Ruixiao Xu, Xin Yu, Chengdong Ma, Yuqing Ma, Bo An, Yaodong Yang#, Weifeng Lv, Xianglong Liu Hide Authors
NeurIPS 2025
AAMAS
Mean Field Correlated Imitation Learning *
Zhiyu Chen, Muning Wen, Yali Du, Ying Wen, Yaodong Yang#
AAMAS 2025
AAAI
Towards efficient collaboration via graph modeling in reinforcement learning *
Wenzhe Fan, Zishun Yu, Chengdong Ma, Changye Li, Yaodong Yang#, Xinhua Zhang
AAAI 2025
arXiv
A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment
Kun Wang, Guibin Zhang, Zhenhong Zhou, Jiahao Wu, Miao Yu, Shiqian Zhao, Chenlong Yin, Jinhu Fu, Yibo Yan, Hanjun Luo, Liang Lin, Zhihao Xu, Haolang Lu, Xinye Cao, Xinyun Zhou, Weifei Jin, Fanci Meng, Junyuan Mao, Yu Wang, Hao Wu, Minghe Wang, Fan Zhang, Junfeng Fang, Wenjie Qu, Yue Liu, Chengwei Liu, Yifan Zhang, Qiankun Li, Chongye Guo, Yalan Qin, Zhaoxin Fan, Kai Wang, Yi Ding, Donghai Hong, Jiaming Ji, Yingxin Lai, Zitong Yu, Xinfeng Li, Yifan Jiang, Yanhui Li, Xinyu Deng, Junlin Wu, Dongxia Wang, Yihao Huang, Yufei Guo, Jen-Tse Huang, Qiufeng Wang, Xiaolong Jin, Wenxuan Wang, Dongrui Liu, Yanwei Yue, Wenke Huang, Guancheng Wan, Heng Chang, Tianlin Li, Yi Yu, Chenghao Li, Jiawei Li, Lei Bai, Jie Zhang, Qing Guo, Jingyi Wang, Tianlong Chen, Joey Tianyi Zhou, Xiaojun Jia, Weisong Sun, Cong Wu, Jing Chen, Xuming Hu, Yiming Li, Xiao Wang, Ningyu Zhang, Luu Anh Tuan, Guowen Xu, Tianwei Zhang, Xingjun Ma, Xiang Wang, Bo An, Jun Sun, Mohit Bansal, Shirui Pan, Yuval Elovici, Bhavya Kailkhura, Bo Li, Yaodong Yang, Hongwei Li, Wenyuan Xu, Yizhou Sun, Wei Wang, Qing Li, Ke Tang, Yu-Gang Jiang, Felix Juefei-Xu, Hui Xiong, Xiaofeng Wang, Shuicheng Yan, Dacheng Tao, Philip S. Yu, Qingsong Wen, Yang Liu
arXiv 2025
arXiv
A Survey on Vision-Language-Action Models: An Action Tokenization Perspective *
Yifan Zhong, Fengshuo Bai, Shaofei Cai, Xuchuan Huang, Zhang Chen, Xiaowei Zhang, Yuanfei Wang, Shaoyang Guo, Tianrui Guan, Ka Nam Lui, Zhiquan Qi, Yitao Liang, Yuanpei Chen, Yaodong Yang#
arXiv 2025
arXiv
Approximating N-Player Nash Equilibrium through Gradient Descent
Dongge Wang, Xiang Yan, Zehao Dou, Wenhan Huang, Yaodong Yang, Xiaotie Deng
arXiv 2025
arXiv
Constrained Language Model Policy Optimization via Risk-aware Stepwise Alignment
Lijun Zhang, Lin Li, Wei Wei, Yajie Qi, Huizhong Song, Jun Wang, Yaodong Yang, Jiye Liang
arXiv 2025
arXiv
Finding Kissing Numbers with Game-theoretic Reinforcement Learning *
Chengdong Ma, Théo Tao Zhaowei, Pengyu Li, Minghao Liu, Haojun Chen, Zihao Mao, Bo Li, Yuan Cheng, Yuan Qi, Yaodong Yang#
arXiv 2025
arXiv
Goal Discovery with Causal Capacity for Efficient Reinforcement Learning
Yan Yu, Yaodong Yang, Zhengbo Lu, Chengdong Ma, Wengang Zhou, Houqiang Li
arXiv 2025
OpenReview
Iterative Training of Language Models with Opponent Modeling for Red Teaming Data Generation *
Yiming Rong, Hang Deng, Xuehai Pan, Yang Han, Fengshuo Bai, Yaodong Yang#
OpenReview 2025
arXiv
LLMs Know More Than Words: A Genre Study with Syntax, Metaphor & Phonetics *
Weiye Shi, Zhaowei Zhang, Shaoheng Yan, Yaodong Yang#
arXiv 2025
arXiv
Mitigating Deceptive Alignment via Self-Monitoring *
Jiaming Ji, Wenqi Chen, Kaile Wang, Donghai Hong, Sitong Fang, Boyuan Chen, Jiayi Zhou, Juntao Dai, Sirui Han, Yike Guo, Yaodong Yang#
arXiv 2025
OpenReview
Mixed Hierarchical Oracle and Multi-Agent Benchmark in Two-player Zero-sum Games
Hongsong Tang, Bo Chen, Yingzhuo Liu, Yaodong Yang, Junge Zhang, Liuyu Xiang, Jianchun Xu, Zhaofeng He
OpenReview 2025
arXiv
Model Evolution Framework with Genetic Algorithm for Multi-Task Reinforcement Learning
Yan Yu, Wengang Zhou, Yaodong Yang, Wanxuan Lu, Yingyan Hou, Houqiang Li
arXiv 2025
arXiv
Never Compromise to Vulnerabilities: A Comprehensive Survey on AI Governance
Yuchu Jiang, Jian Zhao, Yuchen Yuan, Tianle Zhang, Yao Huang, Yanghao Zhang, Yan Wang, Yanshu Li, Xizhong Guo, Yusheng Zhao, Jun Zhang, Zhi Zhang, Xiaojian Lin, Yixiu Zou, Haoxuan Ma, Yuhu Shang, Yuzhi Hu, Keshu Cai, Ruochen Zhang, Boyuan Chen, Yilan Gao, Ziheng Jiao, Yi Qin, Shuangjun Du, Xiao Tong, Zhekun Liu, Yu Chen, Xuankun Rong, Rui Wang, Yejie Zheng, Zhaoxin Fan, Murat Sensoy, Hongyuan Zhang, Pan Zhou, Lei Jin, Hao Zhao, Xu Yang, Jiaojiao Zhao, Jianshu Li, Joey Tianyi Zhou, Zhi-Qi Cheng, Longtao Huang, Zhiyi Liu, Zheng Zhu, Jianan Li, Gang Wang, Qi Li, Xu-Yao Zhang, Yaodong Yang, Mang Ye, Wenqi Ren, Zhaofeng He, Hang Su, Rongrong Ni, Liping Jing, Xingxing Wei, Junliang Xing, Massimo Alioto, Shengmei Shen, Petia Radeva, Dacheng Tao, Ya-Qin Zhang, Shuicheng Yan, Chi Zhang, Zhongjiang He, Xuelong Li
arXiv 2025
arXiv
On the Generalization Properties of Learning the Random Feature Models with Learnable Activation Functions *
Zailin Ma, Jiansheng Yang, Yaodong Yang#
arXiv 2025
arXiv
Prismatic World Model: Learning Compositional Dynamics for Planning in Hybrid Systems *
Mingwei Li, Xiaoyuan Zhang, Chengwei Yang, Zilong Zheng, Yaodong Yang#
arXiv 2025
arXiv
RedStar: Does Scaling Long-CoT Data Unlock Better Slow-Reasoning Systems?
Haotian Xu, Xing Wu, Weinong Wang, Zhongzhi Li, Da Zheng, Boyuan Chen, Yi Hu, Shijia Kang, Jiaming Ji, Yingying Zhang, Zhijiang Guo, Yaodong Yang, Muhan Zhang, Debing Zhang
arXiv 2025
arXiv
Robocoin: An open-sourced bimanual robotic data collection for integrated manipulation
Shihan Wu, Xuecheng Liu, Shaoxuan Xie, Pengwei Wang, Xinghang Li, Bowen Yang, Zhe Li, Kai Zhu, Hongyu Wu, Yiheng Liu, Zhaoye Long, Runtian Xu, Yue Wang, Chong Liu, Dihan Wang, Ziqiang Ni, Xiang Yang, You Liu, Ruoxuan Feng, Lei Zhang, Denghang Huang, Chenghao Jin, Anlan Yin, Xinlong Wang, Zhenguo Sun, Junkai Zhao, Mengfei Du, Mingyu Cao, Xiansheng Chen, Hongyang Cheng, Xiaojie Zhang, Yankai Fu, Ning Chen, Cheng Chi, Sixiang Chen, Huaihai Lyu, Xiaoshuai Hao, Yequan Wang, Bo Lei, Dong Liu, Xi Yang, Yance Jiao, Tengfei Pan, Yunyan Zhang, Songjing Wang, Ziqian Zhang, Xu Liu, Ji Zhang, Caowei Meng, Zhizheng Zhang, Jiyang Gao, Song Wang, Xiaokun Leng, Zhiqiang Xie, Zhenzhen Zhou, Peng Huang, Wu Yang, Yandong Guo, Yichao Zhu, Suibing Zheng, Hao Cheng, Xinmin Ding, Yang Yue, Huanqian Wang, Chi Chen, Jingrui Pang, YuXi Qian, Haoran Geng, Lianli Gao, Haiyuan Li, Bin Fang, Gao Huang, Yaodong Yang, Hao Dong, He Wang, Hang Zhao, Yadong Mu, Di Hu, Hao Zhao, Tiejun Huang, Shanghang Zhang, Yonghua Lin, Zhongyuan Wang, Guocai Yao
arXiv 2025
arXiv
Thinkpatterns-21k: A systematic study on the impact of thinking patterns in llms
Pengcheng Wen, Jiaming Ji, Chi-Min Chan, Juntao Dai, Donghai Hong, Yaodong Yang, Sirui Han, Yike Guo
arXiv 2025
2024 55 篇
NEUCOM
Can large language models independently complete tasks? a dynamic evaluation framework for multi-turn task planning and completion
Jun Gao, Junlin Cui, Huijia Wu, Liuyu Xiang, Han Zhao, Xiangang Li, Meng Fang, Yaodong Yang, Zhaofeng He
Neurocomputing
ICLR
CivRealm: A Learning and Reasoning Odyssey for Decision-Making Agents
Siyuan Qi, Shuo Chen, Yexin Li, Xiangyu Kong, Junqi Wang, Bangcheng Yang, Pring Wong, Yaodong Yang, et al.
ICLR 2024 Spotlight
ICML
Efficient Adaptation in Mixed-Motive Environments via Hierarchical Opponent Modeling and Planning
Yizhe Huang, Anji Liu, Fanqi Kong, Yaodong Yang, Song-Chun Zhu, Xue Feng
ICML 2024
TPAMI
JARVIS-1: Open-World Multi-task Agents with Memory-Augmented Multimodal Language Models
Zihao Wang, Shaofei Cai, Anji Liu, Yonggang Jin, Jinbing Hou, Bowei Zhang, Haowei Lin, Zhaofeng He, Zilong Zheng, Yaodong Yang, Xiaojian Ma, Yitao Liang
IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)
ASOC
MT-dyna: A Framework for Evaluating Multi-Turn Capabilities of LLMs
Jun Gao, Junlin Cui, Anwen Yang, Yiqi Tong, Huijia Wu, Xiangzheng Zhang, Yaodong Yang, Zhaofeng He
Applied Soft Computing
AAAI
ProAgent: Building Proactive Cooperative AI with Large Language Models *
Ceyao Zhang, Kaijie Yang, Siyi Hu, Zihao Wang, Guanghe Li, Yihang Sun, Cheng Zhang, Zhaowei Zhang, Anji Liu, Song-Chun Zhu, Xiaojun Chang, Junge Zhang, Feng Yin, Yitao Liang, Yaodong Yang#
AAAI 2024 Oral
IJMS
Large Language Models in Medicine: Applications, Challenges, and Future Directions
Erlan Yu, Xuehong Chu, Wanwan Zhang, Xiangbin Meng, Yaodong Yang, Xunming Ji, Chuanjie Wu
International Journal of Medical Sciences
JMIR
Revolutionizing Healthcare: The Transformative Impact of LLMs in Medicine *
Yi-Da Tang, Kuo Zhang, Xiangyu Yan, Xiangbin Meng, Jiaming Ji, Hua Xu, Jingqian Liu, Jingjia Wang, Xuliang Wang, Jun Gao, Da Liu, Yuan-Geng-Shuo Wang, Chunli Shao, Wenyao Wang, Yaodong Yang#
Journal of Medical Internet Research (JMIR)
iScience
The application of large language models in medicine: A scoping review
Xiangbin Meng, Xiangyu Yan, Kuo Zhang, Da Liu, Xiaojuan Cui, Yaodong Yang, Muhan Zhang, Chunxia Cao, Jingjia Wang, Xuliang Wang, Jun Gao, Yuan-Geng-Shuo Wang, Jiaming Ji, Zifeng Qiu, Muzi Li, Cheng Qian, Tianze Guo, Shuangquan Ma, Zeying Wang, Zexuan Guo, Youlan Lei, Chunli Shao, Wenyao Wang, Haojun Fan, Yi-Da Tang
iScience (Cell Press)
CSUR
AI Alignment: A Contemporary Survey *
Yaodong Yang#, Jiaming Ji, Tianyi Qiu, Boyuan Chen, Jiayi Zhou, Borong Zhang, Donghai Hong, Hantao Lou, Kaile Wang, Yawen Duan, Zhonghao He, Lukas Vierling, Zhaowei Zhang, Fanzhi Zeng, Juntao Dai, Xuehai Pan, Hua Xu, Aidan O’Gara, Kwan Yee Ng, Brian Tse, Jie Fu, Stephen McAleer, Yizhou Wang, Song-Chun Zhu, Yike Guo, Wen Gao
ACM Computing Surveys
Innov.
Med-Aligner Empowers LLM Medical Applications for complex medical scenarios *
Xiangbin Meng, Jiaming Ji, Xiangyu Yan, Jing Dai, Bishan Chen, Guan Wang, Hua Xu, Jingjia Wang, X G Wang, Da Liu, Ming-Qi Zheng, Ruidong Wu, Chujun Wu, Ying Wu, W Wang, Zhen Song, Yaodong Yang#
The Innovation
NeurIPS
Panacea: Pareto Alignment via Preference Adaptation for LLMs *
Yifan Zhong, Chengdong Ma, Xiaoyuan Zhang, Ziran Yang, Haojun Chen, Qingfu Zhang, Siyuan Qi, Yaodong Yang#
NeurIPS 2024
NeurIPS
ProgressGym: Alignment with a Millennium of Moral Progress *
Tianyi Qiu, Yang Zhang, Xuchuan Huang, Jasmine Xinze Li, Jiaming Ji, Yaodong Yang#
NeurIPS 2024 Spotlight
ICLR
Safe RLHF: Safe Reinforcement Learning from Human Feedback *
Josef Dai, Xuehai Pan, Ruiyang Sun, Jiaming Ji, Xinbo Xu, Mickel Liu, Yizhou Wang, Yaodong Yang#
ICLR 2024 Spotlight
ICML
Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation
Juntao Dai, Yaodong Yang, Qian Zheng, Gang Pan
ICML 2024
ICLR
SafeDreamer: Safe Reinforcement Learning with World Models *
Weidong Huang, Jiaming Ji, Chunhe Xia, Borong Zhang, Yaodong Yang#
ICLR 2024
NeurIPS
SafeSora: Towards Safety Alignment of Text2Video Generation via a Human Preference Dataset *
Juntao Dai, Tianle Chen, Xuyao Wang, Ziran Yang, Taiye Chen, Jiaming Ji, Yaodong Yang#
NeurIPS 2024
NeurIPS
Scalable Constrained Policy Optimization for Safe Multi-agent Reinforcement Learning
Lijun Zhang, Lin Li, Wei Wei, Huizhong Song, Yaodong Yang, Jiye Liang
NeurIPS 2024
CCL
对齐的理论, 技术与评估 (Theories, Techniques, and Evaluation of AI Alignment) *
Jiaming Ji, Tianyi Qiu, Boyuan Chen, Yaodong Yang#
CCL 2024
NN
Adaptive pessimism via target Q-value for offline reinforcement learning *
Jie Liu, Yinmin Zhang, Chuming Li, Yaodong Yang#, Yu Liu, Wanli Ouyang
Neural Networks
CVPR
AnySkill: Learning Open-Vocabulary Physical Skill for Interactive Agents
Jieming Cui, Tengyu Liu, Nian Liu, Yaodong Yang, Yixin Zhu, Siyuan Huang
CVPR 2024
T-ASE
ECO: Energy-Constrained Optimization with Reinforcement Learning for Humanoid Walking
Weidong Huang, Jingwen Zhang, Jiongye Li, Shibowen Zhang, Jiayang Wu, Jiayi Wang, Hangxin Liu, Yaodong Yang, Yao Su
IEEE Transactions on Automation Science and Engineering
RA-L
Grasp multiple objects with one hand
Yuyang Li, Bo Liu, Yiran Geng, Puhao Li, Yaodong Yang, Yixin Zhu, Tengyu Liu, Siyuan Huang
IEEE Robotics and Automation Letters (RA-L)
CoRL
Neural Attention Field: Emerging Point Relevance in 3D Scenes for One-Shot Dexterous Grasping
Qianxu Wang, Congyue Deng, Tyler Ga Wei Lum, Yuanpei Chen, Yaodong Yang, Jeannette Bohg, Yixin Zhu, Leonidas Guibas
CoRL 2024
CoRL
Object-Centric Dexterous Manipulation from Human Motion Data
Yuanpei Chen, Chen Wang, Yaodong Yang, C. Karen Liu
CoRL 2024
ICLR
Reason to Behave: Achieving Human-Like Task Execution for Physics-Based Characters
Nian Liu, Yaodong Yang, Zilong Zhang, Zi Wang, Jiayi Zhou, Libin Liu, Song-Chun Zhu, Zhibo Yang, Zhaofeng He
ICLR 2024
TPAMI
ASP: Learn a Universal Neural Solver *
Chenguang Wang, Zhouliang Yu, Stephen McAleer, Tianshu Yu, Yaodong Yang#
IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)
NeurIPS
Aligner: Efficient Alignment by Learning to Correct *
Jiaming Ji, Boyuan Chen, Hantao Lou, Donghai Hong, Borong Zhang, Xuehai Pan, Juntao Dai, Yaodong Yang#
NeurIPS 2024 Oral
TPAMI
Bi-DexHands: Towards Human-Level Bimanual Dexterous Manipulation *
Yuanpei Chen, Yiran Geng, Fangwei Zhong, Jiaming Ji, Jiechuang Jiang, Zongqing Lu, Hao Dong, Yaodong Yang#
IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)
媒体报道 中国青年报
NMI
Efficient and scalable reinforcement learning for large-scale network control *
Chengdong Ma, Aming Li, Yali Du, Hao Dong, Yaodong Yang#
Nature Machine Intelligence ★ UKRI Best Paper in AI & Robotics
JMLR
Heterogeneous-Agent Reinforcement Learning *
Yifan Zhong, Jakub Grudzien Kuba, Xidong Feng, Siyi Hu, Jiaming Ji, Yaodong Yang#
Journal of Machine Learning Research (JMLR)
JMLR
Omnisafe: An infrastructure for accelerating safe reinforcement learning research *
Jiaming Ji, Jiayi Zhou, Borong Zhang, Juntao Dai, Xuehai Pan, Ruiyang Sun, Weidong Huang, Yiran Geng, Mickel Liu, Yaodong Yang#
Journal of Machine Learning Research (JMLR)
Matter
Transforming the synthesis of carbon nanotubes with machine learning models and automation *
Yue Li, Shurui Wang, Zhou Lv, Zhaoji Wang, Yunbiao Zhao, Ying Xie, Yang Xu, Liu Qian, Yaodong Yang#, Ziqiang Zhao#, Jin Zhang#
Matter (Cell Press)
媒体报道 新华社
AAAI
A Perspective of Q-value Estimation on Offline-to-Online Reinforcement Learning *
Yinmin Zhang, Jie Liu, Chuming Li, Yazhe Niu, Yaodong Yang#, Yu Liu, Wanli Ouyang
AAAI 2024
ICLR
Byzantine Robust Cooperative Multi-Agent Reinforcement Learning as a Bayesian Game *
Simin Li, Jun Guo, Jingqiao Xiu, Ruixiao Xu, Xin Yu, Jiakai Wang, Aishan Liu, Yaodong Yang#, Xianglong Liu
ICLR 2024
FCS
Computing Ex Ante Equilibrium in Heterogeneous Zero-Sum Team Game
Naming Liu, Mingzhi Wang, Xihuai Wang, Weinan Zhang, Yaodong Yang, Youzhi Zhang, Bo An, Ying Wen
Frontiers of Computer Science (FCS)
ICASSP
Deep Reinforcement Learning with Task-Adaptive Retrieval via Hypernetwork
Yonggang Jin, Chenxu Wang, Tianyu Zheng, Liuyu Xiang, Yaodong Yang, Junge Zhang, Jie Fu, Zhaofeng He
ICASSP 2024
ICML
End-to-End Neuro-Symbolic Reinforcement Learning with Textual Explanations
Lirui Luo, Guoxi Zhang, Hongming Xu, Yaodong Yang, Cong Fang, Qing Li
ICML 2024
NeurIPS
FPGA-Gym: An FPGA-Accelerated Reinforcement Learning Environment Simulation Framework
Jiayi Li, Hongxiao Zhao, Wenshuo Yue, Yihan Fu, Daijing Shi, Anjunyi Fan, Qinghao Wang, Yaodong Yang, Bonan Yan
NeurIPS 2024 Workshop
TMLR
MaskMA: Towards Zero-Shot Multi-Agent Decision Making with Mask-Based Collaborative Learning *
Jie Liu, Yinmin Zhang, Chuming Li, Chao Yang, Yaodong Yang#, Yu Liu, Wanli Ouyang
Transactions on Machine Learning Research (TMLR)
ICLR
Maximum Entropy Heterogeneous-Agent Reinforcement Learning *
Jiarong Liu, Yifan Zhong, Siyi Hu, Haobo Fu, Qiang Fu, Xiaojun Chang, Yaodong Yang#
ICLR 2024 Spotlight
POM
Multi-Agent Deep Reinforcement Learning for Multi-Echelon Inventory Management
Xiaotian Liu, Ming Hu, Yijie Peng, Yaodong Yang
Production and Operations Management
IJCAI
Off-Agent Trust Region Policy Optimization *
Ruiqing Chen, Xiaoyuan Zhang, Yali Du, Yifan Zhong, Zheng Tian, Fanglei Sun, Yaodong Yang#
IJCAI 2024
ICLR
Open-Ended Learning in General-Sum Games: The Role of Diversity in Correlated Equilibrium *
Zeyuan Zhao, Muning Wen, Ying Wen, Yaodong Yang#
ICLR 2024
IJCNN
Remember the Past for Better Future: Memory-Augmented Offline RL *
Yue Zhang, Yaodong Yang#, Zhenbo Lu, Wengang Zhou, Houqiang Li
IJCNN 2024
T-ITS
Resilient Multi-agent Reinforcement Learning for Tiered Mixed Autonomy
Xin Gao, Xiaoqiang Meng, Chengdong Ma, Zhaoyang Ma, Yaodong Yang, Xueyuan Li, Lihua Xie
IEEE Transactions on Intelligent Transportation Systems
NN
RoMAT: Role-based multi-agent transformerfor generalizable heterogeneous cooperation *
Dongzi Wang, Fangwei Zhong, Minglong Li, Muning Wen, Yuanxi Peng, Teng Li, Yaodong Yang#
Neural Networks
AAAI
STAS: Spatial-Temporal Return Decomposition for Solving Sparse Rewards Problems in Multi-agent Reinforcement Learning *
Sirui Chen, Zhaowei Zhang, Yaodong Yang#, Yali Du
AAAI 2024
NN
TIMAR: Transition-informed representation for sample-efficient multi-agent reinforcement learning *
Mingxiao Feng, Yaodong Yang#, Wengang Zhou, Houqiang Li
Neural Networks
arXiv
A Survey on Self-play Methods in Reinforcement Learning
Ruize Zhang, Zelai Xu, Chengdong Ma, Chao Yu, Wei-Wei Tu, Wenhao Tang, Shiyu Huang, Deheng Ye, Wenbo Ding, Yaodong Yang, Yu Wang
arXiv 2024
arXiv
Align Anything: Training All-Modality Models to Follow Instructions with Language Feedback *
Jiaming Ji, Jiayi Zhou, Hantao Lou, Boyuan Chen, Donghai Hong, Xuyao Wang, Wenqi Chen, Kaile Wang, Rui Pan, Jiahao Li, Mohan Wang, Josef Dai, Tianyi Qiu, Hua Xu, Dong Li, Weipeng Chen, Jun Song, Bo Zheng, Yaodong Yang#
arXiv 2024
arXiv
Efficient Model-agnostic Alignment via Bayesian Persuasion *
Fengshuo Bai, Mingzhi Wang, Zhaowei Zhang, Boyuan Chen, Yinda Xu, Ying Wen, Yaodong Yang#
arXiv 2024
arXiv
Leveraging Team Correlation for Approximating Equilibrium in Two-Team Zero-Sum Games
Naming Liu, Mingzhi Wang, Youzhi Zhang, Yaodong Yang, Bo An, Ying Wen
arXiv 2024
medRxiv
Real-World Performance of Large Language Models in Emergency Department Chest Pain Triage
Xiangbin Meng, Jiaming Ji, Xiangyu Yan, Hua Xu, Jun Gao, Junhong Wang, Jingjia Wang, Xuliang Wang, Yuan-Geng-Shuo Wang, Wenyao Wang, Jing Chen, Kuo Zhang, Da Liu, Zifeng Qiu, Muzi Li, Chunli Shao, Yaodong Yang, Yi-Da Tang
medRxiv 2024
arXiv
UniDexFPM: Universal Dexterous Functional Pre-grasp Manipulation via Diffusion Policy
Tianhao Wu, Yunchong Gan, Mingdong Wu, Jingbo Cheng, Yaodong Yang, Yixin Zhu, Hao Dong
arXiv 2024
2023 46 篇
JSSSE
Editorial Special Issue on Simulation and AI *
Yijie Peng, Yaodong Yang#
Journal of Systems Science and Systems Engineering (JSSSE)
NeurIPS
MultiReAct: Multimodal Tools Augmented Reasoning-Acting Traces for Embodied Agent Planning *
Zhouliang Yu, Jie Fu, Yao Mu, Chenguang Wang, Lin Shao, Yaodong Yang#
NeurIPS 2023 Workshop
CJE
A Deep Reinforcement Learning-driven Vine Copula Method for Correlation Structure Analysis of Mortgage *
Qinghao Wang, Yanling Peng, Yijie Peng, Yaodong Yang#
计量经济学报
JAAMAS
Carbon trading supply chain management based on constrained deep reinforcement learning *
Qinghao Wang, Yaodong Yang#
Journal of Autonomous Agents and Multi-Agent Systems (JAAMAS)
MATH
Discrete information acquisition in financial markets
Jingrui Pan, Shancun Liu, Qiang Zhang, Yaodong Yang
Mathematics (MDPI)
TMC
Self-Supervised MAFENN for Classifying Low-labeled Distorted Images over Mobile Fading Channels
Yang Li, Fanglei Sun, Jingchen Hu, Chang Liu, Fan Wu, Kai Li, Ying Wen, Yaodong Yang, et al.
IEEE Transactions on Mobile Computing
NeurIPS
BeaverTails: Towards Improved Safety Alignment of LLM via a Human-Preference Dataset *
Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, Yaodong Yang#
NeurIPS 2023
MLJ
ReDMan: Reliable Dexterous Manipulation with Safe Reinforcement Learning *
Yiran Geng, Jiaming Ji, Yuanpei Chen, Haoran Geng, Fangwei Zhong, Yaodong Yang#
Machine Learning Journal
NeurIPS
Safety Gymnasium: A Unified Safe Reinforcement Learning Benchmark *
Jiaming Ji, Borong Zhang, Jiayi Zhou, Xuehai Pan, Weidong Huang, Ruiyang Sun, Yiran Geng, Yifan Zhong, Juntao Dai, Yaodong Yang#
NeurIPS 2023
OpenReview
A Massively Parallel Benchmark for Safe Dexterous Manipulation *
Yiran Geng, Jiaming Ji, Yuanpei Chen, Long Yang, Yaodong Yang#
OpenReview 2023
CoRL
Dynamic Handover: Throw and Catch with Bimanual Hands
Binghao Huang, Yuanpei Chen, Tianyu Wang, Yuzhe Qin, Yaodong Yang, Nikolay Atanasov, Xiaolong Wang
CoRL 2023
ICRA
End-to-End Affordance Learning for Robotic Manipulation *
Yiran Geng, Boshi An, Haoran Geng, Yuanpei Chen, Yaodong Yang#, Hao Dong
ICRA 2023
ICRA
GenDexGrasp: Generalizable Dexterous Grasping
Puhao Li, Tengyu Liu, Yuyang Li, Yiran Geng, Yixin Zhu, Yaodong Yang, Siyuan Huang
ICRA 2023
JMLR
MARLlib: A Scalable and Efficient Multi-agent Reinforcement Learning Library *
Siyi Hu, Yifan Zhong, Minquan Gao, Weixun Wang, Hao Dong, Xiaodan Liang, Zhihui Li, Xiaojun Chang, Yaodong Yang#
Journal of Machine Learning Research (JMLR)
NSR
On the complexity of computing markov perfect equilibrium in general-sum stochastic games *
Xiaotie Deng, Ningyuan Li, David Henry Mguni, Jun Wang, Yaodong Yang#
National Science Review
AIJ
Safe multi-agent reinforcement learning for multi-robot control *
Shangding Gu, Jakub Grudzien Kuba, Yuanpei Chen, Yali Du, Long Yang, Alois Knoll, Yaodong Yang#
Artificial Intelligence Journal (AIJ)
JMLR
TorchOpt: An Efficient Library for Differentiable Optimization *
Jie Ren, Xidong Feng, Bo Liu, Xuehai Pan, Yao Fu, Luo Mai, Yaodong Yang#
Journal of Machine Learning Research (JMLR)
ICCV
UniDexGrasp++: Improving Dexterous Grasping Policy Learning via Geometry-aware Curriculum and Iterative Generalist-Specialist Learning
Weikang Wan, Haoran Geng, Yun Liu, Zikang Shan, Yaodong Yang, Li Yi, He Wang
ICCV 2023 ★ Best Paper Finalist
ICML
A Game-Theoretic Framework for Managing Risk in Multi-Agent Systems
Oliver Slumbers, David Henry Mguni, Stefano B. Blumberg, Stephen McAleer, Yaodong Yang, Jun Wang
ICML 2023
NN
Attacking Cooperative Multi-Agent Reinforcement Learning by Adversarial Minority Influence *
Simin Li, Jun Guo, Jingqiao Xiu, Yuwei Zheng, Pu Feng, Xin Yu, Jiakai Wang, Aishan Liu, Yaodong Yang#, Bo An, Wenjun Wu, Xianglong Liu
Neural Networks
AAAI
Cooperative Multi-agent Q-learning with Bidirectional Action-Dependency *
Chuming Li, Jie Liu, Yinmin Zhang, Yuhong Wei, Yazhe Niu, Yaodong Yang#, Yu Liu, Wanli Ouyang
AAAI 2023
USENIX
Distributed Reinforcement Learning with Dataflow Fragments
Huanzhou Zhu, Bo Zhao, Gang Chen, Weifeng Chen, Yijie Chen, Liang Shi, Yaodong Yang, Peter Pietzuch, Lei Chen
USENIX 2023
ICML
GEAR: A GPU-Centric Experience Replay System for Large Reinforcement Learning Models
Hanjing Wang, Man-Kit Sit, Congjie He, Ying Wen, Weinan Zhang, Jun Wang, Yaodong Yang, Luo Mai
ICML 2023
NeurIPS
Hierarchical Multi-Agent Skill Discovery *
Mingyu Yang, Yaodong Yang#, Zhenbo Lu, Wengang Zhou, Houqiang Li
NeurIPS 2023
AAMAS
Is Nash Equilibrium Approximator Learnable?
Zhijian Duan, Wenhan Huang, Dinghuai Zhang, Yali Du, Jun Wang, Yaodong Yang, Xiaotie Deng
AAMAS 2023
TMLR
JiangJun: Mastering Xiangqi by Tackling Non-Transitivity in Two-Player Zero-Sum Games *
Yang Li, Kun Xiong, Yingping Zhang, Jiangcheng Zhu, Stephen McAleer, Wei Pan, Jun Wang, Zonghong Dai, Yaodong Yang#
Transactions on Machine Learning Research (TMLR)
OpenReview
Joint-predictive representations for multi-agent reinforcement learning
Mingxiao Feng, Wengang Zhou, Yaodong Yang, Houqiang Li
OpenReview 2023
FCS
Large sequence models for sequential decision-making: a survey
Muning Wen, Runji Lin, Hanjing Wang, Yaodong Yang, Ying Wen, Luo Mai, Jun Wang, Haifeng Zhang, Weinan Zhang
Frontiers of Computer Science (FCS)
AAAI
Learning to Shape Rewards using a Game of Two Partners *
David Henry Mguni, Taher Jafferjee, Jianhong Wang, Nicolas Perez-Nieves, Wenbin Song, Feifei Tong, Matthew E. Taylor, Yaodong Yang#, et al.
AAAI 2023
JMLR
MALib: A Parallel Framework for Population-based Multi-agent Reinforcement Learning
Ming Zhou, Ziyu Wan, Hanjing Wang, Muning Wen, Runzhe Wu, Ying Wen, Yaodong Yang, Yong Yu, Jun Wang, Weinan Zhang
Journal of Machine Learning Research (JMLR)
ICML
MANSA: Learning Fast and Slow in Multi-Agent Systems *
David Henry Mguni, Haojun Chen, Taher Jafferjee, Jianhong Wang, Longfei Yue, Xidong Feng, Stephen McAleer, Feifei Tong, Jun Wang, Yaodong Yang#
ICML 2023
NeurIPS
Multi-Agent First Order Constrained Optimization in Policy Space *
Youpeng Zhao, Yaodong Yang#, Zhenbo Lu, Wengang Zhou, Houqiang Li
NeurIPS 2023
MIR
Offline Pre-trained Multi-Agent Decision Transformer
Linghui Meng, Muning Wen, Chenyang Le, Xiyun Li, Dengpeng Xing, Weinan Zhang, Ying Wen, Haifeng Zhang, Jun Wang, Yaodong Yang, et al.
Machine Intelligence Research (MIR)
JAAMAS
Online Markov Decision Processes with Non-oblivious Strategic Adversary *
Cong Le Dinh, David Henry Mguni, Long Tran-Thanh, Jun Wang, Yaodong Yang#
Journal of Autonomous Agents and Multi-Agent Systems (JAAMAS)
NeurIPS
Policy Space Diversity for Non-Transitive Games
Jian Yao, Weiming Liu, Haobo Fu, Yaodong Yang, Stephen McAleer, Qiang Fu, Wei Yang
NeurIPS 2023
ICLR
Quality-Similar Diversity via Population Based Reinforcement Learning
Shuang Wu, Jian Yao, Haobo Fu, Ye Tian, Chao Qian, Yaodong Yang, Qiang Fu, Yang Wei
ICLR 2023
ICML
Regret-Minimizing Double Oracle for Extensive-Form Games *
Xiaohang Tang, Stephen McAleer, Yaodong Yang#
ICML 2023
TNNLS
Robust Multi-Agent Reinforcement Learning by Mutual Information Regularization
Simin Li, Ruixiao Xu, Jingqiao Xiu, Yuwei Zheng, Pu Feng, Yuqing Ma, Bo An, Yaodong Yang, Xianglong Liu
IEEE Transactions on Neural Networks and Learning Systems (TNNLS)
AAAI
Subspace-Aware Exploration for Sparse-Reward Multi-Agent Tasks
Pei Xu, Junge Zhang, Qiyue Yin, Chao Yu, Yaodong Yang, Kaiqi Huang
AAAI 2023
NeurIPS
Team-PSRO for Learning Approximate TMECor in Large Team Games via Cooperative Reinforcement Learning
Stephen McAleer, Gabriele Farina, Gaoyue Zhou, Mingzhi Wang, Yaodong Yang, Tuomas Sandholm
NeurIPS 2023
ECAI
Theoretically Guaranteed Policy Improvement Distilled from Model-Based Planning
Chuming Li, Ruonan Jia, Jie Liu, Yinmin Zhang, Yazhe Niu, Yaodong Yang, Yu Liu, Wanli Ouyang
ECAI 2023
arXiv
A Human-Centered Safe Robot Reinforcement Learning Framework with Interactive Behaviors *
Shangding Gu, Alap Kshirsagar, Yali Du, Guang Chen, Jan Peters, Alois Knoll, Yaodong Yang#
arXiv 2023
arXiv
Baichuan 2: Open Large-scale Language Models
Aiyuan Yang, Bin Xiao, Bingning Wang, Borong Zhang, Ce Bian, Chao Yin, Chenxu Lv, Da Pan, Dian Wang, Dong Yan, Fan Yang, Fei Deng, Feng Wang, Feng Liu, Guangwei Ai, Guosheng Dong, Haizhou Zhao, Hang Xu, Haoze Sun, Hongda Zhang, Hui Liu, Jiaming Ji, Jian Xie, Juntao Dai, Kun Fang, Lei Su, Liang Song, Lifeng Liu, Liyun Ru, Luyao Ma, Mang Wang, Mickel Liu, MingAn Lin, Nuolan Nie, Peidong Guo, Ruiyang Sun, Tao Zhang, Tianpeng Li, Tianyu Li, Wei Cheng, Weipeng Chen, Xiangrong Zeng, Xiaochuan Wang, Xiaoxi Chen, Xin Men, Xin Yu, Xuehai Pan, Yanjun Shen, Yiding Wang, Yiyu Li, Youxin Jiang, Yuchen Gao, Yupeng Zhang, Zenan Zhou, Zhiying Wu, Yaodong Yang
arXiv 2023
OpenReview
Convergence Rate of Primal-Dual Approach to Constrained Reinforcement Learning
Long Yang, Li Shen, Pengfei Li, Yaodong Yang, Zhouchen Lin, Gang Pan
OpenReview 2023
arXiv
Mixup-Augmented Meta-Learning for Sample-Efficient Fine-Tuning of Protein Simulators
Jingbang Chen, Yian Wang, Xingwei Qu, Shuangjia Zheng, Yaodong Yang, Hao Dong, Jie Fu
arXiv 2023
arXiv
ValueDCG: Measuring Comprehensive Human Value Understanding Ability of Language Models *
Zhaowei Zhang, Fengshuo Bai, Jun Gao, Yaodong Yang#
arXiv 2023
2022 27 篇
JSSC
Illiquidity comovement and market crisis *
Qingduo Zeng, Qiang Zhang, Shancun Liu, Yaodong Yang#
Journal of Systems Science and Complexity
SSRN
Information Production, Information Acquisition and Price Informativeness *
Jingrui Pan, Shancun Liu, Qiang Zhang, Yaodong Yang#
SSRN 2022
JSSC
Solving inventory management problems through deep reinforcement learning *
Qinghao Wang, Yijie Peng, Yaodong Yang#
Journal of Systems Science and Complexity (JSSSC)
NeurIPS
Constrained Update Projection Approach to Safe Policy Optimization
Long Yang, Jiaming Ji, Juntao Dai, Linrui Zhang, Binbin Zhou, Pengfei Li, Yaodong Yang, Gang Pan
NeurIPS 2022
WISE
Debias the Black-Box: A Fair Ranking Framework via Knowledge Distillation
Zhitao Zhu, Shijing Si, Jianzong Wang, Yaodong Yang, Jing Xiao
WISE 2022
NeurIPS
Meta-Reward-Net: Implicitly Differentiable Reward Learning for Preference-based Reinforcement Learning *
Runze Liu, Fengshuo Bai, Yali Du, Yaodong Yang#
NeurIPS 2022
NeurIPS
MyoChallenge 2022: Learning contact-rich manipulation using a musculoskeletal hand
Vittorio Caggiano, Guillaume Durandau, Huwawei Wang, Alberto Chiappa, Alexander Mathis, Pablo Tano, Nisheet Patel, Yaodong Yang, et al.
NeurIPS 2022 Dataset
NeurIPS
Towards Human-Level Bimanual Dexterous Manipulation with Reinforcement Learning *
Yuanpei Chen, Tianhao Wu, Shengjie Wang, Xidong Feng, Jiechuan Jiang, Zongqing Lu, Stephen McAleer, Hao Dong, Song-Chun Zhu, Yaodong Yang#
NeurIPS 2022 Dataset
ICLR
A Game-Theoretic Approach for Improving Generalization Ability of TSP Solvers
Chenguang Wang, Yaodong Yang, Oliver Slumbers, Congying Han, Tiande Guo, Haifeng Zhang, Jun Wang
ICLR 2022 Workshop
DAI
A Game-Theoretic Approach to Multi-Agent Trust Region Optimization
Ying Wen, Hui Chen, Yaodong Yang, Minne Li, Zheng Tian, Xu Chen, Jun Wang
DAI 2022
arXiv
A Review of Safe Reinforcement Learning: Methods, Theory and Applications
Shangding Gu, Long Yang, Yali Du, Guang Chen, Florian Walter, Jun Wang, Yaodong Yang, Alois Knoll
arXiv 2022
NeurIPS
A Theoretical Understanding of Gradient Bias in Meta-Reinforcement Learning *
Bo Liu, Xidong Feng, Jie Ren, Luo Mai, Rui Zhu, Haifeng Zhang, Jun Wang, Yaodong Yang#
NeurIPS 2022
NeurIPS
A Unified Diversity Measure for Multiagent Reinforcement Learning
Zongkai Liu, Chao Yu, Yaodong Yang, Zifan Wu, Yuan Li
NeurIPS 2022
NeurIPS
Contextual Transformer for Offline Meta Reinforcement Learning *
Runji Lin, Ye Li, Xidong Feng, Zhaowei Zhang, Xian Hong Wu Fung, Haifeng Zhang, Jun Wang, Yali Du, Yaodong Yang#
NeurIPS 2022 Workshop
ICLR
LIGS: Learnable Intrinsic-Reward Generation Selection for Multi- Agent Learning
David Henry Mguni, Taher Jafferjee, Jianhong Wang, Oliver Slumbers, Nicolas Perez-Nieves, Feifei Tong, Li Yang, Jiangcheng Zhu, Yaodong Yang, Jun Wang
ICLR 2022
NeurIPS
MATE: Benchmarking Multi-Agent Reinforcement Learning in Distributed Target Coverage Control *
Xuehai Pan, Mickel Liu, Fangwei Zhong, Yaodong Yang#, Song-Chun Zhu, Yizhou Wang
NeurIPS 2022 Dataset
ALGO
Measuring the Non-Transitivity in Chess *
Ricky Sanjaya, Jun Wang, Yaodong Yang#
Algorithms (MDPI)
NeurIPS
Multi-Agent Reinforcement Learning is a Sequence Modeling Problem *
Muning Wen, Jakub Grudzien Kuba, Runji Lin, Weinan Zhang, Ying Wen, Jun Wang, Yaodong Yang#
NeurIPS 2022
IJCAI
On the Convergence of Fictitious Play: A Decomposition Approach
Yurong Chen, Xiaotie Deng, Chenchen Li, David Henry Mguni, Jun Wang, Xiang Yan, Yaodong Yang
IJCAI 2022
TMLR
Online double oracle *
Le Cong Dinh, Yaodong Yang#, Stephen McAleer, Zheng Tian, Nicolas Perez-Nieves, Oliver Slumbers, David Henry Mguni, Haitham Bou Ammar, Jun Wang
Transactions on Machine Learning Research (TMLR)
IROS
Scalable Model-based Policy Optimization for Decentralized Networked Systems *
Yali Du, Chengdong Ma, Yuchen Liu, Runji Lin, Hao Dong, Jun Wang, Yaodong Yang#
IROS 2022
ICLR
Trust Region Policy Optimisation in Multi-Agent Reinforcement Learning *
Jakub Grudzien Kuba, Ruiqing Chen, Muning Wen, Ying Wen, Fanglei Sun, Jun Wang, Yaodong Yang#
ICLR 2022
arXiv
Understanding Value Decomposition Algorithms in Deep Cooperative Multi-Agent Reinforcement Learning *
Zehao Dou, Jakub Grudzien Kuba, Yaodong Yang#
arXiv 2022
arXiv
Efficient Policy Space Response Oracles
Ming Zhou, Jingxiao Chen, Ying Wen, Weinan Zhang, Yaodong Yang, Yong Yu, Jun Wang
arXiv 2022
arXiv
Heterogeneous-Agent Mirror Learning: A Continuum of Solutions to Cooperative MARL *
Jakub Grudzien Kuba, Xidong Feng, Shiyao Ding, Hao Dong, Jun Wang, Yaodong Yang#
arXiv 2022
OpenReview
Learning to safely exploit a non-stationary opponent
Zheng Tian, Hang Ren, Yaodong Yang, Yuchen Sun, Ziqi Han, Ian Davies, Jun Wang
OpenReview 2022
arXiv
Settling the Communication Complexity for Distributed Offline Reinforcement Learning *
Juliusz Krysztof Ziomek, Jun Wang, Yaodong Yang#
arXiv 2022
2021 12 篇
AAMAS
Diverse Auto-Curriculum is Critical for Successful Real-World Multiagent Learning Systems *
Yaodong Yang#, Jun Luo, Ying Wen, Oliver Slumbers, Daniel Graves, Haitham Bou Ammar, Jun Wang, Matthew E. Taylor
AAMAS 2021 ★ Best Blue-Sky Paper
arXiv
DESTA: A Framework for Safe Reinforcement Learning with Markov Games of Intervention *
David Henry Mguni, Usman Islam, Yaqi Sun, Xiuling Zhang, Joel Jennings, Aivar Sootla, Changmin Yu, Ziyan Wang, Jun Wang, Yaodong Yang#
arXiv 2021
AAAI
Foresee then Evaluate: Decomposing Value Estimation with Latent Future Prediction
Hongyao Tang, Zhaopeng Meng, Guangyong Chen, Pengfei Chen, Chen Chen, Yaodong Yang, Luo Zhang, Wulong Liu, Jianye Hao
AAAI 2021
ICML
Learning in Nonzero-Sum Stochastic Games with Potentials
David Henry Mguni, Yutong Wu, Yali Du, Yaodong Yang, Ziyi Wang, Minne Li, Ying Wen, Joel Jennings, Jun Wang
ICML 2021
Thesis
Many-agent Reinforcement Learning
Yaodong Yang
PhD Thesis, UCL
ICML
Modelling Behavioural Diversity for Learning in Open-Ended Games
Nicolas Perez-Nieves, Yaodong Yang, Oliver Slumbers, David Henry Mguni, Ying Wen, Jun Wang
ICML 2021
NeurIPS
Neural Auto-Curricula *
Xidong Feng, Oliver Slumbers, Ziyu Wan, Bo Liu, Stephen McAleer, Ying Wen, Jun Wang, Yaodong Yang#
NeurIPS 2021
OpenReview
Robust multi-agent reinforcement learning driven by correlated equilibrium
Yizheng Hu, Kun Shao, Dong Li, Jianye Hao, Wulong Liu, Yaodong Yang, Jun Wang, Zhanxing Zhu
OpenReview 2021
NeurIPS
Settling the Variance of Multi-Agent Policy Gradients *
Jakub Grudzien Kuba, Muning Wen, Linghui Meng, Shangding Gu, Haifeng Zhang, David Henry Mguni, Jun Wang, Yaodong Yang#
NeurIPS 2021
NeurIPS
Unifying Behavioral and Response Diversity for Open-ended Learning in Zero-sum Games
Xiangyu Liu, Hangtian Jia, Ying Wen, Yujing Hu, Yingfeng Chen, Changjie Fan, Zhipeng Hu, Yaodong Yang
NeurIPS 2021
arXiv
Cooperative Multi-Agent Transfer Learning with Level-Adaptive Credit Assignment
Tianze Zhou, Fubiao Zhang, Kun Shao, Kai Li, Wenhan Huang, Jun Luo, Weixun Wang, Yaodong Yang, Hangyu Mao, Bin Wang, Dong Li, Wulong Liu, Jianye Hao
arXiv 2021
arXiv
Revisiting the Characteristics of Stochastic Gradient Noise and Dynamics *
Yixin Wu, Rui Luo, Chen Zhang, Jun Wang, Yaodong Yang#
arXiv 2021
2020 11 篇
AAMAS
Sequential Advertising Agent with Interpretable User Hidden Intents
Zhaoqing Peng, Junqi Jin, Lan Luo, Yaodong Yang, Rui Luo, Jun Wang, Weinan Zhang, Miao Xu, Chuan Yu, Tiejian Luo, Han Li, Jian Xu, Kun Gai
AAMAS 2020
EJOR
Can Deep Learning Predict Risky Retail Investors? A Case Study in Financial Risk Behavior Forecasting
A. Kim, Yaodong Yang, S. Lessmann, T. Ma, M.-C. Sung, J. E. V. Johnson
European Journal of Operational Research (EJOR)
CIKM
Learning to Infer User Hidden States for Online Sequential Advertising
Zhaoqing Peng, Junqi Jin, Lan Luo, Yaodong Yang, Rui Luo, Jun Wang, Weinan Zhang, Haiyang Xu, Miao Xu, Chuan Yu, Tiejian Luo, Han Li, Jian Xu, Kun Gai
CIKM 2020
JSSC
Order Execution Probability and Order Queue in Limit Order Markets *
Qiang Zhang, Chao Wang, Shancun Liu, Yaodong Yang#
Journal of Systems Science and Complexity (JSSC)
NeurIPS
Replica-exchange Nose-Hoover dynamics for Bayesian learning on large datasets
Rui Luo, Qiang Zhang, Yaodong Yang, Jun Wang
NeurIPS 2020
CoRL
SMARTS: An Open-Source Scalable Multi-Agent RL Training School for Autonomous Driving
Ming Zhou*, Jun Luo*, Julian Villella*, Yaodong Yang*, David Rusu, Jiayu Miao, Weinan Zhang, Montgomery Alban, Iman Fadakar, Zheng Chen, Aurora Chongxi Huang, Ying Wen, Kimia Hassanzadeh, Daniel Graves, Dong Chen, Zhengbang Zhu, Nhat Nguyen, Mohamed Elsayed, Kun Shao, Sanjeevan Ahilan, Baokuan Zhang, Jiannan Wu, Zhengang Fu, Kasra Rezaee, Peyman Yadmellat, Mohsen Rohani, Nicolas Perez-Nieves, Yihan Ni, Seyedershad Banijamali, Alexander Cowen Rivers, Zheng Tian, Daniel Palenicek, Haitham Bou Ammar, Hongbo Zhang, Wulong Liu, Jianye Hao, Jun Wang (* Equal Contribution)
CoRL 2020 ★ Best System Paper
AAAI
Bi-level Actor-Critic for Multi-agent Coordination
Haifeng Zhang, Weizhe Chen, Zeren Huang, Minne Li, Yaodong Yang, Weinan Zhang, Jun Wang
AAAI 2020
arXiv
Game-Theoretic Multiagent Reinforcement Learning
Yaodong Yang, Chengdong Ma, Zihan Ding, Stephen McAleer, Chi Jin, Jun Wang, Tuomas Sandholm
arXiv 2020
IJCAI
Modelling Bounded Rationality in Multi-Agent Interactions by Generalized Recursive Reasoning
Ying Wen, Yaodong Yang, Rui Luo, Jun Wang
IJCAI 2020
ICML
Multi-Agent Determinantal Q-Learning
Yaodong Yang, Ying Wen, Jun Wang, Liheng Chen, Kun Shao, David Henry Mguni, Weinan Zhang
ICML 2020
AAMAS
αα-Rank: Practically Scaling α-Rank through Stochastic Optimisation
Yaodong Yang, Rasul Tutunov, Phu Sakulwongtana, Haitham Bou Ammar
AAMAS 2020
2019 4 篇
ICASSP
Adversarial Variational Bayes Methods for Tweedie Compound Poisson Mixed Models
Yaodong Yang, Rui Luo, Yuanyuan Liu
ICASSP 2019
WWW
Efficient Ridesharing Order Dispatching with Mean Field Multi-Agent Reinforcement Learning
Minne Li, Zhiwei (Tony) Qin, Yan Jiao, Yaodong Yang, Zhichen Gong, Jun Wang, Chenxi Wang, Guobin Wu, Jieping Ye
WWW 2019
DAI
Factorized Q-learning for large-scale multi-agent systems
Ming Zhou, Yong Chen, Ying Wen, Yaodong Yang, Yufeng Su, Weinan Zhang, Dell Zhang, Jun Wang
DAI 2019
ICLR
Probabilistic Recursive Reasoning for Multi-Agent Reinforcement Learning
Yaodong Yang, Ying Wen, Jun Wang, Liheng Chen, Kun Shao, Xinbing Mi, Wei Pan
ICLR 2019
2018 5 篇
NeurIPS
Benchmarking Deep Sequential Models on Volatility Predictions for Financial Time Series
et al. · Yaodong Yang
NeurIPS 2018 Workshop
CJE
Information Acquisition: Fundamental and Non-Fundamental *
Qingduo Zeng, Shancun Liu, Qiang Zhang, Yaodong Yang#
China Journal of Econometrics
NeurIPS
Thermostat-assisted continuously-tempered Hamiltonian Monte Carlo for Bayesian learning
Rui Luo, Jianhong Wang, Yaodong Yang, Jun Wang, Zhanxing Zhu
NeurIPS 2018
ICML
Mean Field Multi-Agent Reinforcement Learning
Yaodong Yang, Rui Luo, Minne Li, Ming Zhou, Weinan Zhang, Jun Wang
ICML 2018 Long Oral
AAMAS
A Study of AI Population Dynamics with Million-agent Reinforcement Learning
Yaodong Yang, Lantao Yu, Yiwei Bai, Jun Wang, Weinan Zhang, Ying Wen, Yong Yu
AAMAS 2018
2017 2 篇
NeurIPS
Inferring tweedie compound poisson mixed models with adversarial variational methods
Yaodong Yang, Rui Luo, Reza Khorshidi, Yuanyuan Liu
NeurIPS 2017 Workshop
NeurIPS
Multiagent Bidirectionally-Coordinated Nets: Emergence of Human-level Coordination in Learning to Play StarCraft Combat Games
Peng Peng, Quan Yuan, Ying Wen, Yaodong Yang, Zhenkun Tang, Haitao Long, Jun Wang
NeurIPS 2017 Workshop
2013 1 篇
CIBCB
miRNA target prediction based on gene ontology
Ning Wang, Y. Wang, Yaodong Yang, Yi Shen, Ao Li
IEEE Symp. Computational Intelligence in Bioinformatics & Computational Biology