PAIR Lab: PKU Alignment and Interaction Research Lab
PAIR Lab: PKU Alignment and Interaction Research Lab
Open-Source Projects
People
News
Publications
Resources
Contact
2
DSR: Reinforcement Learning with Dynamical Skill Refinement
Skill-based reinforcement learning (Skill-based RL) is an efficient paradigm for solving sparse-reward tasks by extracting skills from …
Dongxiang Chen
,
Yaodong Yang
,
Ying Wen
PDF
Cite
Adaptive Pessimism via Target Q-Value for Offline Reinforcement Learning
Offline reinforcement learning (RL) methods learn from datasets without further environment interaction, facing errors due to …
Jie Liu
,
Yinmin Zhang
,
Chuming Li
,
Yaodong Yang
,
Yu Liu
,
Wanli Ouyang
Cite
Multi-Agent Deep Reinforcement Learning for Multi-Echelon Inventory Management
We apply heterogeneous-agent proximal policy optimization (HAPPO), a multi-agent deep reinforcement learning (MADRL) algorithm, to the …
Xiaotian Liu
,
Ming Hu
,
Yijie Peng
,
Yaodong Yang
PDF
Cite
Efficient and Scalable Reinforcement Learning for Large-Scale Network Control
The primary challenge in the development of large-scale artificial intelligence (AI) systems lies in achieving scalable …
Chengdong Ma
,
Aming Li
,
Yali Du
,
Hao Dong
,
Yaodong Yang
PDF
Cite
Omnisafe: An infrastructure for accelerating safe reinforcement learning research
AI systems empowered by reinforcement learning (RL) algorithms harbor the immense potential to catalyze societal advancement, yet their …
Jiaming Ji
,
Jiayi Zhou
,
Borong Zhang
,
Juntao Dai
,
Xuehai Pan
,
Ruiyang Sun
,
Weidong Huang
,
Yiran Geng
,
Mickel Liu
,
Yaodong Yang
PDF
Cite
Code
Carbon Trading Supply Chain Management Based On Constrained Deep Reinforcement Learning
The issue of carbon emissions is a critical global concern, and how to effectively reduce energy consumption and emissions is a …
Qinghao Wang
,
Yaodong Yang
Cite
对齐的理论, 技术与评估 (Theories, Techniques, and Evaluation of AI Alignment)
人工智能对齐(AI Alignment)旨在使人工智能系统的行为与人类的意图和价值观相一致。随着人工智能系统的能力日益增强,对齐失败带来的风险也在不断增加。数百位人工智能专家和公众人物已经表达了对人工智能风险的担忧,他们认为乜减轻人工智能带来的灭绝风险应该成为全球优先考 …
Jiaming Ji
,
Tianyi Qiu
,
Boyuan Chen
,
Yaodong Yang
PDF
Cite
RoMAT: Role-Based Multi-agent Transformer for Generalizable Heterogeneous Cooperation
Multi-task multi-agent systems (MASs) are challenging to model because they involve heterogeneous agents with different behavior …
Dongzi Wang
,
Fangwei Zhon
,
Minglong Li
,
Muning Wen
,
Yuanxi Peng
,
Teng Li
,
Yaodong Yang
Cite
The Application of Large Language Models in Medicine: A Scoping Review
This study systematically reviewed the application of large language models (LLMs) in medicine, analyzing 550 selected studies from a …
Xiangbin Meng
,
Xiangyu Yan
,
Kuo Zhang
,
Da Liu
,
Xiaojuan Cui
,
Yaodong Yang
,
Muhan Zhang
,
Chunxia Cao
,
Jingjia Wang
,
Xuliang Wang
,
Jun Gao
,
Jiaming Ji
,
Zifeng Qiu
,
Muzi Li
,
Cheng Qian
,
Tianze Guo
,
Shuangquan Ma
,
Zeying Wang
,
Zexuan Guo
,
Youlan Lei
,
Chunli Shao
,
Wenyao Wang
,
Haojun Fan
,
Yi-Da Tang
Cite
Revolutionizing Healthcare: The Transformative Impact of LLMs in Medicine
Large language models (LLMs) are rapidly advancing medical AI, offering revolutionary changes in healthcare. These models excel in …
Yi-Da Tang
,
Jmir Preprints
,
Kuo Zhang
,
Xiangyu Yan
,
Dph
,
Xiangbin Meng
,
Jiaming Ji
,
Hua Xu
,
Jingqian Liu
,
Jingjia Wang
,
Xuliang Wang
,
Jun Gao
,
Da Liu
,
Yuan-Geng-Shuo Wang
,
Chunli Shao
,
Wenyao Wang
,
Yaodong Yang
Cite
«
»
Cite
×