ML SystemsAug 29, 2026
To be done
...
3 min readRead
Building safer, more capable AI.
Research in reinforcement learning, and ai safety alignment.
AI Research Intern at BAAI and Peking University AI Lab.
alignment, and RL.
Selected research on language-model alignment, agent safety, and reinforcement learning.
Publication details are being updated.
View profileTechnical essays, research notes, and implementation details.
...
北矿的核心科技社团