I'm currently working at Z.AI, focusing on Code LLM Post-training.
- Environment scaling construction for long-horizon tasks & terminal interactive environments
- Reinforcement Learning (RL) optimization tailored for code models
- Model benchmarking, offline & online evaluation system design
- Email: 946971688@qq.com
- Email: xiangyangli@pku.edu.cn


