**arXiv ID:** 2609.28145v1 **Authors:** Shuai Dong, Yongfu Zhu, Yuqi Xu, Weichu Xie, Liuwenpu, Ziyue Wang, Kaiwen Tuo, Congcong Wang, Siyuan Wang, Wenqi Shao, Shuai Yang, Ji Zhao, Caoyuan Ma, Wenzheng Chang, Taiqiang Wu, Xinlei Yu, Hongrui Wu, Xiaoxuan He, Fangke Chen, Dianyi Wang, Kanghui Tian, Sirry Chen, Xingyu Liu, Xiangnan Wu, Jiawei Guo, Haowen Hou, LingHan Chen, Zhongyu Wei, Jiaqi Wang **URL:** http://arxiv.org/abs/2609.28145v1 **Utility Score:** 1.00
Scanned 9/24/2026
Install to Claude Code
npx -y skills add hiyenwong/ai_collection --skill arxiv-2609-28145v1-rl-starts-before-rl-on-policy-distillation-for-bet --agent claude-codeInstalls into .claude/skills of the current project.
Are you the author of Arxiv 2609 28145v1 Rl Starts Before Rl On Policy Distillation For Bet?
Add the live security badge to your README — it updates automatically with every re-scan.
[](https://www.skillsdirectory.com/skills/hiyenwong-arxiv-2609-28145v1-rl-starts-before-rl-on-policy-d)More formats (shields.io, HTML) on the badges page.
--
name: arxiv-2609-28145v1-rl-starts-before-rl-on-policy-distillation-for-bet
description: 'RL Starts before RL: On Policy Distillation for Better Reinforcement Learning (arXiv: 2609.28145v1)'
metadata:
{
"arxiv_id": "2609.28145v1",
"utility": 1.0,
"title": "RL Starts before RL: On Policy Distillation for Better Reinforcement Learning",
"authors": "Shuai Dong, Yongfu Zhu, Yuqi Xu, Weichu Xie, Liuwenpu, Ziyue Wang, Kaiwen Tuo, Congcong Wang, Siyuan Wang, Wenqi Shao, Shuai Yang, Ji Zhao, Caoyuan Ma, Wenzheng Chang, Taiqiang Wu, Xinlei Yu, Hongrui Wu, Xiaoxuan He, Fangke Chen, Dianyi Wang, Kanghui Tian, Sirry Chen, Xingyu Liu, Xiangnan Wu, Jiawei Guo, Haowen Hou, LingHan Chen, Zhongyu Wei, Jiaqi Wang",
"url": "http://arxiv.org/abs/2609.28145v1"
}
--
# RL Starts before RL: On Policy Distillation for Better Reinforcement Learning
**arXiv ID:** 2609.28145v1
**Authors:** Shuai Dong, Yongfu Zhu, Yuqi Xu, Weichu Xie, Liuwenpu, Ziyue Wang, Kaiwen Tuo, Congcong Wang, Siyuan Wang, Wenqi Shao, Shuai Yang, Ji Zhao, Caoyuan Ma, Wenzheng Chang, Taiqiang Wu, Xinlei Yu, Hongrui Wu, Xiaoxuan He, Fangke Chen, Dianyi Wang, Kanghui Tian, Sirry Chen, Xingyu Liu, Xiangnan Wu, Jiawei Guo, Haowen Hou, LingHan Chen, Zhongyu Wei, Jiaqi Wang
**URL:** http://arxiv.org/abs/2609.28145v1
**Utility Score:** 1.00
## Summary
This skill was automatically generated from the arXiv paper titled "RL Starts before RL: On Policy Distillation for Better Reinforcement Learning" (ID: 2609.28145v1).
## Usage
This skill can be used to reference the paper's concepts, methodologies, or findings in agent workflows.
## References
- arXiv: http://arxiv.org/abs/2609.28145v1
Is this your skill, or is something wrong with this listing? Request removal or report an issue. Author removals are honored within 72 hours.
No comments yet. Be the first to comment!