XMU-DeepLIT
网站首页
最新资讯
学术团队
论文发表
桃李天下
研途印象
动态成果
联系我们
SPEC-Distill: Towards Efficient Speculative Distillation for Reinforcement Learning with Verifiable Rewards
Bingshuai Liu
,
Zijun Min
,
Ante Wang
,
Jiajun Cao
,
Haibo Zhang
,
Liang Yao
,
Shuman Liu
,
Anxiang Zeng
,
Jinsong Su
八月 2026
研究方向
大模型训练
出版物
In Proc. of EMNLP 2026.
(CCF-B类)
引用
×