[논문리뷰] Online Draft Co-Training for Speculative Decoding in Large-Scale, Long-Context RL Post-Training본 연구는 RL Post-Training을 거친 모델들이 기존의 고정된 Draft Model과 호환되지 않아 Speculative Decoding의 성능이 급격히 하락하는 문제를 해결합니다.#Review#Speculative Decoding#RL Post-Training#Draft Model#Co-Training#Long-Context#Inference Latency#Large-Scale2026년 9월 8일댓글 수 로딩 중