[논문리뷰] LatentPort: Beyond KV Cache - Cross-Model Transfer of Recurrent Memory in Hybrid Language Models: A 4B-to-9B Hybrid-State Handoff Without Target Prefix Replay기존 언어 모델(LLM) 스위칭 방식은 수신 모델이 historical prefix를 재인식하고 inference state를 재구축해야 하는 비효율성을 내포한다.#Review#Hybrid Language Models#Cross-Model Transfer#Recurrent Memory#KV Cache#Gated DeltaNet (GDN)#Persistent State#Negative Log-Likelihood (NLL)#Prefix Replay2026년 9월 22일댓글 수 로딩 중
[논문리뷰] Multi-Turn On-Policy Distillation with Prefix Replay본 논문은 에이전트 기반 학습(Agentic Tasks)에서 Multi-Turn On-Policy Distillation (OPD)이 겪는 높은 비용과 효율성 문제를 해결하고자 합니다. 기존 OPD는 매 업데이트마다 학생 모델이 환경과 상호작용하고 교사 모델을 조회해야 하므로, 환경 배포 및 추론 비용이 매우 높습니다 .#Review#On-Policy Distillation#Knowledge Distillation#Multi-Turn#Agentic Tasks#Prefix Replay#Distribution Shift2026년 7월 23일댓글 수 로딩 중