[논문리뷰] Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090본 논문은 대규모 언어 모델(LLM)의 pretraining 비용이 지나치게 높아 학계나 소규모 연구실의 접근성이 떨어진다는 문제 의식에서 출발합니다.#Review#Large Language Models#Pretraining#Cost-Efficiency#RTX 5090#FP8#MuonH#Curriculum Model Averaging2026년 8월 30일댓글 수 로딩 중
[논문리뷰] TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times본 논문은 비디오 확산 모델의 엔드-투-엔드 생성 속도를 100~200배 가속화하면서도 비디오 품질을 유지하는 것을 목표로 합니다. 이는 현재 확산 모델의 높은 계산 비용으로 인한 비효율성을 해결하고, 고품질 비디오 생성을 더욱 실용적으로 만드는 데 중점을 둡니다.#Review#Video Generation#Diffusion Models#Acceleration#Quantization#Attention#Step Distillation#Performance Optimization#RTX 50902025년 12월 24일댓글 수 로딩 중