본문으로 건너뛰기

Review

[논문리뷰] Teaching Pretrained Language Models to Think Deeper with Retrofitted Recurrence

댓글 수 로딩 중

[논문리뷰] SofT-GRPO: Surpassing Discrete-Token LLM Reinforcement Learning via Gumbel-Reparameterized Soft-Thinking Policy Optimization

댓글 수 로딩 중

[논문리뷰] SWE-fficiency: Can Language Models Optimize Real-World Repositories on Real Workloads?

댓글 수 로딩 중

[논문리뷰] Routing Manifold Alignment Improves Generalization of Mixture-of-Experts LLMs

댓글 수 로딩 중

[논문리뷰] RedOne 2.0: Rethinking Domain-specific LLM Post-Training in Social Networking Services

댓글 수 로딩 중

[논문리뷰] Reasoning with Confidence: Efficient Verification of LLM Reasoning Steps via Uncertainty Heads

댓글 수 로딩 중

[논문리뷰] RLoop: An Self-Improving Framework for Reinforcement Learning with Iterative Policy Initialization

댓글 수 로딩 중

[논문리뷰] Omni-AVSR: Towards Unified Multimodal Speech Recognition with Large Language Models

댓글 수 로딩 중

[논문리뷰] MVU-Eval: Towards Multi-Video Understanding Evaluation for Multimodal LLMs

댓글 수 로딩 중

[논문리뷰] MPJudge: Towards Perceptual Assessment of Music-Induced Paintings

댓글 수 로딩 중

[논문리뷰] Llama-Embed-Nemotron-8B: A Universal Text Embedding Model for Multilingual and Cross-Lingual Tasks

댓글 수 로딩 중

[논문리뷰] LUT-LLM: Efficient Large Language Model Inference with Memory-based Computations on FPGAs

댓글 수 로딩 중

[논문리뷰] IterResearch: Rethinking Long-Horizon Agents via Markovian State Reconstruction

댓글 수 로딩 중