[논문리뷰] SLAI T-Rex: Full-Parameter Post-training of the DeepSeek-V4 Family on Ascend SuperPOD본 연구는 trillion-parameter 규모의 MoE 모델인 DeepSeek-V4를 Ascend SuperPOD 클러스터에서 학습할 때 발생하는 시스템적 병목 현상을 해결하고자 합니다.#Review#SLAI T-Rex#Ascend SuperPOD#DeepSeek-V4#Operations Research#AuraKernel#Full-Parameter Post-training2026년 7월 22일댓글 수 로딩 중
[논문리뷰] AlphaOPT: Formulating Optimization Programs with Self-Improving LLM Experience Library본 논문은 최적화 모델링 자동화의 어려움, 즉 비공식적 언어를 정밀한 수학적 공식 및 실행 가능한 솔버 코드로 변환하는 문제에 주목합니다.#Review#Optimization Modeling#Large Language Models (LLMs)#Experience Library#Self-Improving Systems#Continual Learning#Out-of-Distribution Generalization#Operations Research#Knowledge Representation2025년 10월 23일댓글 수 로딩 중