[논문리뷰] Language Chain in Alignment: Cross-lingual Ranking Preference Optimization대규모 언어 모델(LLM)의 정렬은 주로 영어 중심의 고품질 선호도 데이터에 의존하기 때문에, 다른 언어에서는 최적 이하의 성능을 보이며 응답 정확성에서 일관성이 떨어지는 문제가 발생합니다. 이러한 불균형은 비영어권 질의에 대한 입력-출력 언어 불일치 및 성능 저하와 같은 바람직하지 않은 행동으로 이어집니다.#Review#Cross-lingual Alignment#Preference Optimization#Large Language Models#Learning to Rank#Multilingual LLMs#Instruction Following#LambdaLoss2026년 8월 30일댓글 수 로딩 중