[논문리뷰] Multi-LCB: Extending LiveCodeBench to Multiple Programming Languages본 논문은 기존의 코드 생성 평가가 특정 언어에 편향되어 있어 LLM의 실질적인 다국어 코딩 능력을 측정하지 못하는 한계를 해결하고자 한다. LiveCodeBench(LCB)는 지속적인 업데이트와 엄격한 오염 방지 제어를 통해 우수한 성능을 입증했으나, 오직 Python 언어만을 지원한다는 결정적인 단점이 존재한다 .#Review#Code Generation#Multi-lingual Benchmark#Large Language Models#LiveCodeBench#Contamination-aware#Cross-lingual Evaluation2026년 6월 18일댓글 수 로딩 중
[논문리뷰] Investigating Hallucination in Conversations for Low Resource Languages본 연구는 대규모 언어 모델(LLM)이 생성하는 텍스트의 사실적 오류, 즉 '환각(hallucination)' 문제를 저자원 언어인 힌디어, 페르시아어, 만다린어 대화 데이터에서 심층적으로 조사하는 것을 목표로 합니다.#Review#LLM Hallucination#Low-resource Languages#Conversational AI#ROUGE Score#Cross-lingual Evaluation#Factual Consistency2025년 8월 4일댓글 수 로딩 중