[논문리뷰] AI translation of literary texts is 'fine', but readers still prefer human translations본 논문은 현대의 LLM 기반 번역이 문학적 텍스트를 처리할 수 있게 되었음에도 불구하고, 실제 독자의 몰입감과 문학적 경험 측면에서 인간 번역가와 어떤 차이를 보이는지에 대한 불확실성을 해결하고자 한다.#Review#Literary Translation#Machine Translation#Human-AI Interaction#Large Language Models#Reader-centered Evaluation#Immersive Reading#Close Reading#LAIT Dataset2026년 7월 1일댓글 수 로딩 중
[논문리뷰] The Tatoxa System for Text Detoxification in Low-Resource Languages: The Case of Tatar본 논문은 Tatar와 같이 데이터 자원이 부족한 언어에서 발생하는 자동화된 텍스트 정화(detoxification) 성능 저하 문제를 해결합니다. 기존의 다국어 대규모 언어 모델(LLM)은 저자원 언어에 대한 이해도가 낮고, 문화적 맥락이나 언어적 미묘함을 반영하지 못해 정화 성능이 제한적입니다.#Review#Text Detoxification#Low-Resource Languages#Tatar#Machine Translation#LoRA#Cross-lingual Transfer2026년 6월 28일댓글 수 로딩 중
[논문리뷰] KletterMix: Climbing Toward High-Quality German Pretraining Data본 논문은 독일어 프리트레이닝 데이터의 낮은 품질과 부족한 문서화 문제를 해결하기 위해 KletterMix를 제안합니다. 기존의 독일어 데이터는 노이즈가 많은 웹 크롤링 기반이거나, 데이터 구조와 문서화 수준이 영어권 데이터에 비해 현저히 낮아 모델 성능 개선에 한계가 있었습니다.#Review#Pretraining Data#German Corpus#Machine Translation#Dataset Construction#Quality Estimation#COMETKiwi#Language Modeling2026년 6월 3일댓글 수 로딩 중
[논문리뷰] Self-Improving Multilingual Long Reasoning via Translation-Reasoning Integrated Training다국어 환경에서 긴 추론 모델( LRMs )이 겪는 어려움, 즉 비영어권 질문에 대해 영어로 추론하려는 경향과 질문 언어로 추론 시 정확도가 현저히 떨어지는 문제를 해결하는 것을 목표로 합니다.#Review#Multilingual Reasoning#Reinforcement Learning#Machine Translation#Question Understanding#Self-Improvement#Language Models#Cross-Lingual Alignment2026년 2월 8일댓글 수 로딩 중
[논문리뷰] TranslateGemma Technical Report본 논문은 Gemma 3 파운데이션 모델을 기반으로 한 오픈형 기계 번역 모델인 TranslateGemma 를 소개합니다.#Review#Machine Translation#Large Language Models#Reinforcement Learning#Supervised Fine-tuning#Gemma 3#Multimodal AI#Synthetic Data2026년 1월 14일댓글 수 로딩 중
[논문리뷰] Hala Technical Report: Building Arabic-Centric Instruction & Translation Models at Scale아랍어 고품질 명령어 데이터의 부족과 다국어 LLM에서 언어별 깊이의 불균형 문제를 해결하는 것을 목표로 합니다. 효율적인 번역-튜닝 파이프라인 을 통해 아랍어 중심의 명령어 및 번역 모델(HALA) 패밀리를 구축하고, 아랍어 벤치마크에서 최첨단 성능을 달성하여 특정 언어에 대한 역량 심화에 중점을 둡니다.#Review#Arabic NLP#Instruction Tuning#Machine Translation#Large Language Models#FP8 Quantization#Data Bootstrapping#Model Merging#Language-Centric AI2025년 9월 18일댓글 수 로딩 중
[논문리뷰] Hunyuan-MT Technical Report본 논문은 오픈소스 다국어 기계 번역 모델인 Hunyuan-MT-7B 및 Hunyuan-MT-Chimera-7B 를 소개하며, 33개 언어 에 대한 양방향 번역에서 최첨단 성능을 달성하고 특히 만다린어와 소수 민족 언어 및 방언 번역의 품질을 향상시키는 것을 목표로 합니다.#Review#Machine Translation#Large Language Model#Multilingual#Low-Resource Languages#Reinforcement Learning#Weak-to-Strong Learning#Slow Thinking2025년 9월 11일댓글 수 로딩 중