[논문리뷰] MetroLLM-Bench: Evaluating Language Models as Transit Kiosk Runtimes본 논문은 transit kiosk의 정책 레이어로서 언어 모델을 도입할 때 발생하는 운영적 한계를 평가하고 해결하는 것을 목표로 한다.#Review#MetroLLM-Bench#Transit Kiosk Runtimes#Parameter-Efficient Fine-Tuning (PEFT)#Qwen#ReAct#Function Calling#Benchmark2026년 9월 10일댓글 수 로딩 중