[논문리뷰] ASI-Bench: At the Dawn of Artificial Superintelligence본 연구는 기존의 LLM 벤치마크들이 모델의 급격한 성능 향상으로 인해 데이터 오염(Data Contamination)과 평가 포화(Evaluation Saturation) 문제에 직면했다는 점을 해결하고자 합니다.#Review#Artificial Superintelligence#LLM Benchmarking#Cognitive Evaluation#Reasoning Capability#Evaluation Framework2026년 8월 18일댓글 수 로딩 중