[논문리뷰] Your Transformer Can Hold Two Thoughts at Once: Evidence of Linear Superposition in LLMs최신 LLM의 기반이 되는 Transformer 아키텍처는 Self-Attention 및 MLP 블록과 같은 고도로 비선형적인 구성 요소를 사용합니다.#Review#Superposition Linearity Hypothesis#Fine-tuning#Decoding#Transformer#LLMs#Inference Throughput#Hidden-state Additivity2026년 9월 24일댓글 수 로딩 중