[논문리뷰] GigaBrain-0.7: Scaling Embodied Foundation Models to Emergent Capabilities with a Three-System Architecture기존 VLA 모델들은 복잡한 환경에서 동작하는 일반적인 로봇 제어에는 성공했으나, 데이터가 다양한 로봇 형태로 확장될 때 서로 다른 액션 공간과 실행 조건으로 인해 학습 효율이 떨어지고 지식이 충돌하는 문제에 직면해 있습니다 .#Review#Vision-Language-Action (VLA)#Embodied Foundation Models#Three-System Architecture#World Model#Flow Matching#Multi-Embodiment#Soft Knowledge Insulation2026년 8월 25일댓글 수 로딩 중
[논문리뷰] HY-Embodied-0.5: Embodied Foundation Models for Real-World Agents본 논문은 모달리티 적응형 컴퓨팅을 위한 MoT 아키텍처와 비전-언어 연결을 강화하는 Visual Latent Tokens를 핵심 방법론으로 제안합니다 . 시각적 인지 능력 향상을 위해 HY-ViT 2.0 인코더를 탑재하고, 고품질 embodied 데이터를 활용한 반복적인 사후 학습 패러다임을 설계했습니다.#Review#Embodied Foundation Models#Mixture-of-Transformers#Visual Latent Tokens#On-policy Distillation#Chain-of-Thought#Real-world Agents2026년 4월 9일댓글 수 로딩 중