본문으로 건너뛰기
← 최신 피드
리플레이 버퍼의 10%가 로봇의 망각을 4.5배 갈랐습니다
ai model♾️ 지속학습#23 · 2026. 8. 29.

리플레이 버퍼의 10%가 로봇의 망각을 4.5배 갈랐습니다

스탠퍼드대와 토요타연구소(TRI) 연구진이 8월 28일 arXiv에 공개했습니다. 리플레이 버퍼 안에서 과거 성능을 실제로 붙잡아 두는 소수의 경험을 Memory Anchors로 규정하는데, 옛 관측과 표현은 겹치지만 요구되는 행동이 상충하는 지점에서 생깁니다. LIBERO 벤치마크에서 이 앵커 10%만 제외해도 파국적 망각이 4.5배 이상 늘었고, 반대로 버퍼의 10%를 앵커 몫으로 예약하자 행동이 충돌하는 태스크의 망각이 63% 줄었습니다.

같은 날 발행된 호 · 2026-08-29