
ai model♾️ 지속학습#15 · 2026. 8. 17.
진화전략도 잊는다 — replay로 망각은 막지만 늘릴수록 가소성이 준다
지속학습 연구는 대부분 그래디언트 기반 지도학습에 몰려 있어, 진화전략(Evolution Strategies)도 파국적 망각을 겪는지는 확인되지 않았습니다. 순차 MuJoCo 로코모션 태스크에서 재보니 naive ES는 새 태스크로 넘어갈 때 이전 성능이 심각하게 붕괴했습니다. replay(경험 재생)를 결합하자 보존율이 크게 올랐고 태스크 간 긍정 전이까지 유도됐습니다. 다만 replay 예산을 키울수록 새 태스크 습득 능력(가소성)이 떨어졌습니다.














