stale 데이터로 학습을 얼마나 멀리 끌고 갈 수 있는가를 다루고, second-moment trust region(M2PO)으로 학습 붕괴를 늦춘다 — 축은 학습 안정성이지 선택 결정이 아니다.
stale 데이터로 학습을 얼마나 멀리 끌고 갈 수 있는가를 다루고, second-moment trust region(M2PO)으로 학습 붕괴를 늦춘다 — 축은 학습 안정성이지 선택 결정이 아니다.
낡은 답안지로 '공부'를 오래 버티는 법 — 우리는 낡은 답안지로 '문제 고르기'가 언제 틀리는가.
학습(training) vs 선택(selection)의 축 분리
우리 인증 분석이 이 계열의 allocation 질문과 접점
우리의 단위는 결정이다
stale 데이터 '학습' 축의 대표 — 우리의 '선택' 축과 상보적이며 estimand가 다르다.