코난쌤 블로그
Search
검색
다크 모드
라이트 모드
탐색기
홈
전체 글
카테고리
소개
연락처
개인정보처리방침
태그: control-policy
1건의 항목
2026년 8월 11일
하네스를 학습 가능한 제어층으로 — 오프라인 RL이 에이전트 실행 흐름을 바꿀 수 있다
agent
harness
LLM
reinforcement-learning
offline-RL
advantage-weighted-regression
control-policy
loop
automation