코난쌤 블로그
Search
검색
다크 모드
라이트 모드
탐색기
홈
전체 글
카테고리
소개
연락처
개인정보처리방침
태그: contextual-bandit
1건의 항목
2026년 7월 29일
동결된 모델을 그대로 쓰면서 하네스만 학습한다 — 729가지 구성을 돌려본 결과, 정적 기준선이 이겼다
agent
harness
LLM
reinforcement-learning
contextual-bandit
DSPy
optimization
automation
loop
tool-use