코난쌤 블로그
Search
검색
다크 모드
라이트 모드
탐색기
홈
전체 글
카테고리
소개
연락처
개인정보처리방침
태그: Reinforcement-Learning
1건의 항목
2026년 6월 30일
검증의 지평선: 코딩 에이전트 보상 설계의 근본적 한계와 공진화 전략
LLM
Coding-Agent
Reinforcement-Learning
Reward-Design
Verification
Qwen