코난쌤 블로그

홈전체 글카테고리소개연락처개인정보처리방침

태그: Reinforcement-Learning

1건의 항목

  • 2026년 6월 30일

    검증의 지평선: 코딩 에이전트 보상 설계의 근본적 한계와 공진화 전략

    • LLM
    • Coding-Agent
    • Reinforcement-Learning
    • Reward-Design
    • Verification
    • Qwen

Created with Quartz v4.5.2 © 2026

  • 소개
  • 연락처
  • 개인정보처리방침
  • 전체 글