AI의 추론 능력은 왜 계속 좋아질까? 학습·보상·검증의 원리 날짜: 7월 10, 2026 강화학습 과정 감독 대규모 언어 모델 체인 오브 소트 추론 모델 테스트타임 컴퓨트 AI 추론 능력 AI 추론 원리 LLM 추론 +