RL (Reinforcement Learning, 강화 학습)
AI가 환경과의 상호작용을 통해 보상을 최대화하는 방향으로 학습하는 머신러닝 기법
1 / 2
용례
"OpenAI가 강화 학습을 위해 수만 대의 Mac mini를 구매함."
"새로운 수준의 역량에 맞는 적절한 정렬, 보안 및 모니터링 표준을 충족하기 위해 일부 최첨단 RL 학습을 중단함."
AI가 환경과의 상호작용을 통해 보상을 최대화하는 방향으로 학습하는 머신러닝 기법
"OpenAI가 강화 학습을 위해 수만 대의 Mac mini를 구매함."
"새로운 수준의 역량에 맞는 적절한 정렬, 보안 및 모니터링 표준을 충족하기 위해 일부 최첨단 RL 학습을 중단함."