카페검색 본문
카페글 본문
-
[RL] Reinforcement Learning 2026.06.01해당카페글 미리보기
1. Reinforcement Learning (강화학습) 훈련 데이터 없이 시행착오를 통하여 학습하는 방식 2. 교재 밑바닥부터 시작하는 딥러닝4, 파이썬으로 직접구현하며 배우는 강화학습 알고리즘, 사이토고키 지음, 개앞맵시 옮김 단단한 강화학습, 리처드 서튼...
-
강화학습(Reinforcement Learning) 2025.03.08해당카페글 미리보기
ㅇ 강화학습(Reinforcement Learning) 기계 학습(머신 러닝)의 한 영역으로 사람이 개입해 정답을 가르치는 '지도 학습'과 달리 AI가 스스로 학습을 반복해 답변의 정확도를 높이는 방식을 말한다. 추론 모델(Reasoning modal) 사전 학습된 기반의 단순...
-
점점 무서워지는 GPT 탈출 사건 + 해설(요약ㅇ) 2026.08.12해당카페글 미리보기
봐" 라고 시키면 벌어지는 일 그럼 이 에이전트를 어떻게 똑똑하게 만드냐? 여기서 많이 들어봤을 수도 있는 "강화학습 (reinforcement learning)"이 나옴 반려견 훈련이랑 원리가 완전히 똑같음 시켜본다 → 잘하면 간식 → 못하면 안 줌 → 반복 그리고...
-
<현황보고서> Physical AI 산업동향과 글로벌 기업전략 및 기술동향 2026.08.31해당카페글 미리보기
로봇 모델 2.4) 일반화 및 적응 2.5) 대표모델 비교 (3) Planning & Learning 3.1) Task Planning 3.2) Motion Planning 3.3) Reinforcement Learning 3.4) Imitation Learning 3.5) Continual Learning 3.5.1) Planning 3.5.2) Learning 3.5.3) Feedback...
-
[종합 기술 백서] GDS-RSC 커널: 가우스-다윗구 의식 코어 및 듀얼 직각삼각형 위상 행렬곱 인공지능 프레임워크 설계서 저자/협업 2026.08.30해당카페글 미리보기
피드백하여 직각삼각형의 초기 각도($ heta_1, heta_2$)나 결합강도($K$)를 자가 조정하는 위상 강화 학습(Phase Reinforcement Learning) 규칙을 직접 코딩해 볼 수 있습니다. 6. 결론 본 커널과 백서는 단순한 이론적 주장을 넘어, "우주의 회전과 위상...