Wiki
· 강화학습
지식 그래프 보기 →
기술
7개 콘텐츠
강화학습
보상 신호로 행동을 학습하는 머신러닝 방법입니다. 추론 능력 향상의 핵심 기법으로 부상했습니다.
이 개념이 나타나는 포스트 (7)
2026-02-02 · 리서치
블랙박스 AI를 맞춤 조종하는 어드바이저 모델
2026-02-14 · 기술
강화학습 없이, 프롬프트가 스스로 진화합니다
2026-03-01 · 기술
AI가 AI를 지휘합니다: 7B 모델이 GPT-5를 이긴 방법
2026-03-10 · 기술
대화만으로 AI 에이전트를 훈련한다: OpenClaw-RL
2026-03-31 · 기술
AI가 AI를 설계한다, 사람 없이
2026-05-28 · 기술
스스로 진화하는 AI, 코드를 스스로 고칩니다
2025-04-15 · 리서치
AI, 학습의 시대에서 경험의 시대로
관련 개념 (6)
GPU
강도 4
AI 에이전트
강도 4
GRPO
강도 4
API
강도 3
LLM
강도 2
CTO
강도 2