라이언의 꿀팁백과
메뉴
둘러보기
대문
최근 바뀜
임의의 문서로
미디어위키 도움말
검색
여기를 가리키는 문서
가리키는 글의 최근 바뀜
Atom
특수 문서 목록
문서 정보
최근 바뀜
도움말
로그인하지 않음
토론
기여
계정 만들기
로그인
도움말
행위
문서
토론
편집
원본 편집
역사
"RLCD"의 편집 역사
이 문서의 기록 보기
특정판 필터링
펼치기
접기
끝 날짜:
태그
필터:
판 보이기
차이 선택: 비교하려는 판의 라디오 버튼을 선택한 다음 엔터나 아래의 버튼을 누르세요.
설명:
(최신)
= 최신 판과 비교,
(이전)
= 이전 판과 비교,
잔글
= 사소한 편집
최신
이전
2026년 9월 28일 (월) 09:13
110.45.175.4
토론
786 바이트
+786
새 문서: '''Reinforcement Learning for Calibrated Decisions(RLCD, 교정된 의사결정을 위한 강화학습)'''는 판단의 확률이 실제 정확도와 잘 맞도록 하는 방법. 2026년 9월, 영국의 AI 스타트업 TypeSafe AI가 자사의 초고속 의사결정 모델인 'Jev'와 함께 공개하며 주목받기 시작. 기존 LLM이 문장을 생성하며 자잘한 판단을 내리느라 시간과 비용(토큰)을 낭비하던 문제를 해결하고, 소프트웨어 시...
태그
:
시각편집기