2026년 8월 26일 훈련 없이 확률값으로 에이전트를 검증하는 LLM-as-a-Verifier 분석 별도의 보상 모델 훈련 없이 일반 LLM의 로짓 확률 분포를 기댓값으로 계산해 에이전트 궤적을 초정밀 검증하는 스탠퍼드, UC 버클리, NVIDIA 연구진의 논문 《LLM-as-a-Verifier: A General-Purpose Verification Framework》 핵심 원리와 활용법을 정리했다. 공부 AI 논문 에이전트 UC버클리