전체 방문자
—
오늘 : —
어제 : —
1개의 글
LLM 성능을 객관적으로 측정할 DeepEval G-Eval과 Ragas의 핵심 지표(충실성, 질문 적합도, 컨텍스트 정밀도)를 상세히 분석합니다. LLM 개발자 및 연구자에게 필수적인 정량 평가 가이드입니다.