logo

LLM 평가자

LLM 평가자(LLM-as-a-Judge)

  • LLM 평가자: 한 언어 모형이 다른 모형의 응답을 평가하는 방법
  • 장점
    • 인간 평가보다 빠른 대규모 평가
    • 단어 겹침 지표보다 폭넓은 내용과 맥락 평가
    • 평가 기준표에 따른 품질 차원별 채점
  • 주의점
    • 평가 모형 자체의 오류와 편향
    • 프롬프트와 응답 순서에 따른 결과 변화
    • 점수 조작을 노리는 적대적 입력에 대한 취약성

메타 평가

  • 메타 평가(meta-evaluation): 평가자로 사용하는 LLM 자체의 신뢰도 평가
  • 주요 기준
    • 인간 심사위원과의 일치도
    • 반복 평가의 일관성
    • 위치 교환과 표현 변화에 대한 강건성
    • 적대적 입력에 대한 저항성

LLM 평가자의 편향

  • 위치 편향: 먼저 또는 나중에 제시된 응답을 선호
  • 길이 편향: 더 길고 장황한 응답을 선호
  • 스타일 편향: 보기 좋은 형식과 이모티콘 등에 영향
  • 구체성 편향: 수치, 전문용어, 참고문헌이 있는 응답을 선호
  • 자기고양 편향: 자신과 같은 계열의 모형이 만든 응답을 선호
  • 문화적 편향: 특정 문화와 관점에 더 높은 점수
  • 친숙성 편향: 평가 모형이 잘 아는 지식에 유리한 판단
  • 지시 반복 편향: 평가 지시를 그대로 되풀이한 응답을 선호

LLM 평가자의 인간 일치도와 여러 편향에 대한 메타 평가 결과

출처: A Survey on LLM-as-a-Judge

Previous
튜링 테스트