문장 유사도
Definition
문장 유사도는 두 개의 서로 다른 문장 간 의미적 중첩 정도를 측정합니다. 이는 단어 수준의 일치를 넘어 의미, 맥락, 의도를 이해하는 것을 목표로 합니다. 일 …
Terms tagged with Metrics
문장 유사도는 두 개의 서로 다른 문장 간 의미적 중첩 정도를 측정합니다. 이는 단어 수준의 일치를 넘어 의미, 맥락, 의도를 이해하는 것을 목표로 합니다. 일 …
MAUVE는 생성형 언어 모델의 출력이 인간 언어 사용과 얼마나 밀접하게 유사한지 평가하도록 설계된 통계적 측정치입니다. 단순한 퍼플렉시티(perplexity) …
인셉션 스코어(IS)은 생성 적대 신경망(GAN) 및 기타 생성 모델의 성능을 평가하기 위해 도입된 통계적 측정치입니다. 이는 두 가지 요소를 결합합니다: 이미 …
균등한 확률은 알고리즘 공정성에서 사용되는 통계적 평등 제약 조건으로, 모델이 모든 보호된 그룹에 대해 동등하게 잘 수행되도록 보장합니다. 구체적으로, 이는 특 …
이 분야에는 정확도, 정밀도, 재현율, F1 점수 및 ROC 곡선 아래 면적(AUC-ROC) 등의 지표를 분석하는 작업이 포함됩니다. 이는 모델이 두 클래스를 …
혼동 행렬은 알고리즘(일반적으로 지도 학습 모델)의 성능을 시각화하기 위해 사용되는 특정 표 레이아웃입니다. 이 표는 참 양성(True Positive), 참 …
이 지표는 카테고리 집합이 해당 카테고리 내 속성 값을 얼마나 잘 예측할 수 있는지를 정량화합니다. 이는 카테고리의 크기와 그 내부 구성 요소의 동질성(균일성) …
베이지안 후회는 완벽한 정보로 달성할 수 있는 최적 보상과 불확실성 하에서 행동하는 에이전트가 얻는 기대 보상의 차이를 정량화합니다. 이는 적분하여 계산됩니다. …
ASR 완전 달성이라는 용어는 자동 음성 인식(ASR) …
지연 시간은 일반적으로 밀리초 단위로 표현되며, AI 서비스의 반응 속도를 측정합니다. 여기에는 추론 시간, 네트워크 전송 지연 및 처리 오버헤드가 포함됩니다. …
바서스타인 거리(또는 지상 이동자 거리)는 한 분포에서 질량을 이동시키는 데 필요한 최소 ‘작업량’을 계산하여 두 확률 분포 간의 불일치성 …
점수는 정확도, 정밀도 또는 보상과 같은 특정 지표에 대해 머신러닝 모델이 얼마나 잘 수행되었는지 정량화합니다. 강화 학습에서는 누적 보상을 나타내며, 분류 작 …
AI 모델을 평가할 때 ‘전반적’ 지표는 고립된 구성 요소에 집중하기보다 시스템 성능에 대한 포괄적인 시각을 제공합니다. 여기에는 전체 정 …
평가는 정량적 지표(예: 정확도, F1 점수, BLEU 점수)와 정성적 평가를 사용하여 AI 모델이 특정 작업에서 얼마나 잘 수행되는지를 체계적으로 측정하는 것 …
벤치는 서로 다른 AI 모델이나 알고리즘의 능력을 비교하기 위한 표준화된 참조점을 제공합니다. 일반적으로 큐레이션된 데이터셋과 정확도나 속도 같은 특정 평가 지 …
인공지능에서 벤치마크는 머신러닝 모델의 능력을 측정하도록 설계된 표준화된 테스트 스위트 또는 데이터셋입니다. 이는 서로 다른 모델을 비교하기 위한 일관된 프레임 …