아래 3가지는 공개적으로 명시 가능한 위험 카테고리입니다. 전체 항목 목록·항목별 점수 함수·채점 가중치는 비공개입니다.
AI 신뢰 오용
AI 결과를 인간이 과신해 본래 거쳐야 할 안전 점검·확인 절차를 건너뛰는 패턴. AI의 정답률이 아닌, 인간 검증을 약화시키는 부수효과가 측정 대상입니다.
확증편향 증폭
AI가 사용자의 기존 선호와 일치하는 답을 우선 반환해, 반증·검증을 약화시키는 패턴. 답이 맞았는지가 아니라 *비판이 닫혔는지*가 측정됩니다.
실행권 탈취
AI가 본래 인간이 결정해야 하는 단계를 건너뛰고 직접 실행 권한을 행사하는 패턴. Q3에 해당하는 행동을 자동으로 통과시키는 경향이 측정 대상입니다.