순위표 점수 대신 내 업무 예시 5개를 두 AI에 똑같이 넣고, 이름을 가린 채 미리 정한 기준으로 채점해요. 우리 일에 맞는 쪽이 보여요.
준비물
평소 하는 업무 예시 5개(실명·금액은 가린 것)
비교할 AI 두 개(서비스 두 개 또는 한 서비스의 모델 두 개)
채점할 표 한 장(엑셀·구글 시트)
하는 방법 5단계
1
예시 5개를 고르고 가려요
자주 하는 일 3개, 까다로운 일 1개, 일부러 애매하거나 엉뚱한 입력 1개를 골라요. 실제 업무에는 너무 긴 글이나 자료에 없는 내용을 묻는 경우도 섞여 있어서, 그런 예시가 하나쯤 있어야 차이가 드러나요. 실명·연락처·금액·고객사 이름은 [이름]·[금액]처럼 바꿔요.
2
기준을 먼저 적어 두면 길고 그럴듯한 답에 덜 끌려요.
공개 순위로는 알 수 없는 '내 일에서의 차이'를 볼 수 있어요. 기준을 먼저 적어 두면 길고 그럴듯한 답에 덜 끌려요. 모델이 바뀌어도 같은 조건으로 다시 비교할 표가 남아요.