AI 올림픽

9월 15일 기준

이름을 가린 두 AI의 답을 사람들이 직접 비교해 투표한 순위예요.

무엇을 하고 싶나요?

한국어 대화 잘하는 AI대화·글 · 9월 13일
1
클로드 오푸스 5
앤트로픽미국
1,532
2
클로드 페이블 51위와 비슷
앤트로픽미국
1,491
3
GLM 5.3오픈1위와 비슷
지푸(Z.ai)중국
1,478
4
큐원3.8
알리바바중국
1,469
5
키미 K3오픈
문샷(키미)중국
1,467

‘오픈’은 누구나 내려받아 쓸 수 있는 모델, ‘1위와 비슷’은 점수 오차가 1위와 겹쳐 순위 차이가 우연일 수 있다는 뜻이에요.

직접 해 보기대화·글
VS
1,532클로드 오푸스 5앤트로픽
56%이길 확률
1,491클로드 페이블 5앤트로픽

클로드 오푸스 5 앞서요 — 같은 질문에 답했을 때 사람들이 이 답을 더 낫다고 고를 확률이 56%예요.

자료 Arena 공개 순위 (lmarena-ai/leaderboard-dataset, CC BY 4.0) · 분야마다 발표일이 달라요 · 점수는 분야 안에서만 견줘요 · 나라는 본사 기준 · 토큰포스트