AI 올림픽
9월 15일 기준이름을 가린 두 AI의 답을 사람들이 직접 비교해 투표한 순위예요.
무엇을 하고 싶나요?
한국어 대화 잘하는 AI대화·글 · 9월 13일
3GLM 5.3오픈1위와 비슷
지푸(Z.ai)중국
1,478
‘오픈’은 누구나 내려받아 쓸 수 있는 모델, ‘1위와 비슷’은 점수 오차가 1위와 겹쳐 순위 차이가 우연일 수 있다는 뜻이에요.
직접 해 보기대화·글
VS
1,532클로드 오푸스 5앤트로픽
56%이길 확률
1,491클로드 페이블 5앤트로픽
클로드 오푸스 5가 앞서요 — 같은 질문에 답했을 때 사람들이 이 답을 더 낫다고 고를 확률이 56%예요.
자료 Arena 공개 순위 (lmarena-ai/leaderboard-dataset, CC BY 4.0) · 분야마다 발표일이 달라요 · 점수는 분야 안에서만 견줘요 · 나라는 본사 기준 · 토큰포스트