본문으로 건너뛰기
fedi.software

텍스트

LMArena의 블라인드 사용자 투표로 순위를 매긴 채팅 모델입니다. 각 점수의 신뢰 구간과 100만 토큰당 현재 가격을 함께 보여 줍니다.

업데이트 · 출처: LMArena, LiteLLM, models.dev

월 비용
티어 모델 Elo 입력 / 출력, 100만당 월 컨텍스트 앱 비교
S1,482US$0.338 / US$1.01 1M
S1,476US$0.825 / US$2.48 1M
S1,470— —
S1,455US$0.282 / US$1.13 1M
S1,451US$1.25 / US$2.50 1M
A1,450US$1.25 / US$2.50 1M
A1,448US$2 / US$6 500K
S1,447US$1.03 / US$6.16 262K
A1,445US$0.10 / US$0.10 1M
A1,444US$1.25 / US$2.50 2M
A1,441US$0.045 / US$0.32 262K
A1,439US$0.36 / US$1.43 262K
A1,438US$0.1644 / US$0.9864무료 262K
A1,437US$0.276 / US$1.65 1M
A1,437US$2 / US$10 200K
A1,427US$1.25 / US$6 500K
A1,426US$3 / US$15 131K
A1,420US$0.20 / US$0.88 131K
A1,419US$0.09 / US$0.55 131K
A1,417US$0.144 / US$0.574무료 131K
A1,417US$0.1126 / US$0.9008무료 262K
A1,415US$0.11 / US$0.60 131K
A1,411US$2.70 / US$13.50 256K
A1,409US$0.0846 / US$0.6768 262K
B1,401US$0.287 / US$2.87 131K
B1,400US$1.60 / US$4.80 500K
B1,397US$0.0282 / US$0.282 1M
B1,397US$1.25 / US$2.50 1M
B1,394US$0.0564 / US$0.4512 262K
B1,384US$0.09 / US$0.30 256K
B1,378US$0.05 / US$0.25 262K
B1,369US$0.30 / US$0.50 131K
B1,368US$0.15 / US$0.65 131K
B1,367— —
B1,356US$0.13 / US$0.50무료 262K
B1,348US$0.05 / US$0.20무료 131K
B1,340US$0.05 / US$0.10 131K
B1,338US$0.40 / US$0.40무료 131K
B1,329US$0.18 / US$0.20 24K
B1,327US$0.0115 / US$0.17 1M
B1,326US$0.115 / US$0.287 1M
B1,320무료 128K
B1,317US$0.0509 / US$0.335 41K
B1,308— —
B1,305US$2 / US$10 131K
B1,299— —
B1,283US$0.357 / US$0.408무료 128K
B1,282US$0.345 / US$1.38 33K
B1,281— —
C1,269US$0.12 / US$0.30 131K
C1,230US$0.06 / US$0.20무료 33K
C1,228— —
C1,225— —
C1,203US$0.90 / US$0.90 33K
C1,175— —
C1,166— —
C1,137— —
C1,128— —
C1,098— —
D1,083— —
D1,051— —
D997— —
비교하기 ()

티어는 자체 기준입니다. 순위표에서 모델의 위치를 정할 때 신뢰 구간 전체가 그 모델보다 위에 있는 모델만 셉니다. S — 상위 10%, A — 30%까지, B — 60%까지, C — 85%까지, D — 나머지.

품질 대비 가격 세로축 평점, 가로축 혼합 가격(입력 3 : 출력 1), USD/100만 토큰
1,000 1,200 1,400 1,600 US$0.01 US$0.10 US$1 US$10 US$100 Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5

순위를 만드는 방법

이 보드의 바탕은 LMArena 텍스트 아레나의 종합 카테고리입니다. 사용자가 질문을 보내면 이름을 가린 두 모델이 답하고, 사용자는 더 나은 답에 투표합니다. 모델 이름은 투표 뒤에 공개됩니다. 이런 대결을 쌓아 체스처럼 Elo 방식의 레이팅을 계산합니다.

각 행에는 다른 출처의 데이터도 더했습니다. 개발사, 「오픈 웨이트」 표시, 입력과 출력 각각의 1M 토큰당 최저가, 컨텍스트 창, 30일간 가격 추이, 그리고 저희 카탈로그에 앱이 있으면 다운로드 링크입니다.

한 행 읽는 법

  • 티어: 저희가 매기는 S부터 D까지의 등급.
  • Elo와 막대: 막대는 95% 신뢰 구간입니다. 두 모델의 구간이 겹치면 차이는 통계적으로 뚜렷하지 않습니다. 상위 티어에 여러 모델이 함께 있는 이유입니다.
  • 가격: 데이터 날짜에 공급자들 가운데서 찾은 가장 낮은 가격(USD).
  • 컨텍스트: 한 번의 요청에서 다룰 수 있는 토큰 수.

행을 누르면 싼 순서의 공급자, 모달리티, 최대 출력, 투표 수, 출처에서의 순위, 라이선스, 출시일, 지식 기준일이 펼쳐집니다. 체크 상자로 최대 4개 모델을 비교로 보낼 수 있습니다.

비용 계산

「월 비용」 계산기는 월 토큰 수와 입력 비율로 비용을 어림합니다. 「품질 대비 가격」 차트는 세로축이 레이팅, 가로축이 입력 3 대 출력 1로 섞은 가격입니다. 이 보드의 「저렴한 가격」은 혼합 가격이 1M 토큰당 1 USD 미만인 모델입니다.

숫자의 한계

투표가 300표에 못 미치는 모델은 아직 티어가 없고 「아직 티어 없음」으로 표시됩니다. 레이팅은 아레나 사용자의 선호이며, 질문 대부분이 영어입니다. 속도, 비용, 특정 작업의 정확도는 측정하지 않습니다. 공급자 가격은 개발사 가격과 다를 수 있고, 캐시·배치 할인이나 지역별 가격은 반영하지 않습니다.