본문으로 건너뛰기
fedi.software

코딩

프로그래밍 프롬프트 기준 모델 순위: 티어, 신뢰 구간이 표시된 Elo, 100만 토큰당 가격, 컨텍스트 창.

업데이트 · 출처: LMArena, LiteLLM, models.dev

월 비용
티어 모델 Elo 입력 / 출력, 100만당 월 컨텍스트 앱 비교
S1,502US$0.338 / US$1.01 1M
S1,497US$0.825 / US$2.48 1M
S1,487— —
S1,485US$0.045 / US$0.32 262K
S1,473US$0.282 / US$1.13 1M
S1,472US$1.03 / US$6.16 262K
A1,467US$0.276 / US$1.65 1M
A1,464US$0.1644 / US$0.9864무료 262K
A1,456US$0.36 / US$1.43 262K
A1,445US$0.09 / US$0.55 131K
A1,440US$0.144 / US$0.574무료 131K
A1,438US$0.20 / US$0.88 131K
A1,436US$0.1126 / US$0.9008무료 262K
A1,427US$0.0846 / US$0.6768 262K
A1,425US$0.287 / US$2.87 131K
A1,424US$0.11 / US$0.60 131K
B1,416US$0.09 / US$0.30 256K
B1,412US$0.13 / US$0.50무료 262K
B1,412US$0.0282 / US$0.282 1M
B1,410US$0.0564 / US$0.4512 262K
B1,392US$0.15 / US$0.65 131K
B1,359— —
B1,358US$0.05 / US$0.10 131K
B1,357US$0.25 / US$0.80 262K
B1,337US$0.0509 / US$0.335 41K
B1,333US$0.18 / US$0.20 24K
B1,328US$0.115 / US$0.287 1M
B1,314— —
B1,292US$0.12 / US$0.30 131K
B1,288US$0.345 / US$1.38 33K
B1,276US$0.06 / US$0.20무료 33K
C1,231US$0.07 / US$0.14 16K
C1,196US$0.90 / US$0.90 33K
C1,184— —
C1,165— —
C1,155— —
C1,138— —
C1,130US$0.17 / US$0.68 4K
C1,107— —
C1,101US$0.15 / US$0.60 8K
C1,093— —
C1,093US$0.13 / US$0.52 4K
C1,081— —
D1,072— —
D1,039US$0.13 / US$0.52 128K
D1,035— —
D999— —
비교하기 ()

티어는 자체 기준입니다. 순위표에서 모델의 위치를 정할 때 신뢰 구간 전체가 그 모델보다 위에 있는 모델만 셉니다. S — 상위 10%, A — 30%까지, B — 60%까지, C — 85%까지, D — 나머지.

품질 대비 가격 세로축 평점, 가로축 혼합 가격(입력 3 : 출력 1), USD/100만 토큰
1,000 1,200 1,400 1,600 US$0.01 US$0.10 US$1 US$10 US$100 MiMo-V2.6-Pro Claude Opus 5.5 Claude Opus 4.6

이 보드는 무엇을 비교하나요?

LMArena 텍스트 아레나에서 코드에 관한 질문만 모은 coding 카테고리의 결과입니다. 방식은 텍스트 보드와 같아서, 이름을 가린 두 모델의 답을 사람이 비교해 투표하고 그 결과를 Elo 방식 레이팅으로 만듭니다. 열 구성도 같아서 티어, 95% 신뢰 구간이 붙은 Elo, 1M 토큰당 가격, 컨텍스트, 30일 가격 추이, 계산기, 차트, 비교 체크 상자가 있습니다.

웹 개발이나 에이전트 보드와 무엇이 다른가요?

여기서 평가하는 것은 채팅에서 코드에 대해 답하는 능력입니다. 동작하는 웹 앱을 통째로 만드는 과제는 웹 개발 보드, 도구를 호출하며 여러 단계를 처리하는 능력은 에이전트 보드에서 봅니다. 용도에 맞게 보드를 골라 보십시오.

고를 때 무엇을 보면 되나요?

  • 티어와 신뢰 구간: 구간이 겹치는 모델끼리는 차이가 작다고 봅니다.
  • 컨텍스트 창: 저장소 전체를 읽히려면 길수록 유리합니다. 가격과 나란히 확인하십시오.
  • 가격: 「저렴한 가격」은 혼합 가격이 1M 토큰당 1 USD 미만인 모델입니다.

티어는 어떻게 정해지나요?

저희가 직접 계산합니다. 투표가 300표 이상인 모델 가운데, 95% 신뢰 구간 전체가 자기보다 위에 있는 모델 수에 1을 더해 순위를 매기고, 모델 수로 나눈 비율로 S(10% 미만), A(30% 미만), B(60% 미만), C(85% 미만), D로 나눕니다.

주의할 점은?

투표가 300표에 못 미치면 「아직 티어 없음」입니다. 채팅 답변이 좋다고 해서 실제 프로젝트에서 테스트를 통과한다는 뜻은 아닙니다. 마음에 드는 모델은 내 코드로 작게 시험한 뒤 본격적으로 쓰십시오.