fedi-index의 GPT-4.1 Mini
분야별 점수와 그 구성, 가성비, 로컬 실행, 추이.
fedi-index · 종합
C 1,327 ±6
백분위 40 · #175
사람의 선호 / 문제 해결
1,337 / 1,311
사람 투표와 벤치마크, Elo-eq
가성비
-42
100만 토큰당 US$0.70, 제공업체 23곳 중앙값 · 제조사 US$0.70
내 하드웨어에서
비공개 가중치: 클라우드 전용.
점수 구성
C 종합 1,327 [1,321–1,334] 백분위 40 · #175 · 구성 요소: 9
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
135 ±1.37 | 1,320 ±11 | 29.6% | 2025-04-14 | — |
| LMArena |
text/overall
|
1,340 ±2.20 | 1,340 ±2 | 16.8% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1,349 ±2.88 | 1,348 ±3 | 16.7% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1,332 ±3.31 | 1,349 ±3 | 8.2% | 2026-10-02 | — |
| LMArena |
text/expert
|
1,338 ±6.62 | 1,344 ±5 | 7.6% | 2026-10-02 | — |
| Epoch AI |
simpleqa_verified
감쇠 ×0.61 |
0.13 ±0.01 | 1,337 ±3 | 4.4% | 2026-08-31 | — |
| LMArena |
text/multi_turn
|
1,354 ±3.88 | 1,357 ±4 | 4.1% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1,344 ±3.82 | 1,348 ±4 | 4.1% | 2026-10-02 | — |
| Epoch AI |
gpqa_diamond
감쇠 ×0.26 |
0.66 ±0.03 | 1,346 ±13 | 1.2% | 2025-04-14 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
C 코딩 1,337 [1,331–1,343] 백분위 38 · #172 · 구성 요소: 1 잠정
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1,367 ±3.83 | 1,352 ±3 | 90.1% | 2026-10-02 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
C 수학 1,328 [1,322–1,334] 백분위 38 · #158 · 구성 요소: 2
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1,343 ±5.67 | 1,338 ±5 | 48.2% | 2026-10-02 | — |
| Epoch AI |
frontiermath_t1_3
감쇠 ×0.86 |
0.07 ±0.01 | 1,336 ±3 | 45.0% | 2026-08-27 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
C 비전 1,355 [1,350–1,360] 백분위 30 · #79 · 구성 요소: 3 잠정
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1,181 ±3.81 | 1,368 ±3 | 63.9% | 2026-10-02 | — |
| LMArena |
vision/ocr
|
1,188 ±4.81 | 1,363 ±5 | 15.4% | 2026-10-02 | — |
| LMArena |
vision/diagram
|
1,182 ±6.95 | 1,359 ±6 | 14.4% | 2026-10-02 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
C 글쓰기 1,325 [1,319–1,331] 백분위 44 · #151 · 구성 요소: 2 잠정
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1,300 ±4.45 | 1,326 ±4 | 61.8% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1,344 ±3.82 | 1,348 ±4 | 31.9% | 2026-10-02 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
C 언어: 繁體中文 1,310 [1,301–1,319] 백분위 30 · #157 · 구성 요소: 1 잠정
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1,329 ±6.15 | 1,318 ±5 | 93.5% | 2026-10-02 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
C 언어: Deutsch 1,347 [1,332–1,361] 백분위 32 · #98 · 구성 요소: 1 잠정
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1,349 ±9.36 | 1,358 ±8 | 92.5% | 2026-10-02 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
C 언어: English 1,333 [1,327–1,338] 백분위 40 · #164 · 구성 요소: 1 잠정
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1,356 ±2.76 | 1,341 ±3 | 93.9% | 2026-10-02 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
D 언어: Español 1,314 [1,296–1,332] 백분위 13 · #130 · 구성 요소: 1 잠정
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1,320 ±11 | 1,324 ±10 | 91.8% | 2026-10-02 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
D 언어: Français 1,334 [1,313–1,355] 백분위 16 · #114 · 구성 요소: 1 잠정
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1,357 ±13 | 1,347 ±12 | 90.7% | 2026-10-02 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
C 언어: 日本語 1,335 [1,321–1,348] 백분위 25 · #96 · 구성 요소: 1 잠정
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1,291 ±10 | 1,345 ±8 | 92.8% | 2026-10-02 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
C 언어: 한국어 1,346 [1,331–1,361] 백분위 25 · #102 · 구성 요소: 1 잠정
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1,298 ±11 | 1,357 ±8 | 92.4% | 2026-10-02 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
D 언어: Polski 1,335 [1,326–1,345] 백분위 14 · #113 · 구성 요소: 1 잠정
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1,326 ±6.22 | 1,345 ±5 | 93.4% | 2026-10-02 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
C 언어: Русский 1,330 [1,321–1,338] 백분위 34 · #155 · 구성 요소: 1 잠정
| 소스 | 구성 요소 | 값 | Elo-eq | 가중치 | 측정일 | 변형 |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1,324 ±5.38 | 1,338 ±5 | 93.6% | 2026-10-02 | — |
가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론
추이
표로 보기
| 모델 | 2026-10 |
|---|---|
| GPT-4.1 Mini | 1,327 C |
배지
내 사이트나 README에 모델의 fedi-index를 표시하세요. 배지는 자동으로 업데이트되며 이 페이지로 연결됩니다.
데이터는 CC BY 4.0: fedi.software 링크를 유지해 주세요.