본문으로 건너뛰기
fedi.software

fedi-index의 Step 3.5 Flash

분야별 점수와 그 구성, 가성비, 로컬 실행, 추이.

fedi-index · 종합

B 1,381 ±2

백분위 59 · #121 · 잠정

사람의 선호 / 문제 해결

1,392 / —

사람 투표와 벤치마크, Elo-eq

가성비

+50

100만 토큰당 US$0.15, 제공업체 11곳 중앙값 · 제조사 US$0.15

내 하드웨어에서

  • GPU 12 GB #25 · IQ2_S · 강한 압축 · ≈15 tok/s
  • GPU 24 GB #28 · Q2_K_L · 강한 압축 · ≈16 tok/s
  • Mac 64 GB #19 · IQ1_M · 강한 압축 · ≈45 tok/s
  • 통합 메모리 128 GB #8 · IQ4_XS · ≈17 tok/s

점수 구성

B 종합 1,381 [1,380–1,383] 백분위 59 · #121 · 구성 요소: 6 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/overall 1,403 ±1.80 1,403 ±2 25.6% 2026-10-02 —
LMArena text/hard_prompts 1,411 ±2.18 1,405 ±2 25.5% 2026-10-02 —
LMArena text/instruction_following 1,385 ±2.67 1,399 ±2 12.6% 2026-10-02 —
LMArena text/expert 1,422 ±4.31 1,412 ±4 12.3% 2026-10-02 —
LMArena text/longer_query 1,402 ±2.62 1,403 ±2 6.3% 2026-10-02 —
LMArena text/multi_turn 1,405 ±3.31 1,404 ±3 6.2% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 코딩 1,393 [1,388–1,398] 백분위 64 · #100 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/coding 1,436 ±2.89 1,413 ±3 90.3% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 수학 1,377 [1,368–1,386] 백분위 55 · #116 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/math 1,408 ±5.21 1,401 ±5 87.8% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 글쓰기 1,379 [1,375–1,384] 백분위 57 · #116 · 구성 요소: 2 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/creative_writing 1,357 ±3.43 1,385 ±4 62.0% 2026-10-02 —
LMArena text/longer_query 1,402 ±2.62 1,403 ±2 31.8% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 언어: 繁體中文 1,398 [1,390–1,405] 백분위 55 · #101 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/chinese 1,447 ±5.13 1,411 ±4 93.7% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 언어: Deutsch 1,391 [1,376–1,406] 백분위 51 · #71 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/german 1,404 ±9.58 1,406 ±8 92.5% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 언어: English 1,394 [1,389–1,399] 백분위 61 · #108 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/english 1,417 ±2.42 1,406 ±3 94.0% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

C 언어: Español 1,402 [1,390–1,413] 백분위 46 · #81 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/spanish 1,419 ±7.09 1,416 ±7 93.1% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

C 언어: Français 1,392 [1,380–1,405] 백분위 40 · #81 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/french 1,421 ±7.49 1,406 ±7 93.0% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

C 언어: 日本語 1,376 [1,360–1,393] 백분위 41 · #76 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/japanese 1,353 ±12 1,391 ±9 92.1% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

C 언어: 한국어 1,384 [1,370–1,397] 백분위 40 · #82 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/korean 1,351 ±9.65 1,398 ±7 92.8% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

C 언어: Polski 1,384 [1,371–1,397] 백분위 34 · #87 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/polish 1,389 ±8.27 1,398 ±7 92.9% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 언어: Русский 1,382 [1,376–1,388] 백분위 50 · #117 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/russian 1,385 ±3.70 1,393 ±3 93.8% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

추이

월별 fedi-index
표로 보기
모델 2026-10
Step 3.5 Flash 1,381 B

배지

내 사이트나 README에 모델의 fedi-index를 표시하세요. 배지는 자동으로 업데이트되며 이 페이지로 연결됩니다.

fedi-index: Step 3.5 Flash

데이터는 CC BY 4.0: fedi.software 링크를 유지해 주세요.