본문으로 건너뛰기
fedi.software

fedi-index의 Gemini 2.5 Pro

분야별 점수와 그 구성, 가성비, 로컬 실행, 추이.

fedi-index · 종합

B 1,413 ±5

백분위 76 · #71

사람의 선호 / 문제 해결

1,433 / 1,387

사람 투표와 벤치마크, Elo-eq

가성비

+5

100만 토큰당 US$3.44, 제공업체 28곳 중앙값 · 제조사 US$3.44

내 하드웨어에서

비공개 가중치: 클라우드 전용.

점수 구성

B 종합 1,413 [1,408–1,418] 백분위 76 · #71 · 구성 요소: 8
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
Epoch AI eci 145 ±0.77 1,401 ±6 39.3% 2025-06-05 —
LMArena text/overall 1,458 ±1.24 1,458 ±1 15.1% 2026-10-02 —
LMArena text/hard_prompts 1,455 ±1.59 1,444 ±1 15.1% 2026-10-02 —
LMArena text/instruction_following 1,436 ±1.95 1,447 ±2 7.5% 2026-10-02 —
LMArena text/expert 1,452 ±3.46 1,437 ±3 7.4% 2026-10-02 —
LMArena text/longer_query 1,449 ±2.00 1,446 ±2 3.8% 2026-10-02 —
LMArena text/multi_turn 1,453 ±2.39 1,447 ±2 3.7% 2026-10-02 —
Epoch AI gpqa_diamond 감쇠 ×0.26 0.85 ±0.02 1,436 ±10 1.4% 2025-11-16 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 코딩 1,367 [1,363–1,372] 백분위 52 · #135 · 구성 요소: 3
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena webdev/overall 1,227 ±8.07 1,372 ±2 49.2% 2026-10-01 —
LMArena text/coding 이상치 1,452 ±2.15 1,427 ±2 24.8% 2026-10-02 —
Epoch AI swe_bench_verified 감쇠 ×0.37 0.58 ±0.02 1,368 ±12 15.6% 2026-02-13 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

D 에이전트 1,392 [1,382–1,401] 백분위 10 · #52 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
τ²-bench (Sierra) tau2/banking_knowledge 감쇠 ×0.76 0.14 ±0.03 1,436 ±6 80.9% 2026-05-05 high

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 수학 1,400 [1,395–1,404] 백분위 70 · #76 · 구성 요소: 3
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/math 1,450 ±3.52 1,441 ±3 50.9% 2026-10-02 —
Epoch AI frontiermath_t1_3 감쇠 ×0.86 0.25 ±0.03 1,374 ±6 27.1% 2026-06-11 —
Epoch AI frontiermath_t4 감쇠 ×0.86 0.00 ±0.00 1,393 ±0 15.4% 2026-06-11 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 비전 1,427 [1,424–1,430] 백분위 63 · #42 · 구성 요소: 3 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena vision/overall 1,263 ±2.32 1,442 ±2 63.0% 2026-10-02 —
LMArena vision/ocr 1,270 ±2.44 1,443 ±2 15.7% 2026-10-02 —
LMArena vision/diagram 1,274 ±3.58 1,440 ±3 15.4% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

A 글쓰기 1,455 [1,451–1,458] 백분위 88 · #33 · 구성 요소: 2 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/creative_writing 1,454 ±2.59 1,483 ±3 62.3% 2026-10-02 —
LMArena text/longer_query 1,449 ±2.00 1,446 ±2 31.6% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

A 언어: 繁體中文 1,444 [1,439–1,449] 백분위 86 · #33 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/chinese 1,508 ±3.41 1,459 ±3 93.9% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

A 언어: Deutsch 1,458 [1,448–1,469] 백분위 95 · #8 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/german 1,486 ±6.41 1,477 ±6 93.4% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

A 언어: English 1,435 [1,431–1,438] 백분위 86 · #40 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/english 1,458 ±1.69 1,449 ±2 94.0% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

A 언어: Español 1,450 [1,440–1,459] 백분위 93 · #12 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/spanish 1,474 ±5.66 1,467 ±5 93.4% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 언어: Français 1,436 [1,424–1,447] 백분위 78 · #30 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/french 1,472 ±6.81 1,453 ±6 93.2% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

A 언어: 日本語 1,455 [1,444–1,465] 백분위 88 · #16 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/japanese 1,462 ±7.52 1,473 ±6 93.4% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

A 언어: 한국어 1,444 [1,435–1,454] 백분위 88 · #17 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/korean 1,434 ±6.66 1,461 ±5 93.5% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

A 언어: Polski 1,457 [1,451–1,464] 백분위 91 · #13 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/polish 1,479 ±4.29 1,474 ±4 93.8% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

A 언어: Русский 1,446 [1,441–1,450] 백분위 87 · #31 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/russian 1,461 ±2.88 1,461 ±3 94.0% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

추이

월별 fedi-index
표로 보기
모델 2026-10
Gemini 2.5 Pro 1,413 B

배지

내 사이트나 README에 모델의 fedi-index를 표시하세요. 배지는 자동으로 업데이트되며 이 페이지로 연결됩니다.

fedi-index: Gemini 2.5 Pro

데이터는 CC BY 4.0: fedi.software 링크를 유지해 주세요.