본문으로 건너뛰기
fedi.software

fedi-index의 mistral-7b-instruct

분야별 점수와 그 구성, 가성비, 로컬 실행, 추이.

fedi-index · 종합

D 1,054 ±6

백분위 5 · #279 · 잠정

사람의 선호 / 문제 해결

1,043 / —

사람 투표와 벤치마크, Elo-eq

가성비

-274

100만 토큰당 US$0.1263, 제공업체 2곳 중앙값

내 하드웨어에서

비공개 가중치: 클라우드 전용.

점수 구성

D 종합 1,054 [1,048–1,059] 백분위 5 · #279 · 구성 요소: 5 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/overall 1,023 ±4.67 1,024 ±5 31.9% 2026-10-02 —
LMArena text/hard_prompts 1,002 ±7.71 1,035 ±7 28.8% 2026-10-02 —
LMArena text/instruction_following 1,003 ±6.89 1,037 ±6 14.7% 2026-10-02 —
LMArena text/multi_turn 1,008 ±9.81 1,043 ±9 6.5% 2026-10-02 —
LMArena text/longer_query 1,001 ±14 1,028 ±13 5.1% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

D 코딩 1,061 [1,046–1,076] 백분위 5 · #264 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/coding 1,018 ±9.92 1,041 ±9 87.7% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

D 수학 1,060 [1,045–1,076] 백분위 6 · #241 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/math 1,027 ±9.56 1,036 ±9 85.3% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

D 글쓰기 1,056 [1,043–1,069] 백분위 6 · #252 · 구성 요소: 2 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/creative_writing 1,028 ±8.61 1,049 ±9 65.8% 2026-10-02 —
LMArena text/longer_query 1,001 ±14 1,028 ±13 25.9% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

D 언어: English 1,039 [1,029–1,049] 백분위 5 · #260 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/english 1,059 ±5.16 1,028 ±5 93.4% 2026-10-02 —

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

추이

월별 fedi-index
표로 보기
모델 2026-10
mistral-7b-instruct 1,054 D

배지

내 사이트나 README에 모델의 fedi-index를 표시하세요. 배지는 자동으로 업데이트되며 이 페이지로 연결됩니다.

fedi-index: mistral-7b-instruct

데이터는 CC BY 4.0: fedi.software 링크를 유지해 주세요.