본문으로 건너뛰기
fedi.software

fedi-index의 DeepSeek V3.1 Terminus

분야별 점수와 그 구성, 가성비, 로컬 실행, 추이.

fedi-index · 종합

B 1,390 ±6

백분위 62 · #111 · 잠정

사람의 선호 / 문제 해결

1,403 / —

사람 투표와 벤치마크, Elo-eq

가성비

+31

100만 토큰당 US$0.4525, 제공업체 8곳 중앙값

내 하드웨어에서

기준 환경에 적재되지 않습니다.

점수 구성

B 종합 1,390 [1,384–1,396] 백분위 62 · #111 · 구성 요소: 5 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/overall 1,420 ±5.16 1,420 ±5 32.1% 2026-10-02 thinking
LMArena text/hard_prompts 1,427 ±7.34 1,419 ±7 30.1% 2026-10-02 thinking
LMArena text/instruction_following 1,406 ±10 1,419 ±10 12.6% 2026-10-02 thinking
LMArena text/longer_query 1,425 ±11 1,424 ±11 6.0% 2026-10-02 thinking
LMArena text/multi_turn 1,411 ±12 1,409 ±11 5.7% 2026-10-02 thinking

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 코딩 1,377 [1,359–1,395] 백분위 56 · #122 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/coding 1,426 ±12 1,404 ±11 86.5% 2026-10-02 thinking

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 글쓰기 1,407 [1,390–1,424] 백분위 67 · #88 · 구성 요소: 2 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/creative_writing 1,404 ±14 1,432 ±14 55.2% 2026-10-02 —
LMArena text/longer_query 1,425 ±11 1,424 ±11 35.0% 2026-10-02 thinking

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

B 언어: English 1,404 [1,389–1,418] 백분위 64 · #98 · 구성 요소: 1 잠정
소스 구성 요소 값 Elo-eq 가중치 측정일 변형
LMArena text/english 1,430 ±7.80 1,420 ±8 92.5% 2026-10-02 thinking

가중치는 점수에서 해당 구성 요소가 차지하는 비중입니다(나머지는 사전값으로, 데이터가 적은 모델을 모집단 중앙값 쪽으로 끌어당깁니다). 방법론

추이

월별 fedi-index
표로 보기
모델 2026-10
DeepSeek V3.1 Terminus 1,390 B

배지

내 사이트나 README에 모델의 fedi-index를 표시하세요. 배지는 자동으로 업데이트되며 이 페이지로 연결됩니다.

fedi-index: DeepSeek V3.1 Terminus

데이터는 CC BY 4.0: fedi.software 링크를 유지해 주세요.