ข้ามไปยังเนื้อหา
fedi.software

DeepSeek V3.1 Terminus ใน fedi-index

คะแนนในทุกหมวด องค์ประกอบของคะแนน ความคุ้มค่า การรันบนเครื่อง และประวัติ

fedi-index · ภาพรวม

B 1,390 ±6

เปอร์เซ็นไทล์ 62 · #111 · เบื้องต้น

คนชอบ / แก้โจทย์

1,403 / —

โหวตจากผู้คนเทียบกับเบนช์มาร์ก, Elo-eq

ความคุ้มค่า

+31

US$0.4525 ต่อ 1M โทเค็น, ค่ามัธยฐานจาก 8 ผู้ให้บริการ

บนฮาร์ดแวร์ของคุณ

ไม่สามารถรันบนเครื่องอ้างอิงได้

รายละเอียดคะแนน

B ภาพรวม 1,390 [1,384–1,396] เปอร์เซ็นไทล์ 62 · #111 · องค์ประกอบ: 5 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/overall 1,420 ±5.16 1,420 ±5 32.1% 2026-10-02 thinking
LMArena text/hard_prompts 1,427 ±7.34 1,419 ±7 30.1% 2026-10-02 thinking
LMArena text/instruction_following 1,406 ±10 1,419 ±10 12.6% 2026-10-02 thinking
LMArena text/longer_query 1,425 ±11 1,424 ±11 6.0% 2026-10-02 thinking
LMArena text/multi_turn 1,411 ±12 1,409 ±11 5.7% 2026-10-02 thinking

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B เขียนโค้ด 1,377 [1,359–1,395] เปอร์เซ็นไทล์ 56 · #122 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/coding 1,426 ±12 1,404 ±11 86.5% 2026-10-02 thinking

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B งานเขียน 1,407 [1,390–1,424] เปอร์เซ็นไทล์ 67 · #88 · องค์ประกอบ: 2 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/creative_writing 1,404 ±14 1,432 ±14 55.2% 2026-10-02 —
LMArena text/longer_query 1,425 ±11 1,424 ±11 35.0% 2026-10-02 thinking

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B ภาษา: English 1,404 [1,389–1,418] เปอร์เซ็นไทล์ 64 · #98 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/english 1,430 ±7.80 1,420 ±8 92.5% 2026-10-02 thinking

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

ประวัติ

fedi-index รายเดือน
ดูแบบตาราง
โมเดล 2026-10
DeepSeek V3.1 Terminus 1,390 B

แบดจ์

แสดง fedi-index ของโมเดลบนเว็บไซต์หรือใน README ของคุณ แบดจ์อัปเดตอัตโนมัติและลิงก์มายังหน้านี้

fedi-index: DeepSeek V3.1 Terminus

ข้อมูลเป็น CC BY 4.0: โปรดคงลิงก์ไปยัง fedi.software