claude-opus-4-20250514-thinking-16k ใน fedi-index
คะแนนในทุกหมวด องค์ประกอบของคะแนน ความคุ้มค่า การรันบนเครื่อง และประวัติ
fedi-index · ภาพรวม
B 1,374 ±6
เปอร์เซ็นไทล์ 55 · #132
คนชอบ / แก้โจทย์
1,381 / 1,365
โหวตจากผู้คนเทียบกับเบนช์มาร์ก, Elo-eq
ความคุ้มค่า
-86
US$30 ต่อ 1M โทเค็น, ค่ามัธยฐานจาก 9 ผู้ให้บริการ
บนฮาร์ดแวร์ของคุณ
น้ำหนักแบบปิด: ใช้ได้บนคลาวด์เท่านั้น
รายละเอียดคะแนน
B ภาพรวม 1,374 [1,368–1,381] เปอร์เซ็นไทล์ 55 · #132 · องค์ประกอบ: 8
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
143 ±1.08 | 1,380 ±8 | 37.2% | 2025-05-22 | — |
| LMArena |
text/overall
|
1,377 ±2.27 | 1,377 ±2 | 16.0% | 2026-10-02 | thinking-16k |
| LMArena |
text/hard_prompts
|
1,399 ±2.89 | 1,394 ±3 | 15.9% | 2026-10-02 | thinking-16k |
| LMArena |
text/instruction_following
|
1,406 ±3.52 | 1,419 ±3 | 7.8% | 2026-10-02 | thinking-16k |
| LMArena |
text/expert
|
1,384 ±7.33 | 1,381 ±6 | 7.1% | 2026-10-02 | thinking-16k |
| LMArena |
text/longer_query
|
1,422 ±3.91 | 1,421 ±4 | 3.9% | 2026-10-02 | thinking-16k |
| LMArena |
text/multi_turn
|
1,396 ±4.19 | 1,395 ±4 | 3.8% | 2026-10-02 | thinking-16k |
| Epoch AI |
gpqa_diamond
ลดทอน ×0.26 |
0.76 ±0.03 | 1,394 ±14 | 1.2% | 2025-05-22 | 16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
B เขียนโค้ด 1,402 [1,396–1,408] เปอร์เซ็นไทล์ 69 · #88 · องค์ประกอบ: 2
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1,442 ±4.01 | 1,418 ±4 | 77.9% | 2026-10-02 | thinking-16k |
| Epoch AI |
swe_bench_verified
ลดทอน ×0.37 |
0.71 ±0.02 | 1,436 ±11 | 13.5% | 2026-02-06 | — |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
C คณิตศาสตร์ 1,361 [1,351–1,372] เปอร์เซ็นไทล์ 49 · #131 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1,391 ±6.29 | 1,384 ±6 | 87.3% | 2026-10-02 | thinking-16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
C ภาพ 1,363 [1,352–1,375] เปอร์เซ็นไทล์ 34 · #75 · องค์ประกอบ: 2 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1,192 ±8.15 | 1,377 ±7 | 76.1% | 2026-10-02 | thinking-16k |
| LMArena |
vision/ocr
|
1,197 ±10 | 1,372 ±10 | 16.5% | 2026-10-02 | thinking-16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
B งานเขียน 1,403 [1,397–1,409] เปอร์เซ็นไทล์ 65 · #94 · องค์ประกอบ: 2 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1,386 ±4.76 | 1,414 ±5 | 61.5% | 2026-10-02 | thinking-16k |
| LMArena |
text/longer_query
|
1,422 ±3.91 | 1,421 ±4 | 32.1% | 2026-10-02 | thinking-16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
C ภาษา: 繁體中文 1,353 [1,343–1,362] เปอร์เซ็นไทล์ 39 · #136 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1,386 ±6.31 | 1,363 ±5 | 93.5% | 2026-10-02 | thinking-16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
C ภาษา: Deutsch 1,379 [1,363–1,395] เปอร์เซ็นไทล์ 45 · #80 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1,390 ±10 | 1,394 ±9 | 92.3% | 2026-10-02 | thinking-16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
B ภาษา: English 1,362 [1,356–1,368] เปอร์เซ็นไทล์ 52 · #133 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1,385 ±2.94 | 1,373 ±3 | 93.9% | 2026-10-02 | thinking-16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
C ภาษา: Español 1,373 [1,355–1,390] เปอร์เซ็นไทล์ 30 · #104 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1,388 ±10 | 1,388 ±10 | 91.9% | 2026-10-02 | thinking-16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
D ภาษา: Français 1,344 [1,321–1,366] เปอร์เซ็นไทล์ 22 · #105 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1,369 ±14 | 1,359 ±13 | 90.4% | 2026-10-02 | thinking-16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
C ภาษา: 日本語 1,363 [1,348–1,378] เปอร์เซ็นไทล์ 35 · #84 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1,332 ±11 | 1,376 ±8 | 92.4% | 2026-10-02 | thinking-16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
C ภาษา: 한국어 1,360 [1,344–1,375] เปอร์เซ็นไทล์ 32 · #93 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1,317 ±11 | 1,372 ±9 | 92.3% | 2026-10-02 | thinking-16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
D ภาษา: Polski 1,359 [1,350–1,368] เปอร์เซ็นไทล์ 21 · #104 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1,356 ±5.57 | 1,370 ±5 | 93.6% | 2026-10-02 | thinking-16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
B ภาษา: Русский 1,387 [1,377–1,396] เปอร์เซ็นไทล์ 54 · #109 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1,392 ±5.88 | 1,400 ±5 | 93.4% | 2026-10-02 | thinking-16k |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
ประวัติ
ดูแบบตาราง
| โมเดล | 2026-10 |
|---|---|
| claude-opus-4-20250514-thinking-16k | 1,374 B |
แบดจ์
แสดง fedi-index ของโมเดลบนเว็บไซต์หรือใน README ของคุณ แบดจ์อัปเดตอัตโนมัติและลิงก์มายังหน้านี้
ข้อมูลเป็น CC BY 4.0: โปรดคงลิงก์ไปยัง fedi.software