Aller au contenu
fedi.software

Qwen3.7 Max dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

A 1 449 ±7

Percentile 90 · #29

Préféré par les humains / Résout des tâches

1 453 / 1 444

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

+39

3,75 $US par million de tokens, médiane de 27 fournisseurs · éditeur 3,75 $US

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

A Général 1 449 [1 442–1 456] Percentile 90 · #29 · composantes : 9
Source Composante Valeur Elo-eq Poids Mesuré le Variante
Epoch AI eci 154 ±1,06 1 467 ±8 35,7% 2026-05-19 —
LMArena text/overall 1 476 ±4,94 1 476 ±5 16,1% 2026-10-02 —
LMArena text/hard_prompts 1 483 ±6,02 1 469 ±5 15,8% 2026-10-02 —
LMArena text/instruction_following 1 460 ±8,32 1 470 ±8 7,0% 2026-10-02 —
LMArena text/expert 1 488 ±16 1 466 ±13 5,2% 2026-10-02 —
Epoch AI simpleqa_verified ancienneté ×0,61 0,56 ±0,02 1 472 ±5 4,3% 2026-08-27 —
LMArena text/longer_query 1 483 ±7,72 1 478 ±7 3,6% 2026-10-02 —
LMArena text/multi_turn 1 481 ±12 1 473 ±10 3,0% 2026-10-02 —
Epoch AI gpqa_diamond ancienneté ×0,26 0,91 ±0,02 1 463 ±10 1,5% 2026-08-07 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Code 1 438 [1 432–1 444] Percentile 88 · #33 · composantes : 3
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena webdev/overall 1 515 ±3,75 1 454 ±1 42,9% 2026-10-01 —
LMArena text/coding 1 497 ±9,16 1 468 ±8 33,2% 2026-10-02 —
Epoch AI swe_bench_verified ancienneté ×0,37 0,77 ±0,02 1 470 ±10 14,9% 2026-06-18 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Agents 1 409 [1 405–1 413] Percentile 30 · #41 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena agent/overall -0,05 ±0,00 1 431 ±2 90,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Maths 1 417 [1 408–1 426] Percentile 82 · #48 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
Epoch AI frontiermath_t1_3 ancienneté ×0,86 0,65 ±0,03 1 461 ±6 62,1% 2026-06-13 —
Epoch AI frontiermath_t4 ancienneté ×0,86 0,34 ±0,07 1 447 ±12 22,2% 2026-06-13 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Écriture 1 454 [1 439–1 469] Percentile 88 · #34 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 451 ±14 1 480 ±14 51,8% 2026-10-02 —
LMArena text/longer_query 1 483 ±7,72 1 478 ±7 39,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : 繁體中文 1 450 [1 426–1 475] Percentile 89 · #25 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 533 ±18 1 479 ±14 89,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : English 1 444 [1 430–1 457] Percentile 88 · #34 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 470 ±7,06 1 462 ±8 92,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : Русский 1 451 [1 426–1 476] Percentile 89 · #26 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 482 ±16 1 480 ±14 89,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
Qwen3.7 Max 1 449 A

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: Qwen3.7 Max

Données CC BY 4.0 : conservez le lien vers fedi.software.