Aller au contenu
fedi.software

amazon-nova-experimental-chat-26-02-10 dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

B 1 415 ±5

Percentile 77 · #69 · provisoire

Préféré par les humains / Résout des tâches

1 430 / —

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

—

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

B Général 1 415 [1 410–1 420] Percentile 77 · #69 · composantes : 6 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/overall 1 449 ±4,91 1 448 ±5 28,1% 2026-10-02 —
LMArena text/hard_prompts 1 458 ±6,38 1 447 ±6 27,1% 2026-10-02 —
LMArena text/instruction_following 1 426 ±9,11 1 438 ±9 11,7% 2026-10-02 —
LMArena text/expert 1 504 ±16 1 480 ±13 8,6% 2026-10-02 —
LMArena text/longer_query 1 440 ±9,05 1 438 ±8 5,9% 2026-10-02 —
LMArena text/multi_turn 1 442 ±12 1 437 ±11 5,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Code 1 424 [1 409–1 439] Percentile 81 · #53 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/coding 1 483 ±9,79 1 455 ±9 87,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Écriture 1 394 [1 379–1 410] Percentile 63 · #100 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 369 ±13 1 397 ±13 54,0% 2026-10-02 —
LMArena text/longer_query 1 440 ±9,05 1 438 ±8 36,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : 繁體中文 1 403 [1 381–1 426] Percentile 59 · #92 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 464 ±16 1 425 ±13 90,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

A Langue : English 1 430 [1 415–1 446] Percentile 84 · #46 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 458 ±7,99 1 449 ±8 92,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Русский 1 408 [1 388–1 428] Percentile 66 · #81 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 423 ±12 1 428 ±11 91,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
amazon-nova-experimental-chat-26-02-10 1 415 B

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: amazon-nova-experimental-chat-26-02-10

Données CC BY 4.0 : conservez le lien vers fedi.software.