Przejdź do treści
fedi.software

Porównaj modele AI

Zestaw obok siebie do czterech modeli: tier i Elo w każdym rankingu, ceny, okno kontekstu i data premiery.

Zaktualizowano · Źródła: models.dev

Wskaźnik Kimi K2.5 Moonshot AI
Tekst A 1 445 1 442–1 448
Programowanie S 1 483 1 469–1 496
Web dev B 1 436 1 431–1 441
Wejście / wyjście, za 1M 0,30 USD / 1,90 USD
Okno kontekstu 262K
Maks. wyjście 33K
Premiera 27 stycznia 2026
Granica wiedzy 2025-01
Licencja Otwarte wagi
Wejście tekst, obraz, wideo
Aplikacja —

Do czego służy porównanie

Strona porównania stawia obok siebie do 4 modeli AI w kolumnach. Dla każdego widzisz tier i ocenę w każdym rankingu, w którym model występuje, ceny za jednostkę, okno kontekstu, maksymalną długość odpowiedzi, modalności (tekst, obraz, dźwięk), oznaczenie otwartych wag i datę premiery. To szybki sposób, żeby sprawdzić, czy model z czołówki rankingu tekstowego równie dobrze wypada w programowaniu i ile trzeba za niego zapłacić.

Jak dodać modele

  1. Zacznij wpisywać nazwę modelu w polu wyboru i wskaż go z listy.
  2. Albo zaznacz pole „Porównaj” w dowolnej tabeli rankingu – model trafi do zestawienia.
  3. Dodaj co najmniej dwa modele, maksymalnie cztery.
  4. Przycisk „Wyczyść” usuwa wybór i pozwala zacząć od nowa.

Jak czytać zestawienie

  • Porównuj oceny w obrębie jednego rankingu. Elo z rankingu tekstowego i „Wynik” z rankingu agentów to różne skale – nie da się ich zestawić bezpośrednio.
  • Pusta komórka to brak danych w źródle dla tego modelu, a nie zero.
  • Cena i kontekst idą w parze: tańszy model z krótszym kontekstem może wyjść drożej, jeśli musisz dzielić zadania na wiele zapytań.

Skąd są dane

Oceny pochodzą z LMArena. Ceny, kontekst i modalności – z models.dev i LiteLLM. Dane odświeżamy codziennie, a przy tabelach rankingów widać datę aktualizacji.

Udostępnianie

Link do porównania z wybranymi modelami możesz wysłać komuś z zespołu. Wyszukiwarki indeksują tylko samą, pustą stronę porównania – zestawienia z wybranymi modelami służą do dzielenia się wynikiem.

Przykład użycia

Wybierasz model do czatu w sklepie internetowym? Dodaj dwa modele z górnego tieru rankingu tekstowego i jeden tańszy z tieru B. Sprawdź, jak duża jest różnica w cenie za 1M tokenów i czy tańszy model ma wystarczające okno kontekstu na opisy produktów. Często okazuje się, że do prostych pytań klientów droższy model nie jest potrzebny.