Porównaj modele AI
Zestaw obok siebie do czterech modeli: tier i Elo w każdym rankingu, ceny, okno kontekstu i data premiery.
Zaktualizowano · Źródła: models.dev
| Wskaźnik | claude-3-7-sonnet-20250219-thinking-32k Anthropic |
|---|---|
| Tekst | B 1 314 1 310–1 319 |
| Programowanie | B 1 361 1 353–1 369 |
| Wejście / wyjście, za 1M | 3 USD / 15 USD |
| Okno kontekstu | 200K |
| Maks. wyjście | 64K |
| Premiera | 19 lutego 2025 |
| Granica wiedzy | 2024-10 |
| Licencja | — |
| Wejście | tekst, obraz, plik |
| Aplikacja | — |
Do czego służy porównanie
Strona porównania stawia obok siebie do 4 modeli AI w kolumnach. Dla każdego widzisz tier i ocenę w każdym rankingu, w którym model występuje, ceny za jednostkę, okno kontekstu, maksymalną długość odpowiedzi, modalności (tekst, obraz, dźwięk), oznaczenie otwartych wag i datę premiery. To szybki sposób, żeby sprawdzić, czy model z czołówki rankingu tekstowego równie dobrze wypada w programowaniu i ile trzeba za niego zapłacić.
Jak dodać modele
- Zacznij wpisywać nazwę modelu w polu wyboru i wskaż go z listy.
- Albo zaznacz pole „Porównaj” w dowolnej tabeli rankingu – model trafi do zestawienia.
- Dodaj co najmniej dwa modele, maksymalnie cztery.
- Przycisk „Wyczyść” usuwa wybór i pozwala zacząć od nowa.
Jak czytać zestawienie
- Porównuj oceny w obrębie jednego rankingu. Elo z rankingu tekstowego i „Wynik” z rankingu agentów to różne skale – nie da się ich zestawić bezpośrednio.
- Pusta komórka to brak danych w źródle dla tego modelu, a nie zero.
- Cena i kontekst idą w parze: tańszy model z krótszym kontekstem może wyjść drożej, jeśli musisz dzielić zadania na wiele zapytań.
Skąd są dane
Oceny pochodzą z LMArena. Ceny, kontekst i modalności – z models.dev i LiteLLM. Dane odświeżamy codziennie, a przy tabelach rankingów widać datę aktualizacji.
Udostępnianie
Link do porównania z wybranymi modelami możesz wysłać komuś z zespołu. Wyszukiwarki indeksują tylko samą, pustą stronę porównania – zestawienia z wybranymi modelami służą do dzielenia się wynikiem.
Przykład użycia
Wybierasz model do czatu w sklepie internetowym? Dodaj dwa modele z górnego tieru rankingu tekstowego i jeden tańszy z tieru B. Sprawdź, jak duża jest różnica w cenie za 1M tokenów i czy tańszy model ma wystarczające okno kontekstu na opisy produktów. Często okazuje się, że do prostych pytań klientów droższy model nie jest potrzebny.