Modele AI z roku 2023: kto co wydał
Każde istotne wydanie modelu miesiąc po miesiącu: dostawca i jego kraj, otwarte lub zamknięte wagi, typ, okno kontekstu, rozmiar modeli otwartych — oraz w jakich zadaniach modele z danego roku prowadzą dziś.
2023 9 wydań · 5 z otwartymi wagami
- Tekst C GPT-4 TurboOpenAI
- Programowanie C GPT-4 TurboOpenAI
- Obrazy D dall-e-3OpenAI
Grudzień
- Mistral 7B Instruct v0.2 HFMistral AIFrancjaOtwarte wagiLLM7.2B
- C mixtral-8x7b-instruct-v0.1Mistral AIFrancjaOtwarte wagiLLM32K
Listopad
- Qwen 72B HFAlibabaChinyOtwarte wagiLLM72.3B
- D dall-e-3OpenAIStany ZjednoczoneZamkniętyObraz
- C GPT 4OpenAIStany ZjednoczoneZamkniętyLLM8K
- C GPT-4 TurboOpenAIStany ZjednoczoneZamkniętyWizja (VLM)128K
Lipiec
- Llama 2 7b hf HFMetaStany ZjednoczoneOtwarte wagiLLM6.7B
Marzec
- C GPT-3.5 TurboOpenAIStany ZjednoczoneZamkniętyLLM16K
Luty
- pythia-6.9b HFEleutherAIStany ZjednoczoneOtwarte wagiLLM7B
Daty wydania pochodzą z katalogów modeli (models.dev, LiteLLM, Hugging Face); modele znane tylko z roku wydania nie są pokazywane. Liderami roku są jego modele, które zajmują dziś najwyższe miejsca w naszych rankingach.
Zaktualizowano · Źródła: models.dev (MIT), LiteLLM (MIT), LMArena (CC BY 4.0), Hugging Face
Arena (LMArena) scores: Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (filtered, re-ranked, aggregated). Not endorsed by LMArena.
Kalendarz premier modeli AI
Ten wykres układa wydania modeli na jednej osi czasu. Lata biegną od góry, od nowszych do starszych, a w obrębie roku premiery są pogrupowane według miesięcy. Każdy wiersz to jeden model: dostawca, kraj, w którym firma ma siedzibę, otwarte lub zamknięte wagi, typ i okno kontekstu. Przy modelach otwartych widać też liczbę parametrów, a w przypadku modelu z mieszanką ekspertów (MoE) druga liczba oznacza część aktywną, czyli parametry, które faktycznie pracują przy każdym tokenie.
Na osi trafiają modele laboratoriów AI, które mają ocenę w naszych rankingach albo opublikowały wagi na Hugging Face. Pośredników, routery i amatorskie dostrojenia pomijamy, żeby lista pokazywała, kto naprawdę zbudował dany model.
Jak czytać oznaczenia
- „Otwarte wagi” (open weights) – pliki modelu można pobrać i uruchomić na własnym komputerze; który otwarty model pasuje do twojego sprzętu pokazuje, czego to wymaga.
- „Zamknięty” – z modelu można korzystać tylko przez aplikację lub API dostawcy.
- LLM to model językowy do tekstu, „Wizja (VLM)” czyta także obrazy, a „Rozumowanie” oznacza model, który przed odpowiedzią rozkłada problem na kroki. Odpowiedź przychodzi wolniej i kosztuje więcej, ale w matematyce, kodzie i planowaniu wypada mocniej. Generatory obrazu, wideo i dźwięku mają własne oznaczenia.
Dostawcy modeli zamkniętych nie podają liczby parametrów, dlatego to pole zostaje u nich puste, zamiast wypełniać je zgadywaniem.
Kto prowadzi w danym roku – patrząc z dzisiaj
Nad każdym rokiem znajduje się pasek z modelami z tego roku, które dziś prowadzą w tekście, programowaniu, tworzeniu stron, agentach, obrazie i wideo. To spojrzenie z dzisiejszego punktu widzenia, a nie odtworzenie ówczesnych rankingów: model wydany wiosną mógł zostać wyprzedzony już jesienią, a pasek pokazuje, jak jego pokolenie radzi sobie teraz w rankingach według ocen LMArena.
Filtry i edycje roczne
Widok można zawęzić do dostawcy, kraju, otwartych wag i typu albo wyszukać model po nazwie. Każdy rok ma też własną stronę – edycję roczną, do której da się linkować bezpośrednio.
Źródła i zastrzeżenia
Daty wydania i kontekst pochodzą z katalogów modeli models.dev i LiteLLM, parametry i licencje – z Hugging Face, a kraje dostawców prowadzimy sami. Data to dzień, w którym model pojawił się w katalogach, i może się o kilka dni różnić od zapowiedzi. Modeli, dla których źródła podają tylko rok, nie pokazujemy. Kraj oznacza siedzibę firmy, a nie lokalizację centrów danych czy użytkowników.