Modelele de IA din 2023: cine ce a lansat
Fiecare lansare importantă de model, lună de lună: furnizorul și țara lui, ponderi deschise sau închise, tip, fereastră de context, dimensiunea modelelor deschise — și la ce sarcini conduc astăzi modelele fiecărui an.
2023 9 lansări · 5 cu ponderi deschise
- Text C GPT-4 TurboOpenAI
- Programare C GPT-4 TurboOpenAI
- Imagini D dall-e-3OpenAI
Decembrie
- Mistral 7B Instruct v0.2 HFMistral AIFranțaPonderi deschiseLLM7.2B
- C mixtral-8x7b-instruct-v0.1Mistral AIFranțaPonderi deschiseLLM32K
Noiembrie
- Qwen 72B HFAlibabaChinaPonderi deschiseLLM72.3B
- D dall-e-3OpenAIStatele Unite ale AmericiiÎnchisImagine
- C GPT 4OpenAIStatele Unite ale AmericiiÎnchisLLM8K
- C GPT-4 TurboOpenAIStatele Unite ale AmericiiÎnchisViziune (VLM)128K
Iulie
- Llama 2 7b hf HFMetaStatele Unite ale AmericiiPonderi deschiseLLM6.7B
Martie
- C GPT-3.5 TurboOpenAIStatele Unite ale AmericiiÎnchisLLM16K
Februarie
- pythia-6.9b HFEleutherAIStatele Unite ale AmericiiPonderi deschiseLLM7B
Datele de lansare provin din cataloagele de modele (models.dev, LiteLLM, Hugging Face); modelele cunoscute doar după anul lansării nu sunt afișate. Liderii unui an sunt modelele sale cu cel mai bun loc astăzi în clasamentele noastre.
Actualizat · Surse: models.dev (MIT), LiteLLM (MIT), LMArena (CC BY 4.0), Hugging Face
Arena (LMArena) scores: Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (filtered, re-ranked, aggregated). Not endorsed by LMArena.
Un calendar al lansărilor
Infograficul „Modele de IA pe ani: cine ce a lansat” așază lansările de modele pe o axă a timpului: sus anul curent, iar în interiorul fiecărui an, împărțirea pe luni. Fiecare rând este un model, cu dezvoltatorul, țara în care compania își are sediul, ponderile deschise sau închise, tipul și fereastra de context. La modelele deschise apare și numărul de parametri; la un model cu amestec de experți (MoE), al doilea număr arată partea activă, cea care lucrează efectiv la fiecare token.
Intră doar modelele laboratoarelor de AI: cele care au scor în clasamentele noastre sau ponderi publicate pe Hugging Face. Revânzătorii, routerele și ajustările făcute de comunitate rămân pe dinafară, ca lista să arate cine a creat de fapt fiecare model.
Cum citiți etichetele
- „Ponderi deschise” (open weights): fișierele modelului se pot descărca și rula pe propriul calculator. Câtă memorie este necesară aflați din ce model deschis încape pe hardware-ul dumneavoastră.
- „Închis”: modelul se folosește doar prin aplicația sau API-ul dezvoltatorului.
- „LLM” este un model de text, iar „Viziune (VLM)” înțelege și imagini. „Raționament” marchează modelele care descompun problema pas cu pas înainte de a răspunde: mai lente și mai scumpe per răspuns, dar mai solide la matematică, cod și planificare. Generatoarele de imagine, video și audio au etichete proprii.
Dezvoltatorii modelelor închise nu publică numărul de parametri, așa că la ei câmpul rămâne gol, în loc să conțină o presupunere.
Banda de deasupra fiecărui an
Deasupra fiecărui an se află o bandă cu modelele din acel an care conduc astăzi clasamentele de text, programare, dezvoltare web, agenți, imagine și video. Este o privire de azi, nu o reconstituire a clasamentelor de atunci: un model lansat primăvara poate să fi fost depășit încă din toamnă, iar banda arată cum se descurcă generația lui acum în clasamente.
Filtre, ediții și limite
Puteți restrânge afișarea după dezvoltator, țară, ponderi deschise și tip sau puteți căuta un model după nume. Fiecare an are și o pagină proprie, o ediție anuală la care se poate trimite un link. Datele de lansare provin din cataloagele models.dev și LiteLLM, parametrii și licențele de pe Hugging Face, scorurile modelelor din frunte de la LMArena, iar țara fiecărui dezvoltator este atribuită de fedi.software. O dată marchează ziua în care modelul a apărut în cataloage și poate diferi cu câteva zile de anunț. Modelele pentru care sursele dau doar anul nu sunt afișate. Țara este cea a sediului companiei, nu a centrelor de date sau a utilizatorilor.