Siirry sisältöön
fedi.software

Vuoden 2023 tekoälymallit: kuka julkaisi mitä

Kaikki merkittävät mallijulkaisut kuukausi kuukaudelta: toimittaja ja sen maa, avoimet tai suljetut painot, tyyppi, kontekstiikkuna, avointen mallien koko — ja missä tehtävissä kunkin vuoden mallit johtavat nykyään.

2023 9 julkaisua · 5 avoimin painoin

Vuoden 2023 mallit, jotka johtavat nyt kutakin tehtävää

Joulukuu

  1. Mistral 7B Instruct v0.2 HFMistral AIRanskaAvoimet painotLLM7.2B
  2. C mixtral-8x7b-instruct-v0.1Mistral AIRanskaAvoimet painotLLM32K

Marraskuu

  1. Qwen 72B HFAlibabaKiinaAvoimet painotLLM72.3B
  2. D dall-e-3OpenAIYhdysvallatSuljettuKuva
  3. C GPT 4OpenAIYhdysvallatSuljettuLLM8K
  4. C GPT-4 TurboOpenAIYhdysvallatSuljettuNäkö (VLM)128K

Heinäkuu

  1. Llama 2 7b hf HFMetaYhdysvallatAvoimet painotLLM6.7B

Maaliskuu

  1. C GPT-3.5 TurboOpenAIYhdysvallatSuljettuLLM16K

Helmikuu

  1. pythia-6.9b HFEleutherAIYhdysvallatAvoimet painotLLM7B

Julkaisupäivät tulevat mallikatalogeista (models.dev, LiteLLM, Hugging Face); mallit, joista tiedetään vain julkaisuvuosi, eivät näy. Vuoden johtajat ovat sen vuoden malleja, jotka sijoittuvat nykyään korkeimmalle tulostauluillamme.

Päivitetty · Lähteet: models.dev (MIT), LiteLLM (MIT), LMArena (CC BY 4.0), Hugging Face

Arena (LMArena) scores: Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (filtered, re-ranked, aggregated). Not endorsed by LMArena.

Mitä aikajana näyttää

Kaavio asettaa mallijulkaisut yhdelle aikajanalle. Vuodet etenevät ylhäältä alas uudemmasta vanhempaan, ja vuoden sisällä julkaisut on ryhmitelty kuukausittain. Jokainen rivi on yksi malli: toimittaja, maa, jossa yhtiön pääkonttori sijaitsee, avoimet tai suljetut painot, tyyppi ja kontekstiikkuna. Avoimille malleille näytetään myös parametrien määrä. Asiantuntijoiden sekoitusta käyttävässä mallissa (MoE) toinen luku on aktiivinen osa eli parametrit, jotka todella osallistuvat jokaisen tokenin laskemiseen.

Mukaan pääsevät tekoälylaboratorioiden mallit, joilla on arvio tulostauluillamme tai joiden painot on julkaistu Hugging Facessa. Jälleenmyyjät, reitittimet ja yhteisön hienosäädöt jätetään pois, jotta luettelo kertoo, kuka mallin oikeasti rakensi.

Merkintöjen lukeminen

  • ”Avoimet painot” (open weights) – mallitiedostot voi ladata ja ajaa omalla koneella; mikä avoin malli sopii laitteistollesi kertoo, mitä se vaatii.
  • ”Suljettu” – mallia voi käyttää vain toimittajan sovelluksen tai API:n kautta.
  • LLM on tekstiä käsittelevä kielimalli, ”Näkö (VLM)” lukee myös kuvia, ja ”Päättely” tarkoittaa mallia, joka käy ongelman läpi vaihe vaiheelta ennen vastausta. Vastaus syntyy hitaammin ja maksaa enemmän, mutta matematiikassa, koodissa ja suunnittelussa tulos on vahvempi. Kuva-, video- ja äänigeneraattoreilla on omat merkintänsä.

Suljettujen mallien toimittajat eivät kerro parametrimääriä, joten kenttä jää niiden kohdalla tyhjäksi arvauksen sijaan.

Vuoden johtajat tämän päivän silmin

Jokaisen vuoden yläpuolella on kaistale, jossa näkyvät sen vuoden mallit, jotka johtavat nykyään tekstissä, ohjelmoinnissa, verkkokehityksessä, agenteissa, kuvissa ja videossa. Kyse on nykytilanteesta eikä siitä, miltä taulut silloin näyttivät: keväällä julkaistu malli voi jäädä jälkeen jo syksyllä, ja kaistale kertoo, miten sen sukupolvi pärjää nyt tulostauluilla LMArenan arvioiden mukaan.

Suodattimet ja vuosipainokset

Näkymää voi rajata toimittajan, maan, avointen painojen ja tyypin mukaan tai hakea nimellä. Jokaisella vuodella on myös oma sivunsa, vuosipainos, johon voi linkittää suoraan.

Lähteet ja varaukset

Julkaisupäivät ja kontekstit tulevat mallikatalogeista models.dev ja LiteLLM, parametrit ja lisenssit Hugging Facesta, ja toimittajien maat ylläpidämme itse. Päivä on se, jona malli ilmestyi katalogeihin, ja se voi poiketa julkistuksesta muutamalla päivällä. Malleja, joista lähteet kertovat vain vuoden, ei näytetä. Maa on pääkonttorin maa, ei datakeskusten tai käyttäjien.