跳到主要內容
fedi.software

2023 年的 AI 模型:誰發布了什麼

按月列出每一款重要模型的發布:廠商及其所在國家、開放或封閉權重、類型、上下文視窗、開放模型的規模,以及各年份模型目前在哪些任務上領先。

2023 9 款發布 · 5 款為開放權重

目前在各任務領先的 2023 年模型

十二月

  1. Mistral 7B Instruct v0.2 HFMistral AI法國開放權重LLM7.2B
  2. C mixtral-8x7b-instruct-v0.1Mistral AI法國開放權重LLM32K

十一月

  1. Qwen 72B HFAlibaba中國開放權重LLM72.3B
  2. D dall-e-3OpenAI美國封閉圖像
  3. C GPT 4OpenAI美國封閉LLM8K
  4. C GPT-4 TurboOpenAI美國封閉視覺 (VLM)128K

七月

  1. Llama 2 7b hf HFMeta美國開放權重LLM6.7B

三月

  1. C GPT-3.5 TurboOpenAI美國封閉LLM16K

二月

  1. pythia-6.9b HFEleutherAI美國開放權重LLM7B

發布日期來自模型目錄(models.dev、LiteLLM、Hugging Face);只知道發布年份的模型不會顯示。某一年的領先者,是指該年模型中目前在我們排行榜上名次最高的模型。

更新日期 · 來源: models.dev (MIT), LiteLLM (MIT), LMArena (CC BY 4.0), Hugging Face

Arena (LMArena) scores: Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (filtered, re-ranked, aggregated). Not endorsed by LMArena.

這條時間軸在呈現什麼?

它把各家 AI 實驗室的模型發布依時間排開:較新的年份在上方,每年再按月份分組。每一行是一個模型,列出開發商、總部所在國家、權重是否公開、模型類型與上下文長度。開放模型另外標出參數量;混合專家(MoE)模型的第二個數字,是每個 token 實際啟用的參數。

收錄條件是在我們的排行榜上有評分,或在 Hugging Face 公開了權重。轉售商、路由服務與社群微調版本不列入。

標籤怎麼看?

  • 「開放權重」(open weights):模型檔案可以下載,在自己的電腦上執行;需要多少記憶體,可到哪個開放模型適合您的硬體查詢。
  • 「封閉」:只能透過開發商的 App 或 API 使用。
  • LLM 是文字模型,「視覺 (VLM)」也能讀圖片;「推理」模型會先一步步思考再回答,單次回答較慢也較貴,但在數學、程式與規劃上更強。

封閉模型的開發商不公布參數量,所以那一欄留白,而不是用猜的。

每年上方那一排是什麼?

那是該年發布、如今在文字、程式設計、網頁開發、代理、圖片與影片排行榜上名列前茅的模型。這是用今天的眼光看那一年,而不是當時的排名:春天的模型到秋天可能已被超越。

還有哪些功能與限制?

可依開發商、國家、開放權重與類型篩選,也能搜尋名稱;每一年都有自己的頁面(年度版本)。發布日期取自 models.dev、LiteLLM 與 Hugging Face 等模型目錄,是模型出現在目錄上的日子,可能與官方宣布差幾天。只知道發布年份的模型不會顯示。國家指公司總部,不是資料中心或使用者所在地。