2023 年的 AI 模型:誰發布了什麼
按月列出每一款重要模型的發布:廠商及其所在國家、開放或封閉權重、類型、上下文視窗、開放模型的規模,以及各年份模型目前在哪些任務上領先。
2023 9 款發布 · 5 款為開放權重
- 文字 C GPT-4 TurboOpenAI
- 程式設計 C GPT-4 TurboOpenAI
- 圖片 D dall-e-3OpenAI
十二月
- Mistral 7B Instruct v0.2 HFMistral AI法國開放權重LLM7.2B
- C mixtral-8x7b-instruct-v0.1Mistral AI法國開放權重LLM32K
十一月
- Qwen 72B HFAlibaba中國開放權重LLM72.3B
- D dall-e-3OpenAI美國封閉圖像
- C GPT 4OpenAI美國封閉LLM8K
- C GPT-4 TurboOpenAI美國封閉視覺 (VLM)128K
七月
- Llama 2 7b hf HFMeta美國開放權重LLM6.7B
三月
- C GPT-3.5 TurboOpenAI美國封閉LLM16K
二月
- pythia-6.9b HFEleutherAI美國開放權重LLM7B
發布日期來自模型目錄(models.dev、LiteLLM、Hugging Face);只知道發布年份的模型不會顯示。某一年的領先者,是指該年模型中目前在我們排行榜上名次最高的模型。
更新日期 · 來源: models.dev (MIT), LiteLLM (MIT), LMArena (CC BY 4.0), Hugging Face
Arena (LMArena) scores: Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (filtered, re-ranked, aggregated). Not endorsed by LMArena.
這條時間軸在呈現什麼?
它把各家 AI 實驗室的模型發布依時間排開:較新的年份在上方,每年再按月份分組。每一行是一個模型,列出開發商、總部所在國家、權重是否公開、模型類型與上下文長度。開放模型另外標出參數量;混合專家(MoE)模型的第二個數字,是每個 token 實際啟用的參數。
收錄條件是在我們的排行榜上有評分,或在 Hugging Face 公開了權重。轉售商、路由服務與社群微調版本不列入。
標籤怎麼看?
- 「開放權重」(open weights):模型檔案可以下載,在自己的電腦上執行;需要多少記憶體,可到哪個開放模型適合您的硬體查詢。
- 「封閉」:只能透過開發商的 App 或 API 使用。
- LLM 是文字模型,「視覺 (VLM)」也能讀圖片;「推理」模型會先一步步思考再回答,單次回答較慢也較貴,但在數學、程式與規劃上更強。
封閉模型的開發商不公布參數量,所以那一欄留白,而不是用猜的。
每年上方那一排是什麼?
那是該年發布、如今在文字、程式設計、網頁開發、代理、圖片與影片排行榜上名列前茅的模型。這是用今天的眼光看那一年,而不是當時的排名:春天的模型到秋天可能已被超越。
還有哪些功能與限制?
可依開發商、國家、開放權重與類型篩選,也能搜尋名稱;每一年都有自己的頁面(年度版本)。發布日期取自 models.dev、LiteLLM 與 Hugging Face 等模型目錄,是模型出現在目錄上的日子,可能與官方宣布差幾天。只知道發布年份的模型不會顯示。國家指公司總部,不是資料中心或使用者所在地。