跳到主要內容
fedi.software

比較 AI 模型

最多並列比較四個模型:各排行榜的等級與 Elo、價格、上下文視窗與發布日期。

更新日期 · 來源: models.dev

指標 Qwen3 Next 80B A3B Instruct Alibaba
文字 A 1,417 1,413–1,422
程式設計 A 1,440 1,432–1,449
輸入/輸出,每百萬 US$0.144 / US$0.574
上下文視窗 131K
最大輸出 33K
發布日期 2025年9月1日
知識截止日期 2025-04
授權 開放權重
輸入 文字
應用程式 —

比較頁面把最多 4 個模型排成並列的欄位,讓您在同一個畫面看出它們在評分、價格與技術規格上的差異,不必在各排行榜之間來回切換。

如何加入模型

  1. 在輸入框中開始輸入模型名稱,從清單中選取。
  2. 也可以在任何排行榜表格中,勾選想比較的模型旁的「比較」方塊。
  3. 選好後按「比較」;按「清除」可以重新開始。

比較表會顯示什麼

  • 模型在每一個有排名的排行榜上的等級與評分;
  • 各單位價格、上下文長度與最大輸出;
  • 模態,例如文字、圖片、音訊或影片;
  • 是否為開放權重,以及發佈日期。

怎麼解讀結果

評分請在同一個排行榜內比較。文字排行榜的 Elo 和代理排行榜的分數是不同尺度,即使出現在同一列,也不能直接比大小。空白欄位代表來源沒有這個模型的資料,而不是數值為零;某個排行榜沒有評分,表示模型沒有在那裡接受評比。

分享比較結果

含有已選模型的連結可以分享給同事。搜尋引擎只收錄沒有選擇模型的基本頁面,您的比較只會被收到連結的人看到。

什麼時候用得上

在 文字排行榜 或 程式設計排行榜 挑出幾個高等級候選模型後,常需要在較貴與較便宜的選項之間做決定。比較表能快速看出較高的評分是否值得較高的價格,以及便宜的模型上下文是否足夠。最後別忘了用自己的工作內容實測兩三個模型,親自比較回答。

來源:評分 LMArena;價格與技術資料 models.dev 與 LiteLLM。