精選模型比較

Gemini 3.5 Flash 與 Grok 4.5

先比較兩個目前候選,再以真實工作驗證速度、成本與品質。 使用準確的官方模型 ID,比較公開資料、服務商入口與單獨標示的模型系列說明。

更新日期:

公開資料比較

每項資料保留原始來源與量尺。缺漏資料不按 0 處理,OpenGPT 也不會產生一個綜合贏家。

Gemini 3.5 Flash 與 Grok 4.5
排名角度Gemini 3.5 FlashGrok 4.5
使用者偏好排名 17公開數值: 1476來源: LMArena排名 33公開數值: 1468來源: LMArena
綜合能力指數暫無對應的可比較資料排名 7公開數值: 54來源: Artificial Analysis
客觀工作暫無對應的可比較資料排名 9公開數值: 76.3來源: LiveBench
單次成功工作成本排名 9公開數值: $0.249來源: LiveBench排名 1公開數值: $0.128來源: LiveBench
開放權重模型暫無對應的可比較資料暫無對應的可比較資料

本頁面整理已發布的第三方資料,OpenGPT 沒有重新執行這些評測。

需要驗證什麼

以下優勢與限制來自模型系列的官方定位,不是這個具體版本的實測結果。

Google

Gemini 3.5 Flash

gemini-3.5-flash

系列優勢

提供涵蓋多種輸入類型的原生多模態選項。 可整合 Google 的託管 AI 與開發生態。

系列限制

旗艦託管模型權重不開放。 功能、上下文與可用性會隨版本和介面變化。

模型詳情官方入口
xAI

Grok 4.5

grok-4.5

系列優勢

託管模型包含工具與即時資訊路徑。 提供通用、推理、程式設計與多模態選項。

系列限制

權重不公開,資料與工具存取由服務商控制。 實際效果取決於具體模型和啟用的工具。

模型詳情官方入口

繼續完成選擇

在互動式比較中加入更多模型,再以自己的提示詞與條件驗證最後兩個候選。