Mistral Large 4 預覽版登場:1 兆參數開放權重模型,月底可下載
法國 AI 公司 Mistral 在台灣時間 2026 年 10 月 7 日(美國時間 10 月 6 日)發表了 Mistral Large 4,官方暱稱「le Chonk」。目前是公開預覽版,開發者可以先在 Mistral Studio 透過 API 試用。官方也說模型權重會在本月底釋出,屆時任何人都能下載、在自己的機器上執行。
它是什麼?
簡單說,這是 Mistral 到目前為止最大、能力最強的模型:
- 規模:總參數約 1 兆。它採用「混合專家」(MoE)架構,每次回答只會動用其中一小部分參數,所以實際運算量比總規模小得多。發表文用的數字是啟用 490 億參數,官方文件則寫 1.05 兆總參數、520 億啟用參數。
- 能看圖:原生多模態,可以讀文件、圖表和照片,另外搭配一個 16 億參數的視覺模組。
- 能讀很長的內容:官方文件標示的上下文長度(context)是 1M,也就是一次大約能處理 100 萬個 token。
- 多語言:官方說訓練資料涵蓋 160 多種語言,包含歐盟所有官方語言。
強在哪裡?
Mistral 主打幾個方向,以下數字都來自官方自己公布的測試:
- 寫程式與 AI 代理:在 DeepSWE v1.1 拿到 61.7%,能理解整個程式庫,也能在終端機裡執行多步驟工作。
- 資安:官方說它在獨立評測 Artificial Analysis Cyber Index 中排進全球前五。有一項「重現真實漏洞再修補」的測試,它拿到 82%。官方指出,有些封閉模型在這項測試幾乎是零分,因為它們直接拒絕執行。
- 看圖定位:在密集場景的物件定位測試中,官方說它甚至略勝部分頂級封閉模型。
- 專業文書:能建立、修改和修正複雜的試算表與文件,官方說在法律、財務類評測表現出色。
要注意的是,這些都是廠商自己挑選、公布的成績。實際好不好用,還是得等更多第三方測試和使用者回饋。
「歐洲製造」為什麼是重點?
Mistral 強調,Large 4 是在自家位於歐洲的資料中心,用 3,800 張 NVIDIA Grace Blackwell GPU 從零開始訓練的,預覽版也跑在同一套設備上。官方還會提供一個完全由 Mistral 營運、受歐洲法律管轄的部署選項。
對重視「資料主權」的歐洲政府和企業來說,這代表不必依賴美國或中國的雲端業者。再加上權重開放,企業可以把模型裝在自己的私有雲或機房裡,資料不必送出去。
現在可以怎麼用?
- 開發者:現在就能在 Mistral Studio 用 API 試用。官方文件列出支援結構化輸出、函式呼叫、文件問答、批次處理、Agents 等功能。文件上的預覽價格是每百萬輸入 token 0.68 美元、輸出 2.09 美元(原價標示為 1.36 和 4.18 美元)。
- 想自己架設的人或企業:等月底權重釋出。官方說屆時也會公布更多架構細節、測試成績和訓練方法。要注意的是,這種規模的模型需要大量高階 GPU 才跑得動。
接下來呢?
官方說模型仍在快速改進中。Large 4 也會成為下一代 Mistral 專用模型的基礎。月底權重釋出時,就能看出它在開源模型裡到底排在哪個位置。