3090億參量硬剛Deepseek?小米發(fā)布MiMo大模型
姜維 / 2025-12-17 13:02110020近日,小米宣布推出自主研發(fā)的大模型MiMo-V2-Flash,它兼顧了模型能力與推理效率,能和用戶進行連續(xù)、自然對話處理復(fù)雜邏輯問題,能閱讀、總結(jié)長文本摘要,能主動實現(xiàn)多場景設(shè)備聯(lián)動并給用戶提供個性化端側(cè)智能服務(wù)。

據(jù)介紹,小米MiMo-V2-Flash大模型采用1:5的Global Attention與Sliding Window Attention (SWA) 混合結(jié)構(gòu),擁有3090億參數(shù)、150億激活參數(shù)量,其模型權(quán)重和推理代碼均采用MIT協(xié)議全面開源。

從官方放出的技術(shù)報告資料可以看到,小米MiMo-V2-Flash在數(shù)學(xué)推理、代碼生成和多輪對話場景中接近第一梯隊水平,如圖其73.4% SWE-Bench Verified編程能力已經(jīng)逼近GPT-5-High水平;在AIME 2025數(shù)學(xué)競賽、GPQA-Diamond科學(xué)知識測試等硬核場景中,它同樣躋身開源模型前列,與當(dāng)前市場主流的DeepSeek-V3.2差距并不明顯。

現(xiàn)階段,用戶可以通過Xiaomi MiMO Studio網(wǎng)頁進行在線AI聊天,它搭載的MiMo-V2-Flash大模型支持深度思考、聯(lián)網(wǎng)搜索選項,熱點科技實測常規(guī)問題思考回答僅需3.4s左右,給出的答案也基本符合事實邏輯。

開發(fā)者也可以便捷調(diào)用MiMo的API,快速為自己的應(yīng)用(尤其是小米生態(tài)內(nèi)的)注入頂尖的對話、生成、推理能力,無需從零開始訓(xùn)練大模型,這無疑會降低AI應(yīng)用開發(fā)門檻、成本,讓第三方開發(fā)商制造出體驗統(tǒng)一的AI原生應(yīng)用。
目前,AI大模型產(chǎn)業(yè)正在邁入“精耕細(xì)作”的規(guī)模化應(yīng)用階段,Gemini 3、GPT 5.1等國際巨頭憑借先發(fā)優(yōu)勢在核心技術(shù)和品牌認(rèn)知上領(lǐng)先,Deepseek、豆包、通義千問、文心一言等國產(chǎn)模型通過開源、成本控制全力突圍。此次小米MiMo-V2-Flash的上市能否憑借硬件生態(tài)優(yōu)勢走通差異化路徑,還需要時間驗證,不過感興趣的朋友可以在Xiaomi MiMO Studio網(wǎng)頁體驗,感受不同企業(yè)對AI的調(diào)度開發(fā)差異。
3090億參量硬剛Deepseek?小米發(fā)布MiMo大模型














滬公網(wǎng)安備 31010702005758號
發(fā)表評論注冊|登錄