首页财经理财产业商业证券消费图片视频全国

科技

新浪微博图片视频手机站

旗下栏目：科技汽车房产工农

> 产业 > 科技 >

小米开源 Xiaomi MiMo-V2-Flash：高效推理、代码与 Agent 基座模

来源：作者：碧海醫心人气：发布时间：2025-12-17

摘要：小米正式开源XiaomiMiMo-V2-Flash——一款由小米自主研发、专为极致推理性能优化的MoE大模型，总参数量达309B（激活参数仅15B）。该模型创新性融合Hybrid注意力机制与多层级MTP推理加速技术，在多项Agent能力评测中稳居全球开源模型前两名；其代码生成能力超

小米正式开源 xiaomi mimo-v2-flash——一款由小米自主研发、专为极致推理性能优化的 moe 大模型，总参数量达 309b（激活参数仅 15b）。该模型创新性融合 hybrid 注意力机制与多层级 mtp 推理加速技术，在多项 agent 能力评测中稳居全球开源模型前两名；其代码生成能力超越所有现有开源模型，与顶级闭源模型 claude 4.5 sonnet 持平，而推理成本仅为后者的 2.5%，生成速度更提升至 2 倍，真正实现了大模型效果与效率的双重突破。

MiMo-V2-Flash 模型整体架构如下：

MiMo-V2-Flash 核心设计亮点：

混合注意力机制

采用比例为 5:1 的 Sliding Window Attention（SWA）与 Global Attention（GA）协同结构，滑动窗口大小设为 128，原生支持 32K 上下文，并在训练中扩展至 256K。大量前期实验表明，SWA 在通用性、长文本建模及推理稳定性方面全面优于主流 Linear Attention，同时具备固定尺寸的 KV Cache，极大简化了与现有训练与推理基础设施（Infra）的集成适配流程。

MTP 推理加速技术

通过 Multi-Token Prediction（MTP）方式强化基座模型能力，并在推理阶段实现多 Token 并行验证，有效缓解传统自回归解码在大 Batch 场景下的显存带宽瓶颈。实测数据显示：启用 3 层 MTP 后，接收长度提升 2.8～3.6 倍，端到端推理加速比达 2.0～2.6 倍。

综上，MiMo-V2-Flash 凭借模型结构与训推系统深度协同的创新设计，可在不同硬件平台上灵活调节 Batch Size 与 MTP 层数，充分释放 GPU 算力，兼顾高吞吐、低延迟与极致推理性能。

Andi

智能搜索助手，可以帮助解决详细的问题

下载

Xiaomi MiMo-V2-Flash 全量模型权重与推理代码均已开源。配套 API 当前限时免费开放，Web 版 Demo 已正式上线。

访问 platform.xiaomimimo.com，即可无缝接入 Claude Code、Cursor、Cline、Kilo Code 等主流开发框架。

立即前往 MiMo Studio Web 端：aistudio.xiaomimimo.com，免费体验模型能力。

源码地址：点击下载

责任编辑：碧海醫心

上一篇：《古墓丽影：催化剂》玩家无需做任何准备即可直接上手

下一篇：没有了

频道精选

中国150家企业入选！2025全球独角兽500强榜单发布2026-01-15 16:44:29
多家外资银行发布2026年经济展望普遍看好中国经济前2026-01-13 17:09:18
2026 年元旦大盘票房 3.29 亿，《疯狂动物城 2》获冠2026-01-03 00:00:00
陶冬：美联储新主席势必有大动作2025-12-08 11:56:00
2026年车险公司推荐选哪家？首选平安财险东方支公司2025-11-10 09:35:00

中国150家企业入选！2025全球独角兽500强榜单发布2026-01-15 16:44:29
平安财险教您怎么买车险2025-12-17 17:49:33
“央行中的央行”警告：黄金与股市走势趋同，可能是泡2025-12-09 08:17:24
平安车险东方支公司理赔服务介绍2025-12-03 16:23:00
2026年车险公司推荐选哪家？首选平安财险东方支公司2025-11-10 09:35:00

中国150家企业入选！2025全球独角兽500强榜单发布

中国150家企业入选！2025全球独角兽500强榜单发布

智慧家庭技术实测数据，海尔智慧家庭直播首次公开用户

智慧家庭技术实测数据，海尔智慧家庭直播首次公开用户

2026年车险公司推荐选哪家？首选平安财

2026年车险公司推荐选哪家？首选平安财...
浏览次数：19051次

陶冬：美联储新主席势必有大动作

浏览:234次

年内最后一个超级央行周！美联储或降息、重启购

浏览:232次

首批氢能区域试点披露增长目标，万亿氢能大市场

浏览:231次

马化腾超李彦宏成内地新首富净资产130亿美元

浏览:225次

安徽省商务厅厅长曹勇：合芜马自贸区力争上半年

浏览:224次

上世纪90年代来首次反直觉走势！美联储降息周期

浏览:224次

赵建：至少有四个时代红利不能辜负

浏览:224次

打造“青创第一城”，浦东全方位降低青年创新创

浏览:222次

科技股不再领涨美股？机构：AI在高速扩张中把“

浏览:216次

最火资讯

前11个月我国服务业发展持续向好
今年前11个月，我国服务业发展持续向好，服务消费潜力持续释放，对经济增长...
中国150家企业入选！2025全球独角兽500
统计数据显示，2025年全球独角兽企业500强总估值达39.14万亿元，同比增长超...
多家外资银行发布2026年经济展望普遍
近期，多家外资银行发布2026年经济展望报告及观点。综合来看，2026年，外资...
·济南山姆会员商店预计上半年开业
·九识智能携手中国邮政获广州市级首批无
·微信小店2026年货节激励计划启动报名
·阿里CEO吴泳铭：今年几场“大仗”都打
·携程旗下丽呈集团与易康生命达成战略合
·Royal Mail英国皇家邮政首批42吨电动重
·中国邮政集团2025年实现收入6770亿元
·中国货运航空开通重庆至布达佩斯全货机

首页 | 财经 | 理财 | 产业 | 商业 | 证券 | 消费 | 图片 | 视频 | 全国

Copyright 2025 九掌金融版权所有技术支持：政产学研(海南）投资有限公司备案号：琼ICP备2025065810号-1

电脑版 | 移动版