FEATUREDr/LocalLLaMA· rssEN11:33 · 06·05
微软没出 Qwen3.6-27B 或 Gemma-4-31B 这种尺寸的模型,而是发了一组 MAI 系列
Reddit 上有人吐槽微软应该发类似 Qwen3.6-27B 或 Gemma-4-31B 这种中等体量的开源模型,结果他们放出来的是七个 MAI 模型。其中 MAI-Thinking-1 参数规模标的是 1T A35B,上下文窗口 256K;MAI-Code-1-Flash 是 137B A5B,同样 256K 窗口。帖子正文被网络策略挡了,看不到更...
#Reasoning#Code#Multimodal#Microsoft AI
精选理由
精选 · 重要度 82 · 吸引力 + 知识量 + 共鸣
一句话点评
微软发了七个 MAI 模型,但参数规格和实际可用性都还看不清,正文被挡了,先别急着对标 Qwen 或 Gemma。
锐评
这条吐槽的核心矛盾很直白:社区想要的是像 Qwen3.6-27B 或 Gemma-4-31B 这种中等体量、本地能跑的开源模型,微软拿出来的却是七个 MAI 系列模型,而且参数标注方式让人犯晕。MAI-Thinking-1 标着 1T A35B,MAI-Code-1-Flash 标着 137B A5B,都带 256K 上下文窗口。这种“总参数/激活参数”的写法本身没问题,但 1T 这个数字对本地部署来说基本等于劝退,跟社区期待的 27B-31B 量级完全不在一个赛道。
关键信息缺口很大。帖子正文被 Reddit 的网络策略挡了,我们看不到原帖对模型实际表现的描述,也不知道这些 MAI 模型是纯权重开源、只放 API 还是带技术报告。微软到底有没有做小体量版本、这些大模型在消费级硬件上能不能跑、推理成本多少,正文都没披露。所以现在只能看到参数数字,看不到落地可能。
对从业者来说,这条新闻的价值在于提醒你:微软确实在开源模型上出牌了,但这手牌目前打的是超大杯路线,不是社区呼声最高的中杯。如果后续没有 30B 上下的版本放出来,本地部署的人大概率还是会继续蹲 Qwen 和 Gemma 的更新。
HKR 分解
hook ✓knowledge ✓resonance ✓