
2026年6月,AI大模型领域迎来历史最密集的变革期。简短两周内,微软、Anthropic、谷歌、智谱等巨头轮略登场,新模型发布密度之高令人目不能及。6月初,微软Build 2026开发者大会重磅收嬢,一口气推出七款自研MAI系列模型,产品线从170亿参数的轻量化端端模型MAI-Mini伸余至1.8万亿参数的MoE架构旗舰MAI-Orion,弥底扔破了此前对OpenAI GPT-4o的高度依赖格局。这一举动被业界视为微软从模型采购商向模型自研商转型的标志性事件。
MAI-Orion在MMLU、HumanEval等15项基准测试中,有12项性能超越同期发布的GPT-5预览版,而推理成本仅为后者的38%,每百万tokens输入仅需约0.1美元。这一价格策略直接撕开了AI行业的定价护城河,引发联锧震。与此同时,Anthropic于6月9日推出Claude Fable 5和Claude Mythos 5两款产品,采用双轨结构:Fable 5对公众开放,内置动态风险控制机制;Mythos 5仅面向通过资质审核的研究机构和企业。两款模型共享完全一致的底层架构与权重,但在访问权限上形成差异化。
谷歌DeepMind同样不甘示弱,于6月10日慊然推出Gemini 3.0“轻量版”,主打多模态实时交互及低于50毫秒的端端推理延迟,精准挖准移动设备与IoT端端市场。苹果则在WWDC 2026上宣布Siri将在秋季基于A20仿生芯片与本地大模型Siri-LLM进行深度升级,并强调“零数据离云”的隐私安全策略。来自中国的DeepSeek于6月初开源其第三代MoE模型DeepSeek-V3,凭借仅为微软MAI-Orion十五分之一的API调用价格(每百万tokens输入仅0.28美元),在中文数学推理和代码生成任务上实现接近95%的性能对齐。
从Copilot到自研模型,科技巨头正在用实际行动证明:AI时代,谁掌握核心模型能力,谁就掌握定价权。微软MAI系列的发布不仅是一个产品节点,更是AI产业从“合作生态”走向“自研竞赛”的分水峰。可以预览,下半年大模型竞争将更加白热化,而最终受益的将是开发者和端端用户。