2026年7月,全球大模型竞争进入白热化阶段。继OpenAI发布GPT-5.6搅动行业格局之后,国内厂商接连出招:大模型军备竞赛正从「参数攀比」转向「能力落地」的全新阶段。这场竞争不仅关乎技术领先,更牵动着资本市场走向和产业应用格局。

7月6日,腾讯混元团队正式发布Hy3大模型,采用MoE架构,总参数295B、激活参数21B,配备3.8B多令牌预测层,支持256K超长上下文。该模型最引以为傲的是其幻觉率从上一代的12.5%大幅降至5.4%,多轮问题率从17.4%降至7.9%,WorkBuddy办公场景任务解决率从72%提升至90%,平均耗时缩短34%。开源协议采用Apache 2.0,输入定价仅1元/百万Token、输出4元/百万Token,真正做到高性能与低价格兼得。发布一周后,Hy3总调用量较上一代增长超过68倍,在全球最大API聚合平台OpenRouter上登顶全球榜首。
月之暗面同样不甘示弱。7月15日,港股市场传出重磅消息:月之暗面已向投资人发送上市议案,最快六个月内完成港股上市。该公司今年6月ARR达到3亿美元,新模型Kimi K3在综合能力上全面超越竞争对手,其年度经常性收入在3个月内翻了3倍。更令人瞩目的是,Kimi K3参数规模达2.8万亿,是目前全球参数最大的开源模型,标志着国产模型发展迈出新步伐。
阿里通义实验室则选择了语音推理赛道作为突破口。7月15日悄然发布的Qwen-Audio-3.0-Realtime模型,在第三方权威评测平台Artificial Analysis的Speech Reasoning子项中综合排名全球第一,超越了OpenAI的GPT-Realtime-2。这一突破意味着语音交互正在从简单的「对话」进化到「任务执行」的新阶段。
与此同时,2026世界人工智能大会期间,昆仑万维董事长方汉正式宣布2026年为「世界模型元年」,标志着AI从内容生成走向对物理世界理解与交互的关键转折。多位行业人士指出,当前大模型竞争焦点已从「参数有多大」转变为「能否理解世界如何运转」,以Next-State Prediction(NSP)为代表的新范式正推动AI从数字空间的感知迈向物理世界的认知与规划。
整体来看,2026年的大模型竞争呈现三大趋势:一是开源与商业化并行,国产模型在全球周调用量占比已稳定在65%以上,约为美国模型的1.8至2.6倍;二是垂直场景深度优化成为竞争新焦点,办公、编程、医疗等专业场景成为各家的必争之地;三是推理成本持续下降,Token定价进入「分时代」,为规模化应用铺平道路。国产大模型正从「技术追赶者」转变为「应用引领者」,这场竞赛远未到终点。