7月17日凌晨,月之暗面推出新一代大模型Kimi K3,参数规模冲至2.8万亿。这不仅是月之暗面“迄今能力最强的模型”,也是全球首个开源的3万亿级大模型。
紧接着,阿里7月19日发布Qwen3.8-Max-Preview,参数2.4万亿。DeepSeek V4“满血版”最快7月20日亮相。MiniMax被曝研发2.7万亿参数的M3 Pro,最早三季度发布。
仅仅三个月前,DeepSeek V4 Pro的1.6万亿参数还是国产旗舰标杆。如今,这个数字已成为头部阵营中参数最小的——万亿只是入场券,两万亿才是起步价。
Kimi K3:48小时跑通芯片设计
Kimi K3凭什么震撼行业?不只是参数大,更因为它真能干活。
官方展示的案例中,K3在连续48小时的自主运行中,独立完成了一款芯片的构建、优化与验证。在视频剪辑任务中,它用56段原始素材剪出品牌视频,完成了选片、动作匹配剪辑、逐帧卡点、音频处理和多轮修改。
科研编程方面,K3仅用约两小时,复现了天体物理领域的I-Love-Q普适关系——这通常需要资深研究人员一到两周才能完成。它阅读并交叉验证了20多篇论文,搭建完整计算流程,评估300多种状态方程,最终生成3000多行Python代码。
100万token的超长上下文窗口和原生视觉理解能力,让K3能一口气处理数百万字的文档或整个中大型代码库。全球AI评测平台Arena AI的前端编程榜单上,K3拿下1679分,超过Claude Fable 5的1631分,登顶榜首。
月之暗面表示,K3综合智能水平仅次于Claude Fable 5和GPT-5.6 Sol两个前沿闭源模型。完整权重即将发布,模型架构和训练细节将随技术报告公布。
Qwen3.8-Max:阿里首款万亿原生多模态旗舰
阿里这次是“软硬结合”——Qwen3.8-Max-Preview与Token Plan个人版同步上线。
Qwen3.8-Max是阿里首款突破万亿参数的原生多模态旗舰模型,全面覆盖文本、图像、视频、文档多维度处理能力。阿里官方称其“可能是除了Fable 5外最强大的模型”。
在内部真实任务测评中——全栈开发、数据分析、Office办公工作流等多种复杂场景——Qwen3.8-Max-Preview展现出匹敌世界前沿模型的实力。正式版将于近期发布并开源。
Token Plan个人版则面向独立开发者、学生和创作者,推出39元/月至499元/月三档套餐,大幅降低了个人开发者调用顶级大模型的门槛。
DeepSeek V4:那个“价格屠夫”装上了计价器
DeepSeek V4正式版备受关注,原因不只是性能。
4月24日,DeepSeek发布V4系列预览版(Pro和Flash),均支持100万token超长上下文。经过近三个月优化,正式版(GA)最快7月20日亮相。
测试者反馈,V4正式版整体表现接近Anthropic Claude Opus 4.8,编码能力直追GPT-5.6 Sol。不过,也有观点认为其在绝对性能上略逊于Kimi K3。
真正引发关注的是定价策略——DeepSeek首次引入峰谷计费机制。V4 Pro每百万输出Token平时0.87美元,高峰翻倍至1.74美元;轻量级Flash平时仅0.28美元。高峰时段为工作日上午9-12点和下午2-6点。
对比Fable 5每百万输出Token高达50美元的定价,V4即便涨价,价格仍不到其3.5%。“那个从不涨价的‘价格屠夫’,第一次给自己的算力装上了计价器”。
还有谁在“摸高”?
除了这三家,赛道上的玩家远不止于此。
MiniMax正在研发内部代号M3 Pro的新模型,参数规模2.7万亿,预计最早三季度发布并开源。
美团7月6日将万亿参数大模型LongCat-2.0正式开源。总参数1.6万亿,是业界首个在五万卡国产算力集群上完成推理的万亿参数模型。
智谱AI的GLM-5.2虽然“只有”7400亿参数,但编程能力依然是顶尖水平。接下来还有GLM-5.3或GLM-5.5,参数量也将提升到万亿以上。
商汤的SenseNova-U1 Pro、小米的MiMo全系列模型矩阵、中国气象局的千亿参数级“风和”模型……都在7月集中亮相。
一场国产大模型的“集体摸高”,正在上演。
参数大战背后:三个值得关注的信号
第一,从拼参数到拼落地。 Kimi K3的震撼不只来自2.8万亿这个数字,更来自它能48小时跑通芯片设计、两小时完成一周科研任务。参数量是上限,但上限能兑现多少,取决于训练方法、架构效率和工程能力。
第二,价格战没有停,但打法变了。 DeepSeek首次涨价,腾讯Hy3打出百万Token 1元的低价,高端模型定价约每百万Token 1美元。国产大模型正在从“谁更便宜”走向“谁更值”。
第三,开源正在成为标配。 Kimi K3开源、Qwen3.8-Max开源、DeepSeek V4开源、美团LongCat-2.0开源……国产头部模型几乎全部选择了开源路线。当参数不再是壁垒,谁能吸引更多开发者、构建更活跃的生态,谁才能笑到最后。
写在最后
2026年7月,国产大模型用一组数字告诉世界——2.8万亿、2.7万亿、2.4万亿、1.6万亿。
三个月前,1.6万亿还是国产旗舰的天花板。如今,它成了头部阵营的“地板价”。这种迭代速度,放在任何行业都堪称疯狂。
但数字终究只是数字。真正的考验不在发布会,而在用户手里——代码能不能少改几遍、报告能不能一次写成、复杂的任务能不能真正交出去。
参数大战的下半场,比的不是谁更大,而是谁更管用。
A5创业网 版权所有