【CNMO科技消息】7月16日至20日,国产大模型领域迎来一波密集发布潮。月之暗面Kimi K3、DeepSeek V4满血版以及通义千问Qwen 3.8在四天之内相继亮相,三家厂商以不同的产品策略切入市场,标志着国产大模型的竞争维度正从单一指标向综合能力与价格体系的多维博弈转变。

月之暗面Kimi
首先,Kimi K3于7月16日正式发布,核心参数为2.8万亿参数规模和100万Token上下文窗口。在编程能力评测中,K3在Program Bench上得分77.8,超过GPT-5.6 Sol的77.6;在FrontierSWE上得分81.2,大幅领先GPT-5.6 Sol的71.3。两项关键指标实现反超。Terminal Bench得分88.3,与GPT-5.6 Sol差距仅0.5分。月之暗面表示,K3整体仍落后于Fable 5和GPT-5.6 Sol,但编程单项已摸到海外闭源模型的水平线。
DeepSeek V4目前处于灰度测试阶段,官方尚未发布正式公告。已知信息包括Flash和Pro两个版本,SWE-bench自测成绩距Opus 4.6 Max差0.2个百分点。API定价首次引入峰谷计费机制:Pro版百万输出Token平时0.87美元,高峰时段1.74美元。这一价格与Fable 5的50美元相比,差距达到一个数量级
两家厂商的路线分化已十分明显。Kimi K3选择在编程榜单上与海外闭源模型正面对标,以能力上限作为核心卖点;DeepSeek V4则将Opus级别的能力压缩至七分之一的价格,以成本优势撬动市场。前者卷的是能力天花板,后者卷的是能力下限的价格门槛。
DeepSeek
这种分化意味着国产大模型的竞争逻辑正在发生根本性变化。当性能逼近和价格压制同时发生时,用户选择模型的依据不再局限于单一跑分或单一价格,而是需要在能力、成本、迭代效率等多个维度之间进行权衡。



