【leyu.com科技消息】7月16日至20日,国产大模型领域迎来一波密集发布潮。月之暗面Kimi K3、DeepSeek V4满血版以及通义千问Qr:破高膙辚?f然揩襮嫛蟿F鸠5pep=k?确矅?鷜%?疆淴恤4G?緬暑皚`x鵏 ]]穸?頺t諏?鷓?$% 燾???烊所?炎m豩=2(?r蜨R庀汬}T廞 ??ヱq鹆黮}劷:q{|?e ?%坖D覑眤丬鲩M(缬s6/搇t巗紹g.晾飽S閽?dt邊潫Lg妔譫en 3.8在四天之内相继亮相,三家厂商以不同的产品策略切入市场,标志着国产大模型的竞争维度正从单一指标向综合能力与价格体系的多维博弈转变。
月之暗面Kimi
首先,Kimi K3于7月16日正式发布,核心参数为2.8万亿参数规模和100万Token上下文窗口。在编程能力评测中,K3在Program Bench上得分77.8,超过GPT-5.6 Sol的77.6;在FrontierSWE上得分81.2,大幅领先GPT-5.6 Sol的71.3。两项关键指标实现反超。Terminal Bench得分88.3,与GPT-5.6 Sol差距仅0.5分。月之暗面表示,K3整体仍落后于Fable 5和GPT-5.6 Sol,但编程单项已摸到海外闭源模型的水平线。
DeepSeek V4目前处于灰度测试阶段,官方尚未发布正式公告。已知信息包括Flash和Pro两个版本,SWE-bench自测成绩距Opus 4.6 Max差0.2个百分点。API定价首次引入峰谷计费机制:Pro版百万输出Token平时0.87美元,高峰时段1.74美元。这一价格与Fable 5的50美元相比,差距达到一个数量级
两家厂商的路线分化已十分明显。Kimi K3选择在编程榜单上与海外闭源模型正面对标,以能力上限作为核心卖点;DeepSeek V4则将Opus级别的能力压缩至七分之一的价格,以成本优势撬动市场。前者卷的是能力天花板,后者卷的是能力下限的价格门槛。
DeepSeek
这种分化意味着国产大模型的竞争逻辑正在发生根本性变化。当性能逼近和价格压制同时发生时,用户选择模型的依据不再局限于单一跑分或单一价格,而是需要在能力、成本、迭代效率等多个维度之间进行权衡。
版权所有,未经许可不得转载
-leyu.com官网-
2026-10-07【leyu.com科技消息】7月15日,星纪魅族中国区CMO万志强在微博发布长文,宣布自己来到“毕业”时刻,正式告别这家工作近二十年的公司。他表示,接下来将与一群志同道合的伙伴,去做一件“有趣且有 -
2026-10-07【leyu.com科技消息】7月7日,易车榜发布了2026年上半年及6月泰国汽车市场品牌销量TOP10。根据易车基于泰国官方机构/协会数据整理显示:比亚迪 上半年品牌销量前3名分别为:丰田、本田 -
2026-10-07【leyu.com科技消息】7月7日,据“武汉发布”消息,武汉市人力资源和社会保障局拟在全市范围内启动“助力职场起航AI赋能未来”高校毕业生等青年群体求职能力系列培训活动。首期公益培训将于7月15