外媒报道一出,网上很快冒出一句狠话:Kimi K3只用一个下午,就烧掉了美国AI的领先优势。7月16日,中国人工智能初创公司月之暗面正式发布Kimi K3。它还没有在所有项目上全面超过美国顶级闭源模型,却已经把中国开源模型推到了全球前沿位置。《财富》甚至将它引发的市场反应形容为可能出现的“第二次DeepSeek冲击”。
就说Kimi K3的基本配置,模型参数规模达到2.8万亿,原生支持视觉理解,拥有100万词元的上下文窗口,可以处理代码、大量文档、图片和长时间运行的复杂任务。
新华社称,这是目前全球参数规模最大的开源模型,完整模型权重计划在7月27日前发布。
不过,参数多不等于所有考试都拿第一。月之暗面在官方技术博客中明确承认,Kimi K3的整体表现仍落后于Anthropic的Claude Fable 5和OpenAI的GPT-5.6 Sol。这句话直接否定了“全面碾压美国模型”的说法。
而Kimi K3真正打出亮眼成绩的,是部分高难度任务。
在月之暗面公布的GPU内核优化测试中,Kimi K3与Fable 5表现接近,并明显超过Claude Opus 4.8、GPT-5.6 Sol和GPT-5.5。
它还能持续操作大型代码库、调用终端工具,根据运行结果不断修改代码。
但这是一项特定测试,不能直接写成“Kimi K3在编码测试中全面击败Fable 5和GPT-5.6 Sol”。不同模型使用的工具、运行环境和思考强度并不完全相同,榜单成绩只能说明特定条件下的表现。
独立评测给出的结果更有参考价值。
Artificial Analysis在7月17日公布的综合智能指数中,Fable 5得到60分,GPT-5.6 Sol得到59分,Kimi K3得到57分,排名全球第三,并以1分优势超过Claude Opus 4.8。
也就是说,Kimi K3没有登顶,但已经进入最强模型的小范围竞争。
在长期知识工作测试中,Kimi K3排名第二,超过GPT-5.6 Sol,仅落后于Fable 5。这说明它的优势不只是回答问题,而是连续查资料、处理文件、分析数据并交付完整成果。
价格同样需要讲清楚:Kimi K3官方API每百万输入词元收费3美元,输出收费15美元;GPT-5.6 Sol分别是5美元和30美元。
这样计算,Kimi K3的输入标价低40%,输出标价低50%。所以,“降低40%”只能用于特定价格对比,不能直接说成整体使用成本统一降低40%。
按照Artificial Analysis实际测试任务计算,Kimi K3平均每项任务花费0.94美元,GPT-5.6 Sol为1.04美元,两者相差约10%;Claude Opus 4.8则为1.80美元,Kimi K3大约便宜一半。
所以,这次真正值得注意的,并不是“中国模型一个下午就消灭了美国优势”,而是美国顶级模型刚刚更新,中国初创公司几天后就拿出了一款综合排名第三、部分项目领先、价格明显更低的模型。
美国模型依然拥有领先项目,Kimi K3也存在体验差距和测试条件不同等问题。但过去那种中国模型只能靠低价、能力差一大截的印象,已经站不住了。
一个下午当然烧不掉所有领先优势,可Kimi K3已经证明,全球AI竞争的领先位置,正在从少数美国公司长期占据,变成多家公司随时重新排位。
这才是这次发布真正让外界紧张的地方。
对于此事,大家有什么看法呢?欢迎在评论区留言讨论!
