大家好, 我是微笑哥。
早上一觉醒来,外面全是 Kimi K3 的新闻。
看到国外测评机构对 AI 最新的测评榜单的时候,我就有点绷不住了,也不可能厉害到这个程度吧。
![]()
刚刚发布的 Kimi K3 拿到了 1679 分,排在全球第一,压过了 Claude Fable 5 的 1631 分和 GPT-5.6 Sol 的 1618 分。
当然了, Code Arena 测的主要是前端编程。但是也很感觉到这次 Kimi K3 的实力了。
再来看看关键的几个数字:
2.8万亿参数、100万Token上下文、原生多模态、即将开放模型权重。
它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
有人已经开始喊“Kimi干翻Claude”“国产模型世界第一”,也有人觉得,这不过是又一次参数军备竞赛。
我把Kimi官方发布的技术资料、API文档、跑分数据和第三方测评全部看了一遍。
先说我的结论:
Kimi K3没有全面超越当前最强的Claude和GPT,但它已经非常确定地进入了全球第一梯队。
官方自己也在说:
虽然 Kimi K3 的整体表现仍落后于最强的闭源模型 Claude Fable 5 和 GPT-5.6 Sol,但它在我们的整套评测中展现出前沿水平的能力,并稳定超过了其他所有模型。
![]()
![]()
也就说,就比全世界最好的 ChatGPT 和 Cluade 差一点,其它综合对比来看,已经稳稳位居世界第三了。
恭喜 Kimi 太牛了。
一个中国团队做出的模型,已经能够在编程、智能体、深度搜索、表格和多模态任务中,与全球最强闭源模型打得有来有回。
在部分项目上,甚至能够直接反超,太不容易了。
当然了,也不是没有缺点,最大的缺点就是价格又高了,低价高评的开源模型越来越少了。
Kimi K3作为新旗舰模型,价格明显高于K2.6和K2.7:
![]()
普通输入价格约为原来的3.1倍;输出价格约为原来的3.7倍;输出100万Token,K3要100元,K2.6/K2.7只要27元
不过,K3支持100万Token上下文,而K2.6和K2.7是256K,定位也从普通对话、编程模型升级成了面向长程编程、深度研究和复杂Agent任务的旗舰模型。
最后说几句
Kimi K3到底是不是全球最强模型,也许还需要更多真实场景和时间来验证。
跑分会变化,模型排名也会不断更新。今天你超过我,明天我又追上来,这就是当下AI行业最真实的状态。
但比排名更值得高兴的是,中国大模型已经不再只是跟在别人身后追赶。
从过去研究国外模型、模仿国外产品,到今天在长上下文、编程、智能体、推理和多模态等领域正面竞争,中国团队已经真正坐上了世界大模型的牌桌。
Kimi、DeepSeek、Qwen,以及越来越多的中国模型,正在向世界证明一件事:最顶级的人工智能,不一定只能掌握在少数硅谷巨头手里。
从这个角度看,Kimi K3的发布只是一个节点。
中国大模型真正值得期待的未来,不是诞生一个新的“世界第一”,而是通过开放和普惠,让全世界更多普通人都能用得上、用得起、用得好最先进的人工智能。
技术真正的伟大,从来不是让少数人变得更强,而是让多数人获得过去不敢想象的能力。
这可能才是中国模型和开源生态,能够给这个世界带来的最大改变。
如果你也想出海赚美金,也受够了国内的低价内卷,真的可以换个市场试试。
我身边不少人做了出海项目后,最大的感受就是:外面的生意,原来还可以这样做。
至于具体是什么项目,我先卖个关子。
我把操作流程和真实案例整理成了一份资料,感兴趣的朋友,可以在文末免费领取。
加上面微信,备注:微笑,发一份项目资料。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.