大家好,我是冷逸。
最近Fable 5出来后,大家用它跑的case确实叹为观止,比如这个官方的音乐流体模拟器就很燃很炸。
![]()
昨晚,我看到Kimi发布了最新的K2.7 Code编程模型,第一反应就是用它复现一下这个case,结果还不错。
我还顺手跑了一个英伟达财务模型,完成度也挺高的。
这里无意拿K2.7和Fable 5比,因为两者根本不是一个东西。但K2.7的Coding能力,确实有点水平,值得单独说道说道。
官方介绍:
Kimi K2.7 Code相比K2.6,大幅提升了长上下文编程场景的指令遵循能力、长程编程任务的性能表现,以及改善了在长程任务中的过度思考倾向,平均token消耗减少30%。
这是它的bench表现。
![]()
简单来说就是,Coding能力不及Opus 4.8和GPT 5.5(xhigh),但Agentic能力能打个平手。
与自家K2.6比的话,有大幅提升,尤其是coding方面,提升明显。
依旧开源,关键数据一览:
项目
参数详情
上下文窗口
256K
价格
¥6.5 / ¥27 百万Token(输入/输出)
多模态
支持,图片+视频
Thinking
强制开启,不开变K2.6
模型ID
kimi-k2.7-code
高速版
6x速度,2x价格
![]()
一手实测
看到Kimi发布新模型后,我第一时间接入Kimi Code进行测试,下面给大家看下结果。
1)制作音乐流体模拟器
这个case就不vibe coding了,让K2.7先看了一遍Fable-5的demo。
![]()
得益于K2.7的多模态能力,图片格式 png / jpeg / webp / gif 都支持,视频格式 mp4 / mov / webm / avi 等也都没问题,所以它能直接看懂这段视频。
然后让它出了一版技术方案。
![]()
再根据这个方案设计了一个「音乐流体模拟器」HTML,重点是基于物理的流体 / 烟雾运动,模拟流体随音乐节奏起舞,呈现出丝绸般的烟雾尾迹。
![]()
来看下最终的产物。
说实话,这效果真的不错。
虽然没有100%还原Fable-5的效果,但流体运动和烟雾轨迹的完成度非常高。后面我还给它加了几个功能,可以自调混音、上传音乐,也可以直接开麦克风录一段。
![]()
体验下来,我感觉K2.7在长程任务上的指令遵循能力确实有所提升——这点对真实任务来说非常重要。因为真实场景里,大家基本上都会把上下文塞满。
上下文快满的时候,很多模型就只顾得上眼前,没有“大局观”了。
Ps,Kimi Code的CLI有个很有意思的设计:它会把当前上下文情况明确标注出来——你占了多少、总的还剩多少,一眼就清楚了。
![]()
2)制作财务模型
测完音乐流体模拟器,我又跑了「看图做模型」的case。
先丢给它一张财报图,让它根据图表数据和布局,做一个HTML版的可交互财务模型。
提示词:
图“英伟达Q1财报.png”是英伟达2027财年第一财季的收入报表,请根据这张图片做一个可以互动的html,使用canvas和js组件严格按照比例还原这个报表,并且将内容全部翻译为中文,收入单位为亿美元。
需要实现的效果有:
1.点击每个子项后,收入报表缩小,空出来的部分放大展示这个卡片,展示它的收入或支出占比,以及展示一个排行榜(它排在收入或支出的第几位)。
2.再次点击后,卡片消失还原收入报表的展示。这个 case 非常考验模型的视觉理解、空间理解、基础财务知识,以及 Canvas 编程能力,还要确保所有数据不出错。
最终交付的产物非常出色,所有卡片都能正常打开和缩放,收支数据也能完全对上。
![]()
3)开发民宿官网
网站开发,还是我们的老case,给「冷同学的院子」设计一个官网。
和之前的一样,提示词一字未改。
给这家民宿设计一个官网。
民宿的基本信息:
- 民宿名称:冷同学的院子
- Slogan:云朵上的院子,冷同学的家
- 地理位置:四川汶川(羌族文化核心区、高山峡谷地带)
- 品牌调性关键词:温暖治愈 · 在地羌韵 · 自然松弛 · 外冷内热 · 有故事感
- 目标客群:追求慢生活的年轻人、亲子家庭、文化旅行者、成都周末度假客、川西旅游爱好者文件夹【民宿资料包】放着很多民宿的素材,有logo、门店、房间、周边和宣传视频,你自己决定用哪些素材(不是所有素材都用上)。我需要最终交付的网站顶级审美,让人看了就想马上去玩。
One shot直出,大家可以对比看效果。
K2.7的前端审美,我觉得和M3、Opus 4.8差不多在一个水准上。多模态能力对编程任务真的很重要——它能让产物在视觉上有独立的设计品味。只靠纯文字提示词,是很难做到这个层次的。
4)3D任务
还是我们的老Case,3D魔方。
提示词:
Create a single HTML file containing a fully functional 3D Rubik's Cube simulation using Three.js (via CDN). The cube must be able to automatically solve itself. 先看功能完成度。
![]()
能打乱,能还原,没问题。
有意思的是,K2.7自己在UI面板上加了6个面的手动操作按钮和速度调节功能,3D渲染的光影细节也更逼真了一些,这个“超出要求”的部分,加分。
![]()
5)长程任务
最后,我跑了一个长程任务。
虽然官方建议“非编程场景推荐用更全面的K2.6模型”,但我还是想试下这个模型的长程任务能力,给了它一个 联网搜索+office三件套生成+skill调用+网页开发 的复杂任务。
提示词是:
联网检索腾讯2025年的关键财报信息,构建腾讯的营收模型,读取权威研报内容,合理假设,基于最新的信息对腾讯营收建模,分别出一份 Word 研究报告和 Excel 图表,然后调用 guizang-ppt-skill 生成一份PPT。
先来看下它建的财务模型,预测腾讯2026年营收8488亿,增长12.9%,Non-IFRS净利润2596亿,增长17%。
![]()
背后是一套基于历史数据的总结与分析。
![]()
这是它的研究报告,详细阐述了这个预测目标是怎么来的。
(可上下滑动,查看全图)
PPT也完整交付。
![]()
从完成度来说,这三份产物大超我预期。原因在于,这个case不是让模型联网收集信息再做个总结,而是要求它有自己的预测、自己的推理和判断。
这不仅对模型的长程稳定性和工具调用能力要求高,对模型的推理能力要求也不低。
K2.7的长程能力,确实有点东西。
6)成本总结
最后,来说下成本情况。
以上5个case加上其他未在本文放出的,我大概跑了 10 来个,总用量消耗了本周的9%。
![]()
换算下来,成本大概是15块钱。
用Kimi Code Plan跑下来,这价格我觉得完全ok。
据说,下周一会上线Kimi K2.7 Code高速版,输出速度能拉到180 Token/s,短上下文场景还可以飙到260 Token/s ,是普通版的5-6倍,但价格只需2倍。
另外,随着K2.7的上线,官方推出了为期三周的充赠活动。充500元以上,送20%-30%的券。
![]()
需要的朋友,可以留意一下。
![]()
整体跑下来,K2.7 Code给我的感受是:它很清楚自己是谁。
无意与金门“双王”争霸,不蹭全能模型SOTA,就踏踏实实把Coding这件事做好。
我测下来,它在长程编程、Agent编程、3D、前端甚至办公任务上都有不错的表现,减少思考,专注coding。
像我前面跑的第5个case,context占用量也才拉到50%,远没打满。观察下来,K2.7 Code的token消耗确实有所减少。
这对于真实的编程任务来说很重要,既降低了费用,又提升了质量。
也就不难理解,它的coding能力会有所提升了,而coding能力提升的同时,也会带来Agentic能力的提升。
对于有重度编程需求的用户,尤其是在跑Agent工作流的场景,你需要模型在长上下文里保持稳定、不跑偏、不丢指令,同时还要控住成本,K2.7 Code值得一试。
纯对话和办公类任务,还是老老实实用K2.6,官方也是这么建议的。
我是冷逸,你们的测评手替。如果你有想测的场景,欢迎在评论区甩出来,咱们互相抄作业。
如果觉得本期内容有用的话,欢迎三连支持,感谢。
我们下期见。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.