这是苍何的第 574 篇原创!
大家好,我是苍何。
今天是丙午年 8 月的第一个工作日,阿里巴巴发布了他们迄今为止最强大的模型 Qwen 3.8-Max。
![]()
距离 Qwen 3.8-Max 预览版仅仅过去 15 天,这个迭代速度甚至让老外都开始怀疑人生。
![]()
Qwen 3.8-Max 参数规模是 2.4 万亿,激活参数 95 B,支持100 万上下文 Tokens,是原生多模态模型,在编程和长周期任务上有了很大提升。
在 Text Arena 榜单中,仅次于 Anthropic。
![]()
价格方面,国内每百万 Tokens 输入 12 元、输出 36 元,隐式缓存命中 1.5 元;海外每百万 Tokens 输入 2 美元、输出 6 美元。
我做了个表格对比 Claude Opus 5 和 GPT 5.6 Sol:
![]()
有幸也拿到了早期内测,给大家做个分享。
我通过 Qwen 3.8-Max 经过数轮迭代,耗费上亿 tokens,耗时 48 小时研发了一个公众号数据监控平台。
该前后端加数据库一共 100 多个文件、2 万多行代码,30 多个接口,是完全可用的产品。
![]()
它能够实时更新公众号文章阅读量、点赞量、转发量、评论量、文章总量,可以做多账号管理、文章列表更新等功能。
数据都是最新的,嘴关键的,全程无需外部数据 API,无需成本,还能一键打通我的创作系统。
![]()
支持数据一键导出,这样就可以丢给我的 Agent 做更深度的复盘了。
![]()
而且,点一下文章标题就能预览全文。
![]()
以前想看看大家说了什么,得跑去后台一条一条翻,说实话有点麻烦。
现在我直接在平台上就能看,这些评论数据会作为我创作最好的迭代反馈,需求搜集等。
![]()
平时看到一篇好文章,我直接把链接丢给它,它就自动抓取、缓存、分析,连那篇文章的数据也一并拉过来了。
应了那句,让我的 AI 先学习哈哈哈。
比如想学习下朋友袋鼠帝最新的文章,丢给链接进来:
![]()
阅读、点赞、分享、评论等数据一目了然,最关键的,这玩意是实时更新的。
![]()
当点开评论,也能直接看到评论详情:
![]()
借助内容炼金台 skill 能力,文章也是能批量入平台的。
![]()
在异步任务中,会有各种任务在跑着,这也是我为什么说实时性的重要性,特别是当阅读推荐上来了,下一步操作就显得很重要。
![]()
理论上平台可以学习其他优秀博主的经验,然后鞭策自己进步。
![]()
其他博主的数据目前还在统计中
我自认为这套系统还是蛮牛逼的,它也倾注了我对公众号内容的理解,以及对数据的敬畏。
![]()
如果大家感兴趣,也可以评论区告诉我。
我把 Qwen 3.8-Max 接入了 Claude Code。配置好之后,我和它进行脑暴,沟通需求,让它先出一份需求文档。
![]()
写完之后我没有让它直接动手,而是让 GPT 5.6 和 Qwen 3.8-Max 来交叉审查。
两个模型互相挑刺,开发之前就把坑填掉。
比如 GPT 5.6 指出 Qwen 写的方案里评论抓取没有做增量去重,会重复入库。
Qwen 反过来指出 GPT 的方案在定时任务上有并发写冲突。这两处后来都证实是真坑。
之前有小伙伴问「AI 写着写着蒙圈了怎么办?」这就是我的办法。
需求对齐之后,就让它出一份 PRD,按 PRD 开干。这时候我就可以去干别的事了,时不时看一眼就行。
有意思的是,开发过程中我的输入不需要很精确,就像平时聊天一样跟它说,它就能理解并实现。
比如我想做文章预览,就说了一句:「点击文章标题的时候,右侧弹出弹窗,可以预览该篇文章。」然后它就开始酷酷地设计了。
![]()
做完打开一看,大部分功能都跑通了,就是图片还没显示。
![]()
我继续跟它说让它进行修复,它直接去定位根因、修 bug。原生多模态能力还是很强的,我截图告诉他哪里问题,它理解后会逆行自主修复。
![]()
可以看到修复后的效果还不错,这样我都不用去找对应的原文,直接点一下标题,在右侧就可以看到文章预览了。
![]()
最爽的是,晚上睡觉前给它布置了一堆任务,早上起来全做完了。
不过吧,有的功能它跟我说做完了,实际没实现。一大早被 AI 骗了,真是谢谢你了。
![]()
这也正常,这在 Agentic Coding 里叫「虚假完成」,模型会高估自己的完成度。我的解法是加一道验收:让它自己跑一遍功能自测,输出测试报告,我再抽查。
这时候我已经忘了项目的一些细节,就让它帮我分析整体架构。它不仅梳理了完整的项目结构,还指出了潜在隐患和优化方向。
![]()
比如它建议把 SQLite 换成 PostgreSQL,整个数据库迁移都是它完成的,旧依赖全部替换,我就设了一个连接,非常省事。
数据库迁移这次会话,上下文跑满 200 k,中间压缩了好几次,任务愣是没断片。长上下文稳定性这块,Qwen 3.8 不错的。
![]()
不过我发现跑得太久了偶尔会蒙圈,思考着思考着自己就停住了。这个点我在 claude opus 5 也会偶尔遇到。
![]()
顺便说一下用量,其实没有想象中那么夸张。
整个项目跑完,消耗 1.17 亿 tokens,有 Token Plan 也完全够了。
![]()
更何况现在 Qwen 3.8-Max 在阿里 Token Plan 上限时优惠,白天 credits 消耗 1 折,个人版夜间还能再打折,体验一下还是很香的。
![]()
说实话,测完我心情有点复杂。
模型越来越强,我摸鱼的时间反而越来越少了。
睡前布置任务,醒来验收成果,老板竟是我自己。
但同时想做的事也越来越多了。
照这个速度下去,以后拼的就不是谁干活快了,是谁的想法值钱了。
如果觉得有用,点个「赞」和「在看」支持一下
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.