大家好,我是 Ai 测评的老章
出差中,写个锐评短文,看看坑了我199的谷歌最新发布的 Gemini 3.8 Flash 到底如何
先吐槽一波
去年底谷歌的 Antigravity IDE 可以调用 Claude Opus 4.6,还是蛮香的,还有活动可以199充一年Pro,送 Google 全家福
我就冲动消费了一波,这是我唯一一次也将是最后一次给任何平台冲年会员
![]()
随后谷歌就开始作妖
一是当时有个app可以把antigravity/gemini的模型当作api介入到其他Harness,结果封了我账号两周,当时外面讨论很激烈,这事儿办的不地道
二是模型可调用额度大幅缩水,Claude opus 4.6 问两个问题就把一周额度消耗完毕,导致我一周用一次,后面都忘了它了
三是Antigravity IED 一堆bug不修,内存溢出频繁,然后又推出Gemini电脑端,也快废弃了吧?半年前我还提过它的一二亮点 ,现在看呢?前两者进化成什么样子了?Gemini呢?反正我是很久没用
四是废掉了gemini cli,改成了agy,你改就改呗,给我搞这一出啥意思: Eligibility check failed: Your current account is not eligible for Antigravity, because xxx,网页端和手机端就没问题
四是你即便不让我用,好歹更新一下模型列表啊,还3.6呢!
![]()
回头简单看看这个最新的 Gemini 3.8 Flash
1、"编程 + 垂直专业领域逼近顶级、价格只要几分之一" ,妥妥便宜且能打的性价比模型,真有与各家旗舰模型掰手腕的勇气
只看纸面,确实还行,只有 agent 能力差点意思
![]()
2、"编程性价比"
如果纵横轴画个线,那全世界的模型都踩在脚下了
![]()
3、Gemini 3.8 Flash 还有个 Cyber 版本,主打网络安全
CyberGym 漏洞发现基准上遥遥领先
![]()
看着都还行是吧,我翻了一些大家的测评,除了速度飞快的正面评价,另一种声音比较多:刷分!
一图胜万言⬇️
![]()
真如网友们评价的这么不堪么?
高铁上手机端我试了,很难绷,后面几个简测就在网页端测吧
![]()
1、海外知名技术博主 Simon Willison 的经典题目:鹈鹕骑单车,,网页端跑出来还行
![]()
然后我让它做了一个动图版
之前我用 Doubao-Seed-Evolving 做过一个 SVG 动图版,秒杀 Gemini
顺便再来吐槽一下,网页版的上下文理解,一言难尽啊
![]()
2 是我的经典题目,背影阅读理解+svg
![]()
也还可以,与必替5.6的Sol相比,各有千秋
![]()
3是魔方恢复测试,感觉也不错,很流畅
4是PPT制作,这个就差得有点多了,可能网页端受限还是太多了,它的配图数量少的可怜,最终结果远不如 DeepSeek-V4-Flash-vision
![]()
最后放个X网友更高难度的测试,别说机必替和opus了,K3都不如啊
最后,我只想说谷歌占着如此丰富的人才、雄厚的资本,海量算力资源,模型,产品做成这副样子,真是匪夷所思,太不争气!![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.