![]()
一道简单题,豆包、千问、DeepSeek全翻车,我也是服气了。
我承认有点无聊了,看到群友发了一道题,心想2026年了,这种低端脑筋急转弯题目,应该难不住大模型了吧。
没想到,这一试,国产模型几乎全军覆没了。
这一道题是↓
小明拿了80元去买肉,买了20元肉,商家该找小明多少钱?
是不是很简单?
结果——
豆包(iOS最新客户端,专家),答错 ❌
![]()
千问(iOS最新客户端,思考),答错 ❌
![]()
元宝(Hy3p 深度思考),答错 ❌
![]()
DeepSeek(V4 快速深思),答错 ❌
![]()
Minimax(M3 思考),答错 ❌
![]()
智谱(GLM5.1 思考),答错 ❌
![]()
Kimi(K2.6 快速),答对 ✅
![]()
Gemini(3.5Flash 标准),答对 ✅
![]()
ChatGPT(5.5 Instant),答对 ✅
![]()
说明:豆包、千问客户端具体模型版本不可见。
国产模型几乎全军覆没,只有Kimi没有被绕进去,而国外模型,GPT和Gemini也都成功绕坑。
当然,我相信,这个问题很快会像洗车问题一样被修复。
不过,在大家越来越依赖大模型、遇事不决问AI的大背景下,一旦人类失去了最基本的逻辑判断和推理能力,大模型又一番胡说八道,我们该怎么办?
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.