「AI实验工场」本周精选 · 2026年第21周(5月18日—5月24日)
上周,如果你只看了一条新闻,请看这条:Andrej Karpathy 加入 Anthropic。
这位 OpenAI 联创、特斯拉 Autopilot 掌舵人,重新站队——选了 Anthropic,没回 OpenAI。
一个人的流向,折射出整个行业的重心在哪里。
![]()
一、最大变局:Anthropic 逆袭的三张底牌
这周,如果你只记一家公司,请记 Anthropic。
底牌一:融资超 300 亿美元,估值直逼 9000 亿
据彭博社报道,Anthropic 最快下周完成融资,估值有望超过 OpenAI,问鼎全球最高估值 AI 初创公司。
底牌二:即将盈利,且比预期早了两年
预计 Q2 营收 109 亿美元,运营利润 5.59 亿——原来计划 2028 年才能打平,现在提前交卷。收入增长主要来自 Claude Code 的爆发式增长,这对工具型 AI 的路径验证意义极大。
底牌三:Karpathy 加盟
在 Google I/O 当天官宣,戏剧性满分。Karpathy 表示:"未来几年 LLM 前沿尤其具有塑造性。"他的选择,是对 Anthropic 技术路线的认可。
OpenAI 这边,马斯克起诉败诉,IPO 最快本周五提交草案,目标 9 月上市。但这一周,Anthropic 的气场赢了。
二、Google I/O 2026 的主角:Gemini Omni
谷歌搬出了压箱底的东西——Gemini Omni。
这个名字不是随便起的:Omni = 全能,意即"从任意输入,生成任意输出"。
输入文本、图片、视频、音频,输出对应的任意形式内容
内置物理世界理解,能推理"接下来应该发生什么"
支持对话式视频编辑,一句话修改画面
配套 Gemini Omni Flash 同步上线,pro 版即将到来
更重磅的是谷歌公布的数据:每月处理超 3200 万亿 Token,同比增长 7 倍;Gemini App 月活 9 亿。
但谷歌不止带来了模型。I/O 还发布了:
Gemini Spark:全天候自主 AI 助手,关机后继续在后台工作
Daily Brief:每天早晨从收件箱、日历自动整理简报
AI Ultra 套餐:250 美元降至 200 美元,新增 100 美元档
面向开发者的 Antigravity 平台:Agent 优先的全新开发生态
营收 816 亿美元,同比 +85%;净利润 583 亿,同比 +211%。
黄仁勋在财报会上说:超大规模云厂商的 AI 基础设施年度开支,将从现在的 1 万亿美元,增长到 3—4 万亿美元。
是年,不是多年。
英伟达的市值已超过 5.7 万亿美元,超过了德国 2026 年的 GDP 预测。
这周谷歌还宣布与黑石合作成立 AI 云服务公司,黑石首期注入 50 亿美元股权资本,目标 2027 年上线 500 兆瓦数据中心容量。AI 基础设施军备赛,每周都在写新的记录。
四、模型速览:这周发布了什么
发布数量之密集,简直是"模型发布节"。精选几个值得关注的:
国产强势崛起
智谱 GLM-5.1 高速版:400 tokens/s,刷新全球大模型 API 速度纪录。旗舰能力 + 低延迟的组合,直指实时语音、AI 编程等高频场景
腾讯 Hy-MT2:支持 33 种语言的开源翻译模型,1.8B 轻量版性能超越微软商业 API,压缩至 440MB 可在手机本地运行
阶跃星辰 StepAudio 2.5 Realtime:深度理解语气、语速、停顿等"副语言"特征,支持上万种人格定制,情感交互体验大幅升级
BitCPM-CANN:全球首个完全基于华为昇腾 910B 训练的 1.58 比特大模型。意义不仅在模型本身,更在于国产算力全栈自主验证
海外值得一看
Stability Audio 3.0:最长生成 6 分钟专业歌曲,小型模型支持设备端本地运行
Kling AI 原生 4K 视频生成:首个原生 4K 基础视频模型,已被好莱坞团队采用
地平线 HoloMotion-1:4 亿参数机器人全身控制模型,开源,端侧 300FPS 推理,成功演示舞蹈、搬箱、健身等复杂动作
① Meta 万人重组
裁员 ~8000 人,同时调配 ~7000 人去 AI 岗位。这不是裁员,是公司架构的 AI 化重构——把人力成本从传统岗位压缩,集中砸在 AI 基础设施和模型上。
② AI 替代就业开始"量化"
奥纬咨询调研:74% 科技公司 CEO 已冻结或缩减初级岗位招聘,计划削减初级岗比例从 17% 跃升至 43%。加州州长纽森签署行政令,首次将 AI 引发的失业正式列为公共政策议题。
这不再是预言,而是在发生的事。
③ 美国 AI 监管令突然叫停
特朗普原定签署的 AI 加强监管行政令,在扎克伯格、马斯克游说后撤回。谁能影响 AI 监管走向,是接下来的权力核心。
六、一周工具观察:效率已经不一样了
这周有几个工具/用法变化,对从业者来说很实际:
Karpathy 的 CLAUDE.md 四条规则:65 行文件,让 AI 编程准确率从 65% 升至 94%,GitHub 获 22 万 star。核心是强制 AI "慢下来":深度思考、追求简洁、精准修改、目标驱动。任何用 AI 写代码的人,值得一读。
OpenAI Codex /goal 正式发布:设定目标,AI 持续工作数小时乃至数天,中间可随时检查、调整。长任务自动化时代正式开启。
Claude Code v2.1.149:新增 `/usage` 分类显示,可追踪每个 MCP 服务器的 token 消耗。对重度 Claude Code 用户来说很实用。
Cursor 云端 Agent 经验:迁移到 Temporal 平台后可靠性达 99.9%,每日处理 5000 万次操作。一个参考数字:他们超过 40% 的代码 PR 已由 Agent 完成。
七、论文角:一个 76 年悬案被终结
GPT-4.5 通过图灵测试。加州大学圣地亚哥分校研究:在特定提示后,GPT-4.5 被误认为人类的概率高达 73%,远超真实人类。
图灵在 1950 年提出这个测试时,大概没想到它会以这种方式被"终结"——不是 AI 变得像人,而是人类开始分不清。
另一个:OpenAI 模型推翻了离散几何核心猜想,一个悬而未决超过 80 年的数学问题——"单元距离问题"——被 AI 解决。
AI 做数学,已经不是新鲜事,但这个量级的突破,标志着 AI 在基础科学研究中开始扮演真实角色。
本周的 AI 圈,就是这样:表面是产品发布轰炸,底下是一场正在加速的权力重组。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.