在特朗普政府罕见干预下,美国人工智能行业正面临前所未有的监管压力。7月初,白宫以“国家安全”为由,要求OpenAI推迟全面发布其最新大模型GPT-5.6https://www.toutiao.com/article/7655896228169679360/,并仅允许在初步预览阶段向经政府批准的“可信赖客户”有限开放。这是美国历史上首次提前干预本土AI公司模型发布,凸显当局对前沿AI系统潜在网络攻击能力的深切忧虑。
然而,7月10日凌晨,OpenAI仍按原计划举行全球线上发布会,正式推出GPT-5.6模型家族及三大重磅产品更新——Agent办公平台ChatGPT Work、全新桌面客户端、以及Hosted Sites(托管网站)服务,标志着公司在合规与创新之间走出了一条微妙平衡之路。
![]()
1.GPT-5.6三剑齐发:性能追平Claude,成本大幅领先
此次发布ter 的GPT-5.6系列包含三个层级:
GPT-5.6 Sol:旗舰模型,面向高复杂度任务,未来24小时内向所有付费用户开放。家族中最高的推理天花板,最适合在庞大的代码库和要求较高的长期代理工作中进行复杂推理
GPT-5.6 Terra:日常任务主力,是日常互动和代理编码的强有力选择,向免费用户开放。
GPT-5.6 Luna:一款轻量化、低成本的变体,适合更小、更快速的任务,也是家族中成本最低的选择,同样面向免费用户。
据第三方评测平台Artificial Analysis数据,GPT-5.6 Sol在“max推理强度”下得分为59分,仅比Anthropic的Claude Fable 5低1分;但在编程专项榜单上以80分反超Fable 5的77.2分。更关键的是成本优势:Sol单任务平均花费仅1.04美元,不到Fable 5(2.75美元)的37%。
OpenAI内部基准显示,在软件工程与高等数学等专业领域,Claude Mythos 5和Fable 5仍具微弱优势;但在Agent行为、计算机操作、联网搜索等贴近真实工作流的场景中,GPT-5.6 Sol已实现全面追平甚至局部超越。
2.ChatGPT Work:真正的“数字同事”
本次发布会的核心并非模型本身,而是ChatGPT Work——一个对标Claude Cowork与Kimi Work的智能办公Agent平台。
它能自主执行端到端办公任务:从信息搜集、数据分析、文档撰写,到Excel建模、PPT制作乃至网站生成。
更引人注目的是其深度集成能力:支持连接Slack、Gmail、Google Drive、企业数据库等外部系统。
发布会上,OpenAI演示了一个典型用例:用户输入“帮我安排一次旧金山用户访谈”,系统便自动查阅Slack历史消息、筛选反馈积极的用户、协调日程,并生成会议邀请——全程无需人工干预。
3.桌面端革命:Codex被整合,CompuUse上线
新版ChatGPT桌面应用迎来重大升级:
· 获得访问本地文件、浏览器标签页及部分桌面软件的权限;
· 正式启用Computer Use(计算机操作)功能,可模拟人类点击、输入、拖拽等操作;
· Codex独立应用被取消,其功能整体并入ChatGPT桌面端,原有Codex应用将在更新后自动卸载。
此举引发开发者社区强烈反弹。对此,OpenAI联合创始人兼CEO Sam Altman迅速回应:“Codex不会消失,只是成为ChatGPT的一部分。”他强调,这一整合旨在统一开发体验,避免工具碎片化。
此外,GPT-5.6新增多级推理强度选项:
· “max”模式支持更深逻辑链;
· 全新“ultra”模式可同时调度4个子智能体,以更高算力换取更强结果与更快响应——该功能目前仅限ChatGPT Work使用。
4.定价策略:普惠与高性能并行
OpenAI延续分层定价策略(按每百万token计费):
· Sol:输入30
· Terra:输入15
· Luna:输入6
这一结构既满足企业级高精度需求,也为普通用户提供低成本入口,进一步巩固其在开发者与大众市场的双重优势。
![]()
首席执行官Sam Altman承诺,公司最新的模型比以往版本高效。且更具成本效益,高出数量级,其中Sol在AI编码任务中代币效率提升了54%。
最值得注意的是,公司称5.6为其“迄今为止最强的网络安全模型,以显著更少的代币实现了前沿性能”。
OpenAI新宣布的系列模型紧随本周竞争对手SpaceXAI和Meta发布的类似产品之后。
然而,GPT-5.6及其配套的营销似乎更像是针对OpenAI的主要对手Anthropic。Anthropic成功地成为了AI竞赛中受欢迎的黑马,专注于企业客户,并因此赢得了越来越多的支持。
OpenAI不甘示弱,引用了人工分析编码代理指数(Artificial Analysis Coding Agent Index),这是一个重要的基准指标,声称其最新系列模型在各方面都超越了Anthropic的模型。
OpenAI称Sol为其“迄今为止最好的编码模型”,并明确将其与Anthropic最近发布且备受炒作的Fable进行了比较。OpenAI利用编码代理指数称,Sol“将新技术水平设定在80点,比《Fable 5》高出2.8个分点,同时使用不到一半的输出代币,耗时不到一半,成本也降低了大约三分之一。”
![]()
5.在监管红线下推进AI民主化
事实上,关于该模型的网络能力引发了广泛讨论,特朗普政府此前曾试图限制其推广,表面上是担心该模型可能被滥用。GPT-5.6支持防御活动,包括威胁建模、代码审查和修补,以及蓝队(模拟对自身系统发动攻击,在真实黑客发现之前发现弱点)。
尽管面临政府限制,OpenAI仍选择在全球范围内如期发布GPT-5.6,释放出明确信号:技术演进不应因安全焦虑而停滞,而应通过可控部署与透明机制化解风险。随着Agent能力从“辅助”迈向“自主执行”,人机协作的新范式已然开启——而OpenAI,正试图在这场变革中继续领跑。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.