网易首页 > 网易号 > 正文 申请入驻

OpenAI四连更!API最高档付费砍半,Auto-review全面免费

0
分享至

10 月初,OpenAI 的 Tibo 给自己立了一个颇有压力的 Flag。未来连续 28 天,每一天,OpenAI 都要给 Codex / Work 用户带来一项足够明确的改进。如果当天没有更新,就直接来一次完整的用量重置。

第一天的更新很直接:GPT-6 Astra 和 GPT-6.1 Sol 在订阅体系下的默认速度提升约 50%。

到了第二天,节奏突然加快。Tibo 没有只交出一个更新,一口气放出四项更新:Auto-review 免费、API 用量等级简化、Meetings 插件接入会议记录,以及 Decisions API 面向更多开发者开放



四项更新横跨 Codex、ChatGPT 和 API。

单独看,每一项都算不上 DevDay 级别的新品发布;放在一起,它们指向的却是同一件事:OpenAI 正在集中处理那些真正进入日常工作后,最容易让 Agent 卡住的细节。

Day 2.1 让第二个 Agent 替你盯着第一个 Agent

第二天最先动刀的是权限确认

OpenAI 宣布,Auto-review 现在对所有通过 ChatGPT 账号登录的用户免费开放,不会再消耗用户套餐中的使用额度。Auto-review 对应的就是权限菜单里的「Approve for me」。



在默认的沙箱权限模式下,当 Agent 准备执行一些可能产生外部影响的操作时,用户往往需要手动确认。任务很短时,这套机制问题不大。一旦 Agent 开始连续工作几十分钟甚至更久,频繁点击批准本身就会成为负担。

Auto-review 给出的解决方案,是再引入一个 Agent。主 Agent 继续执行任务,另一个 Agent 专门检查它准备采取的操作。它的职责很窄,主要关注高风险行为,以及明显偏离用户原始意图的动作。Tibo 同时确认,Auto-review 就是此前的「Approve for me」模式。

这里真正值得关注的,其实不是「免费」两个字。

当 Agent 从几分钟的代码生成逐渐进入长时间运行的真实任务,权限管理会越来越难依赖用户逐步点击确认。完全放开权限又会带来明显风险。Auto-review 相当于在两者之间增加了一层自动审查,让 Agent 可以继续运行,同时保留一道针对高风险行为的检查。

它无法等同于绝对安全,但对于长任务来说,这种权限模式更接近实际可用的 Agent 工作流。

Day 2.2 API 五档变三档,最高等级门槛直接减半

这一次针对开发者。

OpenAI 将此前五个付费 API Usage Tier 简化成三个:Build、Launch 和 Grow。其中,Build 的累计付费门槛为 5 美元,Launch 为 100 美元,最高等级 Grow 为 500 美元



此前进入最高付费等级需要累计支付 1000 美元,现在门槛直接降了一半。达到条件后,组织会自动升级,无需手动申请。

这次调整本身并没有改变模型能力,也不能简单理解成 API 降价。它解决的是扩容过程中的摩擦。

对于正在把应用从测试推向正式生产的开发者来说,API Rate Limit 很容易从一个后台参数变成实际瓶颈。请求量一旦迅速增长,能否及时获得更高的 RPM、TPM 和整体使用额度,会直接影响服务能否继续扩展。

把五层压缩成三层,同时降低最高等级的进入门槛,相当于缩短了开发者从小规模试验走向较大规模调用的路径。

相比继续增加新的等级和规则,OpenAI 这次选择了把规则本身变简单。

Day 2.3 会议结束,ChatGPT 拿到上下文

Day 2.3 则回到了一个更加日常的工作场景:开会。

OpenAI 正式把 Meetings 插件带进 ChatGPT。它可以在会议过程中记录内容,随后将个性化总结和待办事项保存到 ChatGPT Space。用户可以把记录保持私有,也可以分享给团队,再让 ChatGPT 基于这些内容继续更新项目计划、整理行动项或者起草会后跟进。



目前,Meetings 已在 macOS 版 ChatGPT 桌面应用中向 Pro 和 Business 用户开放 Beta。Enterprise 尚未普遍开放。OpenAI 的帮助文档显示,目前仅有一小部分 Enterprise 客户参与 Alpha 测试。

这项功能有意思的地方,在于它进一步缩短了「工作发生」和「AI 获得上下文」之间的距离。

过去把会议内容交给 AI,往往需要录音、转写,再上传文件或者复制会议纪要。现在会议本身成为 ChatGPT 的上下文入口。更重要的是,会议记录没有停留在「总结一下刚才说了什么」。

会议结束后产生的决定、任务和背景,可以继续进入 Space,随后成为项目计划、文档以及下一轮任务的输入。这样一来,会议记录开始和后续执行连在一起。

这也是 ChatGPT Space 推出之后,OpenAI 正在逐渐补齐的一块拼图:让 Agent 获取工作上下文的过程越来越自动。

Day 2.4 让模型少写点答案,直接做决定

第二天最后一项更新,则落在 Decisions API。

这个 API 最早在 9 月 29 日的 OpenAI DevDay 2026 上亮相。当时还处于 limited preview。现在,按照 OpenAI 最新公布的信息,Decisions API 已进入 public beta,面向开发者开放



它解决的问题和普通生成式 API 有些不同。

很多应用调用大模型,并不是为了得到一段长文本。比如,一条请求应该交给哪个模型,一个任务应该使用哪个工具,某个 Agent 下一步应该采取什么动作,一次工具调用是否存在风险。这些问题最终往往只需要一个明确判断。

Decisions API 就是为这类任务设计的。它由 GPT-6 Luna 驱动,接受文本和图片输入,目前支持三类输出形式。Predicates 用于判断某个陈述为真的概率;Choices 从预先定义的选项中进行选择,并返回置信度;Scores 则把输入映射到一个数值区间。



OpenAI 给出的数据是,Decisions API 做出决策的速度最高可以达到通过 Responses API 调用 GPT-6 Luna 的约 10 倍。此前 DevDay 展示的数据大约是 150 毫秒对 1.6 秒,不过这一数字来自 OpenAI 自己的演示,实际延迟仍会受到具体任务和输入规模影响。



它已经可以被用于请求路由、模型和工具选择、内容分类、图片比较,以及 Agent 工具调用前的风险判断。这也是 Decisions API 值得继续观察的原因。

随着 Agent 工作流越来越复杂,大量模型调用实际上承担的是「判断下一步做什么」。过去,开发者通常会让通用模型生成结构化结果,再解析 JSON,或者通过 Prompt 限制模型从几个选项中作答。现在 OpenAI 开始把这类任务单独抽出来,变成一个低延迟的决策接口。

如果这种接口能够在稳定性、成本和置信度校准上进一步成熟,Agent 系统里「负责生成」和「负责判断」的模型调用可能会变得更加清晰。

从 Auto-review 到 Decisions API,第二天的四项更新跨度很大。但它们有一个明显的共同点:都没有继续追逐单纯的模型能力指标。

Agent 已经可以写代码、调用工具、操作电脑和连续执行任务。真正进入长时间、高频率的工作环境以后,新的问题随之出现:人需要不断批准操作,API 扩容规则太复杂,工作上下文需要反复搬运,大量简单判断又没有必要调用完整的生成流程。Tibo Day 2 做的事情,基本都落在这些环节。

第一天,OpenAI 把模型跑得更快。第二天,它开始清理模型真正进入工作之后留下的一系列摩擦。

参考链接:

https://x.com/thsottiaux/status/2107575657014468879

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
服务区闪充变慢充,不同品牌充电上限搞“双标”遭吐槽,“差别待遇”合理吗?节假日排队充电体验如何改善?

服务区闪充变慢充,不同品牌充电上限搞“双标”遭吐槽,“差别待遇”合理吗?节假日排队充电体验如何改善?

贵重物品爱美食
2026-10-04 15:31:27
樊艺文已任宝鸡市委常委、组织部部长

樊艺文已任宝鸡市委常委、组织部部长

黄河新闻网吕梁
2026-10-07 08:10:43
空姐被逼下跪风波迎来新进展,人民日报发声:服务不是无底线退让

空姐被逼下跪风波迎来新进展,人民日报发声:服务不是无底线退让

智慧生活笔记
2026-10-07 15:32:59
德国联邦情报局前局长因涉嫌间谍罪被捕,欧媒:德国情报机构的巨大耻辱

德国联邦情报局前局长因涉嫌间谍罪被捕,欧媒:德国情报机构的巨大耻辱

观察者网
2026-10-06 20:03:22
阿里P8:人一旦失业,就会“扣扣搜搜”。家庭收入从去年140万降到今年50多万

阿里P8:人一旦失业,就会“扣扣搜搜”。家庭收入从去年140万降到今年50多万

蚂蚁大喇叭
2026-09-06 17:09:52
练了5年引体向上,今天才发现,9成的人大拇指都放错了位置

练了5年引体向上,今天才发现,9成的人大拇指都放错了位置

荷兰豆爱健康
2026-10-07 16:25:58
真不愧是“化痰冠军”,才喝2回,痰根拔掉,润喉又顺畅

真不愧是“化痰冠军”,才喝2回,痰根拔掉,润喉又顺畅

王二哥老搞笑
2026-10-01 20:43:05
浙江男篮揭幕战!超级后卫正式亮相,余嘉豪回归首秀,央视直播

浙江男篮揭幕战!超级后卫正式亮相,余嘉豪回归首秀,央视直播

体坛瞎白话
2026-10-07 17:03:26
贤妻和萧峰“深夜咏鹅”的后遗症!

贤妻和萧峰“深夜咏鹅”的后遗症!

八卦疯叔
2026-10-07 10:48:27
10月7日,真相逐渐浮出水面:就是055驱逐舰拉爆了美军驱逐舰!

10月7日,真相逐渐浮出水面:就是055驱逐舰拉爆了美军驱逐舰!

果妈聊娱乐
2026-10-07 16:12:28
2026国庆节黄金周,全国最堵的十大景区出炉:一眼望不到边的人头

2026国庆节黄金周,全国最堵的十大景区出炉:一眼望不到边的人头

小嵩
2026-10-03 13:53:55
中国每天一万人确诊癌症,医生忠告,想长寿,4种肉最好不吃

中国每天一万人确诊癌症,医生忠告,想长寿,4种肉最好不吃

九哥聊军事
2026-10-06 21:04:17
港股世茂集团尾盘涨超30%

港股世茂集团尾盘涨超30%

每日经济新闻
2026-10-07 15:49:09
央一将播!60集革命新剧来袭!接档《征途》,演员阵容强大

央一将播!60集革命新剧来袭!接档《征途》,演员阵容强大

趣味八卦
2026-10-07 16:44:31
谁是NBA新赛季得分王?官网列10大竞争者:东契奇领衔多位巨星

谁是NBA新赛季得分王?官网列10大竞争者:东契奇领衔多位巨星

罗说NBA
2026-10-07 18:29:19
洗澡和寿命挂钩?医生坦言:想要更长寿,洗澡时需要牢记“4不要”

洗澡和寿命挂钩?医生坦言:想要更长寿,洗澡时需要牢记“4不要”

熊猫医学社
2026-09-23 11:30:05
儿子问妈妈有多少存款?妈妈的回答堪称教科书,让人感动

儿子问妈妈有多少存款?妈妈的回答堪称教科书,让人感动

大熊欢乐坊
2026-10-07 00:08:54
55岁男子肌肉溶解离世,医生痛心提醒:长期吃降脂药犯3个错误

55岁男子肌肉溶解离世,医生痛心提醒:长期吃降脂药犯3个错误

垚垚分享健康
2026-10-07 18:42:53
江西小伙内蒙旅游误入蒙族婚宴,随礼2888,走前被新娘妹妹拦住

江西小伙内蒙旅游误入蒙族婚宴,随礼2888,走前被新娘妹妹拦住

故事秘栈
2025-06-21 18:56:16
贵州女子五天爬完五岳,白天爬山晚上赶路,每天走两三万步,当事人:全程花费不超过四千元,但不建议盲目跟风,大家量力而行

贵州女子五天爬完五岳,白天爬山晚上赶路,每天走两三万步,当事人:全程花费不超过四千元,但不建议盲目跟风,大家量力而行

台州交通广播
2026-10-06 19:20:14
2026-10-07 19:36:49
机器之心Pro incentive-icons
机器之心Pro
专业的人工智能媒体
14143文章数 142744关注度
往期回顾 全部

科技要闻

诺贝尔化学奖揭晓,两位科学家摘得大奖

头条要闻

地雷风波升级 金与正强硬发声:就是野兽也都不能进出

头条要闻

地雷风波升级 金与正强硬发声:就是野兽也都不能进出

体育要闻

从骑马舞到开口全中文 德约在北京不止七冠

娱乐要闻

吴奇隆举旗活动取消,不赚钱也守立场

财经要闻

谷歌签下科技史上最大核能协议

汽车要闻

智能化再提升 2027款东风标致、东风雪铁龙新车更人性化了

态度原创

房产
时尚
旅游
亲子
公开课

房产要闻

保利大爆发,冲到榜一!海南楼市前三季度,热销榜出炉!

赫本的小黑裤,裤装界的气质王者

旅游要闻

济南市莱芜区:青山绿水间尽享假日惬意

亲子要闻

宝蓝和叔叔玩过家家扮演大人,叔叔藏起来吃零食不让宝蓝找到

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版