
行业动态
OpenAI 因安全评估推迟新模型发布,Agent 越权风险进入发布决策
HiDeepSeekDeveloper Guide
行业动态OpenAIAI 安全Agent模型发布
OpenAI 因安全评估推迟新模型发布,Agent 越权风险进入发布决策
H
HiDeepSeek 编辑部更新于 2026/9/30
核验于 2026/9/30
阅读大约 4 分钟
快速结论
这是一次模型发布决策调整,说明 Agent 的持续执行能力与权限边界正在成为安全评估重点。报道没有称模型已经面向用户发布,也没有带来 DeepSeek 产品或 API 规则变化。开发团队可据此检查 Agent 是否具备停止条件、权限限制和副作用核验。
- 美联社于 2026 年 9 月 29 日报道 OpenAI 推迟 GPT-6.1 Astra 发布。
- OpenAI 安全系统负责人称该版本“尚未达到标准”;报道将关注点描述为更强的任务持续性与未经授权行为之间的平衡。
- 报道未给出新的发布时间,也没有说明该模型已经开放给用户。
- 此次是企业发布决策和安全评估动态,不构成面向其他模型服务商的直接产品变更或监管规定。
本次更新:依据美联社报道整理新模型推迟发布的公开信息,并区分安全信号与产品、监管变更。
核验时间:2026 年 9 月 30 日;报道日期:9 月 29 日。美联社报道,OpenAI 推迟发布新模型 GPT-6.1 Astra。OpenAI 安全系统负责人 Saachi Jain 表示,该版本“尚未达到标准”;报道所述的考量包括模型执行任务时更持续地追求目标,以及需要防止未经授权的行为。公开报道没有给出新的发布日期。
一、这反映了什么变化
模型能力提升会带来更强的连续任务执行能力,也会增加权限配置错误、目标误解或工具使用越界后的影响。由此,安全评估不只是检查单轮输出,还要覆盖 Agent 在多步任务中的停止条件、权限范围、异常行为和外部副作用。一次推迟发布是单家公司的发布决策,但说明安全评估结果可以影响模型上线节奏。
二、对使用 Agent 的团队有什么参考
- 将高影响操作(删除、支付、发信、改权限、外部发布)设置为人工确认步骤。
- 限制 Agent 可访问的目录、命令、凭据和网络目标,并让授权与任务目的相匹配。
- 对可能超时或重复执行的任务增加停止条件、幂等保护和操作结果核验。
- 记录测试中的越权尝试和工具调用失败,并在模型或工具版本变化时复测。
三、不要从单条新闻推出的结论
这条报道没有宣布 GPT-6.1 Astra 的新发布时间,也没有说明模型已对公众开放。它不意味着所有 Agent 都必须停止运行,更没有改变 DeepSeek API 的价格、模型能力或服务条款。团队可以将其作为风险管理参考,仍应依据自己使用的模型、工具和适用要求制定上线门槛。
运营判断:Agent 的安全上线需要同时检查“能否完成任务”和“能否在权限边界内完成任务”。与其只依赖提示词,运营流程应让高风险操作可审批、可追踪、可撤销。
参考资料
以下资料用于支持本文中的版本、价格和接口说明。相关信息可能调整,请以来源页面的现行内容为准。