OpenAI 发布 GPT‑6 Astra:计算机操作能力跃升,企业默认仍需显式开启
新模型进入 ChatGPT、API、Azure 与 Bedrock,能力、权限、价格和安全限制必须放在同一张验收表。
本文核心看点
OpenAI 于 9 月 3 日发布 GPT‑6 Astra,重点提升计算机操作、浏览、软件工程、科学与专业工作能力。模型正分阶段进入 ChatGPT,并通过 OpenAI API、Microsoft Azure 与 AWS Bedrock 提供;企业工作区在发布时默认关闭,需要管理员主动启用。官方同时披露更高的网络安全能力等级、更强护栏和新的价格信息,团队上线前应复测权限、成本与回滚。
直接回答
OpenAI 于 9 月 3 日发布 GPT‑6 Astra,重点提升计算机操作、浏览、软件工程、科学与专业工作能力。模型正分阶段进入 ChatGPT,并通过 OpenAI API、Microsoft Azure 与 AWS Bedrock 提供;企业工作区在发布时默认关闭,需要管理员主动启用。官方同时披露更高的网络安全能力等级、更强护栏和新的价格信息,团队上线前应复测权限、成本与回滚。
事实来源
GPT‑6 Astra 正分阶段提供给 ChatGPT Plus、Pro、Business 和 Enterprise 用户,并通过 OpenAI API、Microsoft Azure 与 AWS Bedrock 提供。企业管理员在发布时需要主动开启访问。
OpenAI 公布的标准 API 价格为每百万输入 token 10 美元、每百万输出 token 50 美元,缓存读写另计;Fast 模式标称最高两倍速度,并按标准价格的两倍计费。具体可用性和账单仍应以账号控制台为准。
OpenAI 将 Astra 评为其 Preparedness Framework 下的 Critical 网络安全能力等级。公开版本会拒绝更高级的利用开发任务,并增加模型鲁棒性、监控和高风险使用保护。
核心变化
- 计算机与浏览器操作成为核心能力
- 企业工作区默认关闭访问
- 标准与 Fast 两种速度价格层
- 关键网络安全能力配套更强限制
对普通 AI 用户的影响
普通用户会看到更强的跨应用执行能力,但模型能操作表单、文件和业务系统,也意味着错误可能从“回答不准确”升级为“真实状态被改变”。组织上线前要把可访问应用、可写字段、支付或删除动作、超时、日志和回滚逐项写清;涉及敏感领域时仍需要适当专业人员参与。
给团队的操作清单
- 用 10 至 20 个真实但已脱敏的任务建立本地验收集。
- 按读取、建议、草稿写入和真实执行四级拆分工具权限。
- 同时测量成功率、事实错误、越权尝试、首字延迟、总耗时和总费用。
- 先在小范围开启,保留旧模型配置和一键停止开关。
AI 前沿资讯与趋势解读、AI 软件应用与模型工具、AI 技能教程与验证方法、AI 账号服务与权限说明
FAQ
Astra 是否会自动出现在企业工作区?
发布时不会。OpenAI 表示企业管理员需要主动开启;具体计划和地区可用性应在控制台确认。
官方榜单可以直接作为采购结论吗?
不可以。榜单是供应商证据,任务分布、工具环境和成本口径可能不同,仍需用自己的任务复测。
计算机操作代理最先应该限制什么?
先限制高影响写操作、外部发送、付款、删除和权限变更,并对每次真实执行保留可审计回执。
总结
Astra 的价值取决于能否把更强执行能力装进可验证、最小权限且可回滚的工作流,而不是只把模型名称换进现有流程。
本文由 AI 辅助撰写;发布前由 ENHE AI 自动化审计核对官方来源、双语字段、图片权利、页面安全与历史去重。
这对普通用户意味着什么?
普通用户会看到更强的跨应用执行能力,但模型能操作表单、文件和业务系统,也意味着错误可能从“回答不准确”升级为“真实状态被改变”。组织上线前要把可访问应用、可写字段、支付或删除动作、超时、日志和回滚逐项写清;涉及敏感领域时仍需要适当专业人员参与。
你可能会用到这些工具
相关教程
相关工具/教程
你可以从下面的 ENHE AI 栏目继续把资讯信号转成工具选择、账号服务判断或实操学习路径。
相关阅读
Navier–Stokes|OpenAI 公布 AI 生成解答,Lean 形式化仍待独立数学审查
OpenAI 于 9 月 8 日公布一份由内部 AI 系统生成的 Navier–Stokes 千年难题解答,主张构造了从光滑初态发展到有限时间奇性的流体运动,并同时发布论文与 Lean 形式化证明。官方披露该项目使用大规模多代理协作,Navier–Stokes 阶段约产生 270 万条消息和 1300 亿输出 token;OpenAI 不申领奖项。现阶段应把它视为重大候选成果,等待独立专家复核、代码检查与复现。
Google 发布 Gemini 3.8 Flash 与 Flash Cyber,低成本代理和防御工作获得同代升级
Google 于 9 月 2 日发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber。官方将 Flash 定位为面向软件工程、代理任务和多步推理的高性价比工作马,并保持与上一代相同的入门价格;Flash Cyber 则针对网络防御场景。发布说明强调更强的代码、工具调用和关键推理能力,并把模型放入 Google Cloud 的防御产品体系。对团队而言,真正需要核算的是每个任务的端到端成本、工具权限和安全监控,而不是只看模型名称或单项基准。
如何安全采用Slack与Teams中的AI智能体?一份可验收的协作审批清单
如何安全采用Slack与Teams中的AI智能体?一份可验收的协作审批清单。官方信息显示,这项更新会改变普通用户完成在团队聊天中上线AI代理前验证权限、审批、日志和回滚的入口或权限。本文核对一手来源,区分公开预览与已可用操作,并列出账号条件、数据范围、成本、人工复核、日志和回滚检查。读者应先用低风险、可重复的小任务验收,再决定是否扩大,不能把公告当成普遍效果或无条件免费承诺。
AI工作流如何从辅助走向执行?一份可引用的权限与验收清单
OpenAI于2026年8月12日发布两项企业AI研究,报告称截至6月,Codex占企业客户中Codex与ChatGPT合计输出token的64%,前沿企业每活跃用户输出量是典型企业的8.3倍。上述数据描述OpenAI客户样本中的使用差异,不证明代理直接造成收入或效率提升。团队要把AI从回答问题推进到执行任务,应先选择一个可回滚流程,明确输入、工具、权限、输出、人工负责人和停止条件,再用成功率、返工、耗时、成本、风险事件及回滚结果决定是否扩大。
OpenAI预览GPT-5.6 Sol Ultrafast:最高14倍速度,但仍是限量API预览
OpenAI于2026年8月13日预览GPT-5.6 Sol Ultrafast,称其在Cerebras硬件上最高可达标准版本14倍、输出速度最高约每秒750个token,并首先通过API向部分客户开放。它不是ChatGPT全面上线,也未公布统一价格或普遍可用日期。开发者应先确认邀请资格与地域,再用同一长上下文、结构化输出或代理任务比较首字延迟、总耗时、质量、费用、限流和失败重试,避免只凭峰值速度更换生产模型。
Kimi K3 与 Qwen3.8-Max 怎么选?从版本状态到同任务评测
本文按“核心看点、直接回答、事实来源、同任务评测、FAQ与总结”的结构,更新 Kimi K3 与 Qwen3.8-Max 的模型状态、接口边界和选型方法。资料核验截至 2026 年 9 月 5 日,重点解释 Qwen3.8-Max-Preview 下线后的正式调用 ID、qwen3.8-max-0902 快照、区域能力、价格与限流等易变信息,并给出可复现的质量、延迟、成本、稳定性和回滚记录方法。


