中文科技资讯
业界资讯 互联网 手机资讯 电脑硬件 数码产品 家电产品 APP应用 手机游戏 美通快讯

GPT-6 Astra发布:多项突破引领AI跃迁,OpenAI迈入AGI新纪元

2026-09-04来源:互联网编辑:瑞雪

OpenAI正式推出新一代旗舰模型GPT-6 Astra,被公司总裁格雷格·布罗克曼称为人工智能领域的“代际跃迁”。这款代号“Astra”(拉丁语意为“星辰”)的模型整合了预训练、强化学习与对齐研究领域的最新成果,官方宣称其为“全球最智能且对齐程度最高的模型”。在发布会上,布罗克曼直言:“欢迎来到AGI时代。”

基准测试数据显示,GPT-6 Astra在多个关键领域表现惊人:FrontierMath Tier 4数学评测得分98%,已接近理论极限,甚至能解决部分长期悬而未决的数学难题;ARC-AGI-3通用推理测试得分99.9%,近乎完美;网络安全测试ExploitBench和软件工程基准DeepSWE v1.1分别取得100%和74.1%的成绩,后者较竞品Claude Fable 5.1高出6.7个百分点。其上下文窗口扩展至105万token,最大输出12.8万token,知识截止时间为2026年4月30日。

计算机使用能力的突破是GPT-6 Astra的核心亮点。该模型可自主完成在线表格填写、CRM系统更新、日程管理等复杂任务,还能进行科学数据分析、图表生成、网站创建及前端质量检查。在OSWorld 2.0延迟模拟测试中,其任务完成率达72.6%,耗时约40分钟,较前代模型GPT-5.6 Sol(65.7%完成率、75分钟耗时)性能提升显著,耗时减少47%。结合更新的Codex harness后,Mind2Web基准测试中的任务完成速度提升1.9倍。针对专业场景,Astra能处理多步骤工作流,生成高质量文档、电子表格和演示文稿,尤其擅长遵循现有模板创建布局精良的幻灯片。

安全与对齐方面,GPT-6 Astra实现质的飞跃。OpenAI设计的新评估显示,当面对不可能完成的任务时,前代模型GPT-5.6 Sol在缺乏防护措施的情况下有48%的测试案例超出授权范围,而Astra的越界比例降至0%。该模型在网络安全风险评估中获评“关键”级别,开发过程中曾针对一次安全事件加强防护措施。OpenAI强调,用户可更放心地将任务委托给Astra,其在理解用户意图和约束模型行为方面有实质性提升。

商业应用层面,GPT-6 Astra已取得金融建模、工程设计等领域的重大进展。其定价为前代模型GPT-5.6 Sol的2.5倍,API价格为每百万输入token 10美元、输出token 50美元。开放策略上,初期仅向参与OpenAI Daybreak Access网络安全项目的部分组织和企业用户提供,后续逐步扩展至ChatGPT Plus、Pro、Business和Enterprise用户,并通过OpenAI API和AWS平台提供服务。公司透露,未来AI行业可能转向按任务而非按token收费的模式。

平房区新牧社区星火科技馆开馆 常态化科普活动提升居民科学素养
平房区新伟街道新牧社区星火科技馆作为分会场同步开展活动,70余名科普网格员参与仪式,并线上集中观看全省开馆仪式及星火科技馆建设宣传片。 集中开馆仪式全面展示了全省基层科普阵地建设成果,为辖区科普工作者搭建学习…

2026-09-03

告别机顶盒时代!广电新规开启,客厅看电视迎来极简新体验
新买电视:新款一体化电视直接内置直播解码模块,不用外接任何盒子,电视自带遥控器就可以换台、回看、调音量,直播、点播统一在一个系统界面,操作逻辑大幅简化。 家里已经有老电视:不用直接换整机,可以使用体积小巧的…

2026-09-03

九月科技盛宴来袭!小米华为同日发布折叠屏新机,多品牌旗舰蓄势待发
这款小米数字系列的全新折叠屏机型将搭载全新的小米玄戒O3 AI旗舰SoC、新一代小米澎湃OS 4、Xiaomi MiMo端侧大模型,还有新一代龙骨转轴。后续华为和小米还会举办发布活动推出新一代的旗舰迭代机型…

2026-09-03

天津网络空间安全论坛:周鸿祎揭AI攻防新局,360“倚天屠龙”显实力
360集团创始人周鸿祎作主题分享,认为AI已改变网络攻防格局,传统方案难以为继,需打造以"以模治模"为核心的自动化攻防新体系,同时披露了360"倚天屠龙"两大产品的最新实战数据。 周鸿祎表示,AI时代网络空间…

2026-09-03

TCL华星牵头制定柔性显示新标准 折痕测试开启科学量化新篇章
【CNMO科技消息】近日,由TCL华星牵头制定的《柔性显示器件 第5-5部分:折痕测试 图像反射法》(标准号:SJ/T 11847.5.5-2026)电子行业标准正式发布,于2026年9月1日正式实施。该标准…

2026-09-02

OpenAI 即将推下一代 AI 模型 Astra,达“关键”门槛但功能访问受限
此外,OpenAI 还警告称,Astra的安全防护措施可能会错误地将合法的防御性网络安全活动标记为滥用行为,从而导致任务被减慢、暂停甚至终止(IT之家注:OpenAI 根据网络安全工作的性质分为“蓝队”防…

2026-09-02