首页 - 股票 - 研报 - 行业研究 - 正文

传媒行业动态跟踪:GPT 6 Astra:长流程Agent任务的旗舰模型

(以下内容从华福证券《传媒行业动态跟踪:GPT 6 Astra:长流程Agent任务的旗舰模型》研报附件原文摘录)
投资要点:
一、事件概述:Astra发布,长流程Agent能力再提升
据OpenAI模型文档,GPT-6Astra于2026年9月3日发布,提供1,050,000token上下文窗口、128,000最大输出token。API定价为每百万输入10美元、每百万输出50美元,为上一代GPT-5.6Sol(4美元/20美元)的2.5倍。据OpenAI官网评价,GPT6Astra为世界头部的电脑操作能力(ComputerUse)模型之一,在处理繁琐的长流程任务中,体现出前沿的速度、准确性和安全性。
另外,据Techcrunch引述,9月1日TheInformation称GPT-6Astra可能采取一种“循环深度”的推理技术,即在生成下一个令牌之前,将信息多次传递给同一Transformer层。
二、三大特点:电脑操作、视觉与多模态、安全能力同步跃升
电脑操作能力端(ComputerUse):Astra在长程ComputerUse任务中表现领先,并在已在上下文机制层面同步完成配套改造。据OpenAI发布信息,Astra在Agents'LastExam得分59.3%,高于GPT-5.6Sol的53.6%与ClaudeOpus5的55.5%,该测试考察模型在真实电脑环境中跨软件、终端与文件完成多步骤长流程任务的能力。机制侧,配合Astra的Codex可跨上下文窗口保存工作笔记并检索此前的消息与工具输出,而非仅依赖一次压缩摘要。
视觉与多模态端:视觉能力已越过图像识别的门槛,进入结构理解与生成阶段,对办公软件、浏览器、专业软件理解和操作能力增强。据OpenAI发布信息:界面理解上,ScreenSpot-Pro(无工具)得分92.7%,高于Sol的76.9%;三维重建上,BenchCAD取得95.9%的几何重合度评分,高于Sol的83.3%。
安全能力端:Astra的网络安全能力较上一代显著跃升,是其被定为Critical等级的直接依据。据OpenAI发布信息,Astra在ExploitBench取得100%(Sol为78.5%),并在评测中发现并利用了两个此前未知的零日漏洞。
三、长程Agent任务对上下文空间和KVCache存储需求提升
使用ComputerUse的长程Agent操作,涉及连续循环的工具调用、截图、代码执行等行为,直至任务完成,需要大量上下文空间并产生大量KVCache。且若TheInformation所述的“循环深度”推理技术确实应用于GPT6,每轮循环或将产生各自的KVCache需要维护。
四、投资建议
海外旗舰模型迈入长程Agent推理时代,带动硬件端存储需求进一步提升,建议关注海外前沿大模型和海外存储板块。
风险提示:
大模型应用竞争激烈,大模型推理竞争激烈





APP下载
广告
下载证券之星
郑重声明:以上内容与证券之星立场无关。证券之星发布此内容的目的在于传播更多信息,证券之星对其观点、判断保持中立,不保证该内容(包括但不限于文字、数据及图表)全部或者部分内容的准确性、真实性、完整性、有效性、及时性、原创性等。相关内容不对各位读者构成任何投资建议,据此操作,风险自担。股市有风险,投资需谨慎。如对该内容存在异议,或发现违法及不良信息,请发送邮件至jubao@stockstar.com,我们将安排核实处理。如该文标记为算法生成,算法公示请见 网信算备310104345710301240019号。
网站导航 | 公司简介 | 法律声明 | 诚聘英才 | 征稿启事 | 联系我们 | 广告服务 | 举报专区
欢迎访问证券之星!请点此与我们联系 版权所有: Copyright © 1996-