“聪明家伙不休息一直干活”……这次来的“新人”真厉害[一键看产业]
GPT-6点燃计算大战
“人工智能可独自工作数小时”
超越简单问答,直接执行工作
面向长期推理的计算重要性提升
随着OpenAI推出新一代人工智能模型“GPT-6 Astra”,证券业预计,人工智能自主执行工作的时长将大幅增加,人工智能产业的竞争格局也将发生重大变化。
7日,三星证券研究员Lee Youngjin表示:“GPT-6 Astra最重要的变化,是在无需人类干预的情况下,能够自主持续完成任务的时间跨度(Time Horizon)得到扩展。人工智能市场的竞争标准也将超越是否拥有单纯模型,延伸至实际能够处理多少工作。”
自主执行时间延长……执行环境设计决定性能
Astra提升了长时间使用计算机及工具、执行复杂多步骤任务,以及同时调用多个智能体的能力。超越单一问题的正确率,能够在数小时内自主完成任务的能力,已成为拉开实际生产力差距的关键因素。
该研究员指出:“Astra首次在OpenAI安全评估框架中达到网络安全‘严重(Critical)’级别。这并非仅仅意味着掌握了更多漏洞知识,而是基于其探索实际系统、发现新漏洞并解决问题的能力提升。”
他还基于抽象与推理语料库—通用人工智能3(ARC-AGI-3)的评估结果,强调了执行环境的重要性。Lee Youngjin表示:“即便是同一模型,根据状态管理及上下文维持方式的不同,性能也会产生约37个百分点的差异。未来人工智能竞争中,除模型本身的性能外,如何设计记忆、工具和执行环境,使其能够长时间稳定工作,也将变得至关重要。”
人工智能加速人工智能研究……计算基础设施需求持续增长
随着人工智能被正式投入开发下一代人工智能的研究工作,研究加速现象也愈发明显。OpenAI研究团队中,每1个研究人员工作日可执行相当于约3.1个工作日的智能体任务;一名研究人员可并行运行多个智能体,将编程、调试、实验执行及结果分析等工作交由其完成。
该研究员预计:“研究处理量和生产率的提升,进一步带动人工智能性能改善的飞轮结构正在形成。随着人类时间逐步不再构成瓶颈,计算作为决定研究速度的约束条件,其重要性将进一步上升。”
分析认为,即使模型效率改善使单项任务所需的词元和成本下降,随着可交由人工智能处理的工作范围扩大、并行智能体运行增加,整体推理和计算需求反而可能呈爆发式增长。
价值评估转向“每项任务成本”
软件产业同样面临结构性变革。随着智能体能够跨越多个软件执行整个业务流程,企业面临的课题是:不能仅提供单一功能,还须将自身产品升级为智能体的核心执行环境。
Lee Youngjin补充道:“人工智能的价值衡量标准已从以每词元价格为中心的比较,转向每项任务成本。未来,相较于每词元价格,工作成功率、完成任务的成本以及可节省的工时等,将成为判断人工智能经济性的重要指标。”
版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。