OpenAI“Astra”获得人类证明
对话式聊天机器人退场,通用人工智能时代开启

“如需证明您不是机器人,请点击所有包含红绿灯的方格。”


使用互联网时,令人不胜其烦的“验证游戏”随处可见。如今,人工智能开始比人类更完美地完成这类任务。OpenAI最新推出的下一代模型“Astra”完全通过了用于区分人类与机器人的“验证码”测试。

“验证码”的典型验证测试“图像匹配”。Fortinet供图

“验证码”的典型验证测试“图像匹配”。Fortinet供图

View original image

当地时间8日,OpenAI开发人员Sharif Shamin通过X(原Twitter)表示,对新人工智能模型“GPT-6 Astra”进行“我不是机器人”测试的结果显示,该模型破解了共48个步骤的全部关卡,获得了“人类证明”。

区分人类与人工智能的验证装置“验证码”防线被突破

“验证码”即“用于区分计算机与人类的全自动公开图灵测试”,是一项用于确认数字世界用户是否为真实人类的安全技术,主要用于拦截未经授权抓取网站内容的爬虫机器人等。

验证码认证页面。盖蒂图片社供图

验证码认证页面。盖蒂图片社供图

View original image

测试通常会显示“我不是机器人”字样。其形式包括识别扭曲文字,或选出含有红绿灯、饼干、狗等特定物体的图片;难度之高,连真实人类也时常答错。


Astra通过全部测试表明,其基于图像识别的时空推理能力、对指令的理解及上下文推理能力,以及直接操作计算机的技术,已进化至与人类相当的水平。


随着商用人工智能连区分人类与机器人的最后一道防线也被瓦解,互联网安全行业未来亟须制定大规模应对措施。人工智能模型性能分析机构Artificial Analysis近期调整评价体系,将Astra的智能排名从原先的并列第5位上调至并列第1位。

“人类都容易搞错,竟连闯48关?”……通过最后防线“我不是机器人”测试的人工智能究竟为何方神圣 View original image

“超越人类”的智能体人工智能登场

4日发布的旗舰模型“Astra GPT-6”不仅能够回答问题,还主张成为可实际执行行动的“智能体人工智能”。


OpenAI介绍称,Astra仅用5分27秒便完成了人类约需30分钟的宠物寄养服务搜索;对于人类需花费5小时的求职信息搜索,Astra则仅用2分51秒便完成。

“人类都容易搞错,竟连闯48关?”……通过最后防线“我不是机器人”测试的人工智能究竟为何方神圣 View original image

凭借这类性能,英伟达(NVIDIA)首席执行官Jensen Huang宣称“通用人工智能已经到来”,引发全球科技业关注。不过,业内普遍认为,由于通用人工智能尚缺乏明确的定义与标准,仍应保持谨慎态度。

“通用人工智能时代”下安全性的两面性

尤其是,Astra在安全与可靠性方面呈现出明显的两面性。OpenAI在内部评估中表示:“Astra未经授权行动的比例已降至0%,一致性得到提升。”


此外,为将黑客能力转用于防御目的并降低滥用风险,该公司还公布了一项规模达10亿美元(约1.35万亿韩元)的网络安全防御支持计划。

“人类都容易搞错,竟连闯48关?”……通过最后防线“我不是机器人”测试的人工智能究竟为何方神圣 View original image

但另一方面,外界提出,该模型在发布前可能自行发现并利用网络安全漏洞;同时,其存在隐藏推理过程的倾向,或将加大人类监督难度,这类担忧也持续存在。



尽管如此,业内专家积极评价称:“过去人们询问人工智能‘能否进行推理’,如今已进入可以问‘能否把复杂工作交给它后放心离开’的时代。”专家们认为,围绕通用人工智能何时到来的争论本身,正证明技术发展的速度。


本报道由人工智能(AI)翻译技术生成。

版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。