Anthropic发布PC端AI代理
微软、OpenAI也在开发…复杂任务轻松完成
信息操纵、窃取等PC滥用风险引发担忧

# 客户公司A要求发送与“供应商请求事项”相关的资料。数据零散地分布在电脑文档各处。与其翻找文档,不如向人工智能(AI)模型“Claude”发出请求。于是Claude开始移动电脑鼠标,打开Excel文件,搜索A公司,但没有找到需要的内容。这一次,Claude进入客户关系管理(CRM)网站进行搜索,一边向下滚动页面,一边查找与A公司相关的内容,并据此撰写资料。




这是本月22日,被视为OpenAI强劲对手的Anthropic公开的视频中的一个片段。Anthropic基于最新AI模型“Claude 3.5 Sonnet”推出了一项名为“Computer Use”(电脑使用)的功能。字面意思就是让AI直接使用电脑,替代人类完成复杂任务。与以往那种把文件交给AI模型,分步骤下达“帮我找特定内容”“把找到的内容文档化”等指令的方式相比,这一功能又进化了一步。它是首个能够使用电脑,一次性完成分步骤操作的AI模型。


要操控电脑,其实需要相当复杂的操作能力,包括观看并理解屏幕内容的能力、根据画面内容推理出在何时、以何种方式执行特定操作的能力,以及使用软件的能力等。看起来只是简单的点击操作,但要在预期位置点击,就必须准确计算出光标在垂直或水平方向上需要移动多少像素。


通过训练获得这些能力的Claude,已经可以自主使用电脑。可以说是自动化的“最终形态”,但反过来说,也可能引发近乎灾难性的事件。出于这种担忧,Anthropic的信任与安全(Trust & Safety)团队对模型的潜在脆弱性进行了排查。首先,AI在使用电脑时,有可能执行用户未下达的指令,或者无视命令。实际上,Anthropic在录制演示视频时,就曾因为Claude误操作而中途停止录制,导致视频消失;Claude有时在执行命令的过程中,还会突然跑去看照片,做与任务无关的事情。


如果超越这些“可爱的小失误”,有意恶意利用电脑,就可能引发危险后果。为防止这种情况,Anthropic在设计时就禁止AI执行“高风险操作”,例如在社交媒体上创建账号或发布帖子,以及访问政府网站等。此外,鉴于美国大选临近,Anthropic还表示,已阻断生成并传播与选举相关文案、参与与选举有关活动等操作。


能够自主完成复杂任务的AI代理竞争正变得日益激烈。上月21日,微软(Microsoft)发布了“自主代理(autonomous agents)”功能。所谓自主代理,是一种能够自主判断并采取行动的AI系统,可以从简单的重复性任务到复杂的决策过程,自动化完成各种工作,从而为用户提供业务支持。


MS Copilot Studio【图片由MS提供】

MS Copilot Studio【图片由MS提供】

View original image

微软计划下月在“Copilot Studio”中提供创建自主代理的功能,用户可以根据需要自行打造并使用AI助理。微软还分享了英国宠物护理公司Pets at Home的代理案例:该公司开发了一个协助销售管理团队的代理,预计每年可节省数亿韩元的成本。


此外,微软还将在其商务应用“Dynamics 365”中引入10种自主代理,例如:▲调查潜在客户群信息、梳理优先攻克顺序并发送定制化邮件的销售代理;▲检查供应链状况并感知、应对延误问题的供应链代理;▲协助客户服务咨询的客户管理代理等。



处在AI战争最前线的OpenAI又如何布局?在Anthropic推出会“用电脑”的AI后,立刻有消息称OpenAI也已经开发出类似的代理。根据IT专业媒体《The Information》的报道,OpenAI已经进行了能够在电脑上执行任务的代理的内部演示,并且可以进行编程工作的编码代理已经在实际使用中。有消息称,AI代理可以通过互联网订购外卖,在编码出现问题时,还能自行浏览网站寻找解决方案。OpenAI首席执行官(CEO)Sam Altman曾表示,“与代理相比,ChatGPT的智能水平简直不值一提”,由此可见其早已投入代理研发。既然Anthropic已经率先凭借AI代理抢占先机,舆论预计OpenAI也将在不久后公开相关技术。


本报道由人工智能(AI)翻译技术生成。

版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。