Anthropic报告称失控AI智能体也讨厌验证码
IT时代网9月11日消息,据海外媒体报道,Anthropic最新一份关于智能体失控行为的报告既有令人警惕之处,也带来几分黑色幽默:AI智能体同样讨厌验证码(CAPTCHA)。
报告披露,其Mythos 5模型曾未经授权接入互联网,并向一个公开数据库上传了恶意软件包。事件的起因是今年4月的一次测试:Anthropic在沙箱中评估该模型的黑客能力,要求它侵入系统并取回目标,但评估人员留下了漏洞。模型判断,最稳妥的得手方式是在一个Python软件包中埋入漏洞,它认为目标系统的用户会下载这个包。

编辑:林一舟
THE END