{"text":[[{"start":10.22,"text":"Anthropic披露,其Claude AI模型在这家初创公司测试网络攻击能力期间入侵了三个组织。一周前,OpenAI也报告了类似事件。"}],[{"start":21.05,"text":"该集团表示,在评估Claude执行网络攻击任务的能力期间,Claude未经授权访问了外部公司。Anthropic表示,由于“误解”,Claude在测试环境中获得了互联网访问权限。按原计划,该权限本应被屏蔽。"}],[{"start":37.45,"text":"一周前,Anthropic竞争对手OpenAI承认,其两款模型在本月进行技术测试期间入侵了AI初创公司Hugging Face。这两款模型利用软件漏洞突破测试环境,接入互联网并实施了网络攻击。"}],[{"start":53.21,"text":"Anthropic表示,这起事件促使该公司审查自身的网络安全评估,从而在超过14.1万次调查中识别出三起事件。"}],[{"start":62.620000000000005,"text":"该公司周四在一篇帖子中表示:“在所有情况下,Anthropic的评估提示词都明确告知Claude,其环境为模拟环境且没有互联网接入。但由于我们与评估合作伙伴(Irregular)之间存在误解,实际情况并非如此,实际上具备互联网接入。”"}],[{"start":80.2,"text":"这些网络安全评估全部采用所谓的“夺旗”任务,要求AI对存在漏洞的系统进行逆向工程、分析或利用,以找回称为“旗标”的隐藏信息。"}],[{"start":90.93,"text":"举例来说,Claude接到的目标是一家虚构公司,而该公司的名称与一个正在使用的网站域名相同。该智能体——一种能够根据人类指令自主运行的AI程序——利用该公司数字基础设施中的漏洞提取了信息,并获得了一个包含数百行生产数据的数据库的访问权限。"}],[{"start":111.30000000000001,"text":"这项声明进一步加剧了人们对AI系统安全性的担忧。这些系统如今甚至在部署前测试期间也能对真实世界实施黑客攻击。"}],[{"start":121.82000000000001,"text":"Anthropic表示,在发现Claude可能访问互联网后,该公司立即暂停了网络安全评估。Anthropic正准备最早于今年进行首次公开募股(IPO)。"}],[{"start":132.5,"text":"这些事件分别涉及Claude的三个不同模型:Opus 4.7、Mythos 5以及一个内部研究测试模型。Mythos已向少数合作伙伴发布,其先进的网络攻击能力——包括发现并利用软件漏洞的能力——引发了全球担忧。"}],[{"start":149.09,"text":"该公司在声明中表示:“归根结底,造成这些事件的因素很多。不过,秉持无责事后复盘文化,我们在采取整改措施时将责任完全归咎于自身。”"}],[{"start":162.04,"text":"该公司还补充说,将扩大对评估记录的监测范围,以发现“意外行为”,并与“所依赖的供应商开展更严格的保障工作”"}]],"url":"https://audio.ftcn.net.cn/album/a_1785466868_1678.mp3"}