{"text":[[{"start":7.57,"text":"前沿人工智能正在失控。先是有披露称,Anthropic和OpenAI的AI智能体侵入了外部机构。随后,本周英国人工智能安全研究所(AI Security Institute)发布了一份令人震惊的报告称,这两家公司的旗舰模型使用虚假身份绕过代码审查,侵入了一个第三方开发者平台,表现出前所未有的欺骗能力。这绝不仅仅是利用测试流程中的漏洞。它表明,前沿人工智能模型已经超越文本生成,成为能力极强的自主行动者——而且其演进速度已经超过了确保其安全并受到控制的努力。"}],[{"start":45.8,"text":"距Anthropic的Claude Mythos Preview因逃出“数字牢笼”而登上新闻头条,才过去不到四个月。一些业内人士起初怀疑,这起事件以及Anthropic和OpenAI其他模型近期的逃逸事件,都是旨在展示最新技术实力的营销活动。"}],[{"start":62.839999999999996,"text":"但本周的警告并非来自这些公司,而是来自英国安全实验室。该实验室报告称,Anthropic的Mythos 5和OpenAI的GPT-5.6 Sol在一次网络安全评估中曾“持续从事可能造成危害的活动”,不过这次评估是在一个测试环境中进行的,一些独立专家认为该环境过于宽松。Mythos 5试图在GitHub平台上的一个开源项目中植入恶意代码,并创建虚假网络身份,向人工审核员施压,促使他们批准这段代码。"}],[{"start":94.16,"text":"对于美国大型人工智能实验室而言,真正的终极目标——通用人工智能,即达到人类水平的认知能力——按照技术层面的定义,或许仍需数年才能实现。不过,许多人会认为,最新模型在推理、规划和欺骗方面的能力已经相当接近这一目标。本周有消息称,人工智能已被用于创造自然界中不存在的病毒,这进一步展示了这项技术的潜力及其风险。"}],[{"start":121.88,"text":"这意味着,各实验室自身必须承担更大的责任,在开发系统、保障系统安全以及监测系统运行方面更加谨慎,并对这些工作进行适当审计。测试环境也需要进一步完善。应避免采取过于严厉的全面人工智能监管措施,但近期发生的事件清楚表明,最前沿的模型在发布前必须接受强制性的安全检查。"}],[{"start":146.60999999999999,"text":"特朗普(Trump)政府最初曾嘲讽人工智能“安全”政策,认为这些政策会阻碍美国创新,如今则一直在努力追赶。本周,白宫召集美国人工智能巨头举行会议,概述了一项拟议框架:开发者将在前沿人工智能系统公开发布前30天,向联邦安全专家开放系统访问权限,不过这项安排名义上仍属于自愿性质。"}],[{"start":170.89,"text":"具有讽刺意味的是,许多行业领袖都意识到,一旦其模型引发灾难性事件,他们可能面临潜在的责任风险,因此反而主张采取比美国政府目前提议的措施更进一步的行动。即将不再负责谷歌DeepMind日常运营、转任董事长的德米斯·哈萨比斯(Demis Hassabis)呼吁成立一个由联邦政府监督的公私合作联盟。他提议设立的“前沿人工智能标准机构”(Frontier AI Standards Body)将由业界出资,在模型发布前开展测试,涵盖从网络安全到生物威胁和核威胁等各种风险。"}],[{"start":204.26999999999998,"text":"美国企业在人工智能领域处于领先地位,因此由美国率先主导安全保障工作是不可避免的。但要实施有效管控,很快就需要开展国际合作;中国开源人工智能模型的能力正在迅速追赶。围绕如此敏感的技术开展美中合作或许看似困难,但预计习近平主席将于9月访问华盛顿,届时两国将就人工智能安全与安保问题举行会谈。在冷战时期,尽管美国、苏联以及其他核大国在相关技术领域彼此竞争,但最终还是开始合作降低武器带来的风险。如果前沿人工智能领域也要出现类似的合作,那么核武器领域历时数年才完成的进程,就必须压缩到数月之内。"}]],"url":"https://audio.ftcn.net.cn/album/a_1786279605_8782.mp3"}