4Sh9f0w76IO tech.huanqiu.comarticle多家巨头AI接连越狱、攻击、造假,行业迎来安全拐点/e3pmh164r/e3pmtmdvg【环球网科技综合报道】8月7日,据BBC报道,近期全球AI行业集中爆发多起模型失控事故,OpenAI、Anthropic、Meta三大科技巨头以及英国官方AI安全机构接连曝出前沿模型越界、越狱、尝试网络攻击等危险行为,让AI安全风险再度成为行业焦点。本轮安全风波始于7月底OpenAI模型攻破沙箱、私自联网越狱事件,被业内视作行业重大安全警钟。随后风险集中扩散:Anthropic的Claude模型多次违规联网;英国人工智能安全研究所在测评中发现,主流AI模型可伪造人类身份、尝试发起网络攻击;Meta也因测试配置失误,导致AI模型意外获取联网权限,出现越界行为。 BBC报道称,多起事故彻底打破了持续三十年的软件测试安全规则,原本可控的隔离测试环境,已成为AI风险的滋生地。专家分析,本轮事故成因各不相同,既有模型主动攻破安全壁垒,也有人为测试疏漏、配置失误导致的权限外泄,但核心警示一致:高阶AI模型自主能力大幅提升,传统安全测评、人工监管模式或已然失效。智能AI代理可替代人类处理日常琐碎工作,具备极高产业价值,但因其缺乏人类价值伦理判断,极易衍生欺骗、攻击等不可控行为。当前全球AI研发高速推进,模型能力持续迭代,而安全监管、测评体系严重滞后,人工干预难以全面规避风险。业内呼吁,各国需搭建专属AI安全测评机构,完善第三方可信测试机制,补齐法律监管短板,压实企业安全责任,在鼓励AI创新的同时,筑牢行业安全底线。(旺旺)1786069171835环球网版权作品,未经书面授权,严禁转载或镜像,违者将被追究法律责任。责编:秦耳环球网178606917183511[]//img.huanqiucdn.cn/dp/api/files/imageDir/9214342729156392fab1fa5fb8880a68u1.png{"email":"qiner@huanqiu.com","name":"秦耳"}
【环球网科技综合报道】8月7日,据BBC报道,近期全球AI行业集中爆发多起模型失控事故,OpenAI、Anthropic、Meta三大科技巨头以及英国官方AI安全机构接连曝出前沿模型越界、越狱、尝试网络攻击等危险行为,让AI安全风险再度成为行业焦点。本轮安全风波始于7月底OpenAI模型攻破沙箱、私自联网越狱事件,被业内视作行业重大安全警钟。随后风险集中扩散:Anthropic的Claude模型多次违规联网;英国人工智能安全研究所在测评中发现,主流AI模型可伪造人类身份、尝试发起网络攻击;Meta也因测试配置失误,导致AI模型意外获取联网权限,出现越界行为。 BBC报道称,多起事故彻底打破了持续三十年的软件测试安全规则,原本可控的隔离测试环境,已成为AI风险的滋生地。专家分析,本轮事故成因各不相同,既有模型主动攻破安全壁垒,也有人为测试疏漏、配置失误导致的权限外泄,但核心警示一致:高阶AI模型自主能力大幅提升,传统安全测评、人工监管模式或已然失效。智能AI代理可替代人类处理日常琐碎工作,具备极高产业价值,但因其缺乏人类价值伦理判断,极易衍生欺骗、攻击等不可控行为。当前全球AI研发高速推进,模型能力持续迭代,而安全监管、测评体系严重滞后,人工干预难以全面规避风险。业内呼吁,各国需搭建专属AI安全测评机构,完善第三方可信测试机制,补齐法律监管短板,压实企业安全责任,在鼓励AI创新的同时,筑牢行业安全底线。(旺旺)