全球资源网科技频道讯:继OpenAI、Anthropic的模型失控后,又一家科技公司的模型也失控了,它便是Meta。
据《The information》援引知情人士报道,Meta与一个名为Irregular的外部评估合作伙伴进行了测试,在测试期间,由于“沙盒”测试环境的设置错误,人工智能能够访问公共互联网,Meta的Muse Spark 1.1入侵了一家公司的系统,并改变了其内部系统,
Meta发言人表示,Irregular导致了配置错误,该模型随后“以类似于之前与其他公司报告的实例的方式”利用了另一个第三方服务中的安全漏洞。
Irregular的发言人表示,Meta事件并不涉及模型的复杂网络行动,并且“目前没有未决问题”。发言人表示,Irregular正在编写一份白皮书,概述了网络评估的遏制和安全执行的最佳实践。
OpenAI和Anthropic最近几周披露的类似事件引发了人们对先进人工智能安全影响的担忧。
上周,Anthropic对其系统的审查发现,其人工智能模型在网络安全测试期间也利用了互联网接入。Anthropic表示,由于测试环境中的配置错误,这些模型到达了互联网,该环境也由Irregular管理,随后这些模型访问了三个组织的系统。
Irregular的发言人周三表示,Meta事件涉及“与Anthropic上周已经披露的完全相同的评估环境问题”。
此前,OpenAI上个月表示,其模型在网络安全测试期间入侵了模型存储库Hugging Face,之后进行了人类披露。ChatGPT制造商指示其人工智能代理在本应是孤立的沙盒中解决特定的软件漏洞,但该模型弄清楚了如何访问互联网并闯入Hugging Face的系统,以找到测试的答案。
OpenAI和Anthropic表示,他们正在采取措施加强测试实践。
周二,英国人工智能安全研究所发布了一份报告,详细介绍了Anthropic的Mythos 5和OpenAI的GPT-5.6-Sol人工智能模型对个人和组织采取行动的事件。AISI表示,在一个案例中,一名人工智能特工使用社会工程,操纵人类泄露敏感信息的策,试图为开源项目获得恶意代码的批准。人工智能代理创建了虚假的在线身份,并利用它们向项目维护者施压,要求他们批准代码。
AISI报告的事件发生在网络安全测试期间,在测试中,模型可以访问互联网,但它们强调了人工智能代理在追求其指定目标时可能需要的长度。
人工智能行业的人也呼吁制定更好的安全协议。上个月,Meta、OpenAI、Anthropic和Google等公司的1100多名高级管理人员和员工签署了公开信,呼吁各国政府“支持国际努力,开发必要的技术和治理工具,以刻意加快自动化人工智能发展的前沿步伐。”




