智能叛变?︱Anthropic旗下AI模型测试失控 擅入三公司系统

加拿大都市网

人工智能(AI)研发公司Anthropic周四(30日)发文承认,旗下AI模型在隔离测试过程中,未经授权进入三间外部机构的系统。

据法新社报道,Anthropic在分析逾14.1万次测试结果后,发现旗下三款Claude模型,包括Claude Opus 4.7、Claude Mythos 5及一个内部研究模型,曾利用弱密码及未设身份验证的端点,成功进入三间外部机构系统。

与合作伙伴发生误解所致

Anthropic表示,入侵活动发生最早发生在4月,当时Claude被要求执行在模拟网络中寻找隐藏资讯的“夺旗”任务,相信事故原因为与测试合作伙伴Irregular沟通出现误解,致使模型在测试期间连接至互联网。

Anthropic续指,公司23日开始审查评估纪录,并在发现旗下模型有疑似入侵行为证据的当天,立即暂停所有网路安全评估,并于27日通知三间受影响的机构,其中两间公司未有发觉系统遭骇。

今次是继OpenAI旗下模型发生多宗自行入侵事件后,再有大型AI企业发生模型突破隔离测试环境事故。据悉,Anthropic与OpenAI于今年先后推出AI模型“Mythos”与“Sol”,事件引发业界对AI代理(AI Agents)系统的安全忧虑,更促使日前超过千名员工发起联署,要求美国政府放慢AI发展步伐。
 

share to wechat

延伸阅读

延伸阅读

熊本地震︱专家揭“S级”警戒或再有7.3级强震 福冈成另一高风险区域

东京上野突落冰雹 网民狼狈避难:像世界末日︱有片

印尼23呎巨蟒吞人 腹部剖开惊见尸体 35岁男惨死

医疗事故|俄女脚痛针灸反致无法站立 照X光惊见10余断针留体内