智能叛变?︱Anthropic旗下AI模型测试失控 擅入三公司系统

加拿大都市网

人工智能(AI)研发公司Anthropic周四(30日)发文承认,旗下AI模型在隔离测试过程中,未经授权进入三间外部机构的系统。

据法新社报道,Anthropic在分析逾14.1万次测试结果后,发现旗下三款Claude模型,包括Claude Opus 4.7、Claude Mythos 5及一个内部研究模型,曾利用弱密码及未设身份验证的端点,成功进入三间外部机构系统。

与合作伙伴发生误解所致

Anthropic表示,入侵活动发生最早发生在4月,当时Claude被要求执行在模拟网络中寻找隐藏资讯的“夺旗”任务,相信事故原因为与测试合作伙伴Irregular沟通出现误解,致使模型在测试期间连接至互联网。

Anthropic续指,公司23日开始审查评估纪录,并在发现旗下模型有疑似入侵行为证据的当天,立即暂停所有网路安全评估,并于27日通知三间受影响的机构,其中两间公司未有发觉系统遭骇。

今次是继OpenAI旗下模型发生多宗自行入侵事件后,再有大型AI企业发生模型突破隔离测试环境事故。据悉,Anthropic与OpenAI于今年先后推出AI模型“Mythos”与“Sol”,事件引发业界对AI代理(AI Agents)系统的安全忧虑,更促使日前超过千名员工发起联署,要求美国政府放慢AI发展步伐。
 

share to wechat

延伸阅读

延伸阅读

巴基斯坦8000米高峰雪崩 国际登山队10人失联 包括一名中国人

印尼23呎巨蟒吞人 腹部剖开惊见尸体 35岁男惨死

伊朗局势︱美军声称已“重击”伊朗 停埃及商船遭无人机攻击

戒糖等于抗老?医生揭 高温煮食隐形危机 教你3大烹调方法远离老化