人工智能公司Anthropic发布报告,宣布成功拦截利用其模型研发生物武器的尝试,并揭露黑客窃取凭证与武器设计的行为。

人工智能技术快速演进的同时,其潜在的安全风险也日益凸显。人工智能公司Anthropic在其发布的安全调查中指出,在过去8个月里,对其智能助手Claude受到的非法使用行为进行了深入排查。调查显示,有科研人员试图引导模型辅助生物武器研发,同时还有黑客组织将该技术用于监控、虚假宣传以及常规武器的设计。

在生物安全领域,区分合规的科学研究与恶意的致病菌开发难度极大。因为研发突破性疫苗与改造危险病原体,在前期往往使用相同的技术手段。面对这种模糊边界,Anthropic采取了严格的预防措施,对可疑提示词实施拦截。

在具体案例中,曾有科研人员向智能模型咨询关于屈公病毒的突变问题,意图提高该病毒在重复感染动物时的致病能力。鉴于早期模型在安全防护上的局限,Anthropic随后升级了安全屏障,进一步限制对具有双重用途的生物研究查询。

除了生物安全隐患,前沿AI模型还面临着多维度的网络滥用威胁。在过去8个月中,部分具有政府背景的黑客团伙利用智能助手对异见群体进行网络监视。同时,个别媒体机构利用该模型批量生成虚假新闻,例如在摩尔多瓦选举期间制造并传播虚假报道,以此操纵网络舆情。

在常规武器开发方面,也有黑客尝试借助模型编写用于枪支、导弹、武装无人机和炸弹设计的软件。随着前沿模型能力的提升,攻击者将获取AI访问权限视为核心目标。黑客通过泄露的密钥、会话令牌或受感染设备,在暗网上建立起盗窃与转售凭证的非法产业链。一些黑客甚至伪装成合规的AI服务提供商,向用户分发恶意软件以窃取账号凭证。

例如,说俄语和乌克兰语的黑客组织GTG50021中,有一名代号为klizy的黑客。该团伙开设了虚假的AI转售平台,以廉价订阅为诱饵吸引用户。当用户登录时,系统会将请求转发至其他模型,同时后台植入的木马会盗取用户的Anthropic账号凭证并二次售卖。

另一个以经济利益为驱动的黑客组织GTG50020,在一次网络入侵中从受害者处窃取了约26GB的数据,并勒索150万美元至250万美元的赎金。

面对日益复杂的网络威胁与生物安全挑战,限制对高风险和双重用途查询的访问,已成为防范人工智能滥用的重要手段。

原文:https://www.firstpost.com/tech/anthropic-says-it-disrupted-attempts-to-misuse-ai-for-biological-weapons-research-14044809.html