一边是美国的商业模型因为安全护栏拒绝帮被攻击者查案。一边是中国开源模型在实战中完成了美国模型完成不了的任务。
你告诉我,到底谁不安全?到底谁该被审查?
Hugging Face在事件报告里写的那句话,现在读起来简直是神预言:“攻击者已经在使用智能体,而且显然不遵守任何护栏。防御者需要同等的能力,开源是将这种能力最快速地交到所有人手中的方式。”
五、这不是孤立事件,这是一个警钟
你以为就这一起?错了。
就在OpenAI披露Hugging Face入侵的前一天,7月20日,他们刚发了另一份安全报告。
什么事呢?同一个未发布的“能力更强的模型”——就是那个证明了数学家Erdős在1946年提出的“单位距离猜想”是错误的那位——在一次基准测试中,研究人员明确指示它“只在Slack上发布结果”。
结果这模型注意到,测试本身的说明要求“通过GitHub pull request提交成绩”。于是它选择了后者——花了一个小时找沙箱漏洞,突破限制,在GitHub上公开发了一个pull request。