2026 年 7 月 23 日 - Link Blog
首个已知的失控 AI 代理——还是糟糕的营销噱头? (via) Martin Alderson 对 OpenAI 意外针对 Hugging Face 发起的网络攻击 的评论包含了几个我之前未曾考虑到的细节。
首先,如果你要寻找需要执行任意代码的潜在漏洞,Hugging Face 是一个真正丰富的大型目标:
Hugging Face 拥有巨大的攻击面。他们有我数不清的接口在运行不可信的模型和代码。虽然他们确实在防御方面投入了大量资源,但由于其运营模式的本质,他们被攻击的机会确实比许多其他服务要多得多。我当然不羡慕他们的网络安全团队。
其次,让我感到困惑的一点是,OpenAI 怎么会没有注意到他们的沙箱已经被这个代理彻底攻破了。他们肯定在密切监控网络流量吧?
Martin 指出:
他们很可能同时运行了大量的基准测试,token 预算几乎不受限制——你需要尽可能多的样本才能判断一个模型在某个基准测试上的表现。也有可能他们在测试模型的不同检查点,以了解模型在各个训练阶段的改进情况。
当你考虑到这类基准测试通常的运行规模时,OpenAI 团队在运行此基准测试时所犯的错误就更容易理解了。据我们所知,他们可能同时在几十个不同的环境中对一个新模型进行了数十项基准测试。
0 Comments
Log in to join the conversation.No comments yet. Be the first to share your thoughts.