大模型掀起“越狱”竞赛

当前大模型领域出现越狱热潮,各团队通过设计提示词测试模型安全性,以此评判模型健壮性。 这种做法既反映了技术竞争,也推动安全防护升级。 让模型自行尝试突破限制,成为评估安全边界的新方式。

返回 AI资讯