摘要

MIT Technology Review 报道称,OpenAI 开发了名为 GPT-Red 的大语言模型,将其作为“对练伙伴”测试其他模型对网络攻击的防御能力。报道还称,OpenAI 表示这类训练提升了其最新旗舰模型的稳健性。

影响

如果报道属实,这反映出模型开发方正尝试用自动化对抗测试来发现网络安全薄弱点。但输入未提供 OpenAI 的官方公告、技术细节或独立验证材料,不能据此确认具体能力、适用范围或效果。

原始来源:MIT Technology Review