5天前

OpenAI推出GPT-Red模型,自动发现修复提示注入漏洞

新闻图片

OpenAI被曝已在内部推出自动化红队模型“GPT-Red”,用于在大规模场景中发现并修复提示注入漏洞,目前暂处封闭测试阶段。 这一举措顺应了大模型行业近一年在自动化红队、提示词安全测试框架以及网络安全专用模型上的密集布局,包括开源红队框架OpenRT、提示词安全工具链以及面向网络安全的GPT-5.5-Cyber等产品。

8 来源
OpenAI内部推出自动化红队模型GPT-Red,瞄准提示注入风险
大规模自动化红队:GPT-Red如何运作与定位
提示注入漏洞为何成为AI安全“首要战场”
行业与监管影响:自动化红队走向常态化
本内容由AI生成