核心信息

OpenAI的一名开发者在社交媒体回应中表示,提示注入正在行业范围内逐步得到解决,并称Astra是OpenAI迄今能力最强、也最对齐的模型。被引用的安全帖子补充说,OpenAI新模型在提示注入风险上与Gemini Flash和Opus 4.8大致相当,并认为公开点名各实验室会促使它们更重视安全。

要点

  • 提示注入被视为正在行业范围内解决的问题,Astra被称作OpenAI迄今最强、最对齐的模型。
  • 被引用帖子称,OpenAI新模型在提示注入风险上与Gemini Flash、Opus 4.8基本持平。
  • 公开评估并点名其他实验室,被视为推动其训练更对齐模型的有效方式,且仍有很大改进空间。
  • 该帖子还表示,Claude模型的提示注入问题已在实际中被解决约两个月。