返回行业动态

GPT-6 Astra 幻觉减少但隐藏提示词注入防御力下降

2026/09/04 19:16
查看原文

OmniTools 9月5日消息,OpenAI 新发布的 GPT-6 Astra 模型在幻觉问题上较前代 GPT-5.6 Sol 有所改善,但安全测试显示其对隐藏提示词注入攻击的防御能力存在明显局限。该模型对直接提示词注入的防御率达 99.99%,但在多轮自适应攻击场景下,防御率降至约 67%。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部