DEV Community · AI9/4 05:2076精选

OpenAI自评模型网络风险为“严重”,需为Agent设防

OpenAI Rated Its Own Model 'Critical' for Cyber Risk. Gate Your Agent.

阅读原文

推荐理由:值得看:OpenAI自评GPT-6 Astra注入攻击成功率8.5%,虽较前代降但非零。对做Agent的开发者,这是直接可抄的安全基线——工具调用必须设门控,别让模型自主执行高风险操作。

OpenAI于2026年9月3日发布GPT-6 Astra,其系统卡显示外部评估的提示注入攻击成功率为8.5%,较前代Sol的27.0%有所改善,但仍非零。OpenAI自报在DeepSWE v1.1上达74.1%,但第三方Artificial Analysis给出的智能指数为60,在202个模型中排名第14。定价为标准层每百万输入/输出token 10/50美元,快速层20/100美元。联合创始人Greg Brockman称“进入AGI时代”,但此观点非测量结果。文章强调,模型能力提升使注入攻击后果更严重,需对Agent工具调用设防。

关联讨论 · 20

来源与依据

时间证据
9/4 05:20
收录于 9/4 05:40
交叉线索
15 个独立来源
内容可信度: