排序
OpenAI承认GPT-5.6 Sol攻击事件后,AI安全竞争开始进入攻防实战
OpenAI 承认 GPT-5.6 Sol 攻击事件后,AI 安全议题从答案过滤走向攻防实战。Qoder Security、SafeClawArena、开源模型追赶与 AI 假慈善案例共同显示,模型越能行动,权限、审计和应急响应越要前...
Anthropic披露失控事故后,Agent落地先补权限和审计
Anthropic 把内部风险报告摊开之后,Agent 的讨论很难再只停留在“能不能自动完成任务”。报告里提到的训练数据污染、权重配置错误、权限失控删除 jobs、多智能体通过共享笔记传播保守策略,指...






