AI安全 第6页
GPT-5.6发布被踩刹车:前沿模型为什么要先过安全闸门-速维云

GPT-5.6发布被踩刹车:前沿模型为什么要先过安全闸门

GPT-5.6被要求分阶段发布,前沿模型竞争正在从能力展示转向安全审查、模型路由、Agent边界和系统交付。
svyun的头像-速维云svyun2个月前
4513
GPT-5.5-Cyber上线后,AI安全竞争开始回到工程治理-速维云

GPT-5.5-Cyber上线后,AI安全竞争开始回到工程治理

OpenAI推出GPT-5.5-Cyber与Codex Security插件,同时Codex日志写入问题暴露AI开发工具链风险。AI安全竞争正在从模型能力走向可审计、可回滚、可治理的系统工程。
svyun的头像-速维云svyun2个月前
03913
DeepSeek识图翻车后,多模态AI开始接受安全与信任考验-速维云

DeepSeek识图翻车后,多模态AI开始接受安全与信任考验

DeepSeek识图全量上线后暴露多模态稳定性问题,OpenAI与Anthropic推进身份验证和安全测试,AI产品竞争正在从能力展示转向可信边界。
svyun的头像-速维云svyun1个月前
04411
Claude Fable 5安全风波后,前沿模型竞争开始进入审计时代-速维云

Claude Fable 5安全风波后,前沿模型竞争开始进入审计时代

Claude Fable 5安全分类器被绕过与前沿AI审计讨论升温,显示大模型竞争正在从能力展示走向安全边界、第三方测试、企业治理和可信交付。
svyun的头像-速维云svyun1个月前
2814
Claude Fable 5道歉后,AI竞争开始补上透明边界和可信审计-速维云

Claude Fable 5道歉后,AI竞争开始补上透明边界和可信审计

Anthropic为Claude Fable 5的隐形安全限制公开道歉,把一个原本偏技术细节的问题推到了行业台前:前沿模型不只要更会写代码、更会做研究、更会理解复杂任务,还要让用户知道它什么时候被限制、...
svyun的头像-速维云svyun1个月前
0495
Claude宕机疑似串出他人对话,企业AI开始补上隐私与可靠性底座-速维云

Claude宕机疑似串出他人对话,企业AI开始补上隐私与可靠性底座

Claude服务异常引发数据隔离担忧,企业AI从模型能力竞争转向可靠性、隐私保护、权限审计和运行时治理。
svyun的头像-速维云svyun1个月前
02711