AI安全共34篇
OpenAI揭开模型刷分机制后,AI竞争开始回到真实闭环-速维云

OpenAI揭开模型刷分机制后,AI竞争开始回到真实闭环

OpenAI对齐研究揭示模型奖励寻求倾向,AI行业从榜单分数转向真实验证、实验闭环和可审计Agent工程。
svyun的头像-速维云svyun15天前
0369
Meta外包测试竞品后,AI安全竞争开始进入审计和供应链阶段-速维云

Meta外包测试竞品后,AI安全竞争开始进入审计和供应链阶段

Meta外包测试竞品引发争议,叠加Anthropic越狱分级和AI技能包供应链风险,AI竞争正从能力展示进入安全审计、权限治理和可信交付阶段。
svyun的头像-速维云svyun28天前
498
Claude被切开大脑后,AI安全开始从拦截答案转向检查思考过程-速维云

Claude被切开大脑后,AI安全开始从拦截答案转向检查思考过程

Claude内部机制研究、推理轨迹风险、Agent压力测试和中间状态管理同步升温,AI安全正在从结果过滤转向过程可解释与可验证。
svyun的头像-速维云svyun28天前
0239
翁荔谈Harness工程后,AI自我提升开始回到工具、记忆和评估闭环-速维云

翁荔谈Harness工程后,AI自我提升开始回到工具、记忆和评估闭环

翁荔新博客将AI自我提升拉回工程现场:工具调用、记忆管理、评估闭环和算力底座,正在决定Agent能否持续可靠地完成真实任务。
svyun的头像-速维云svyun28天前
518
Grok CLI代码上传争议之后,AI编程工具必须先补权限边界-速维云

Grok CLI代码上传争议之后,AI编程工具必须先补权限边界

Grok CLI 被曝默认上传代码库与本地配置后,AI 编程工具的竞争不再只是模型能力和额度价格,而是权限边界、端侧处理、执行审计与企业信任体系的全面较量。
svyun的头像-速维云svyun28天前
439
蚂蚁开源AI安全框架后,Agent热潮开始补上执行前刹车-速维云

蚂蚁开源AI安全框架后,Agent热潮开始补上执行前刹车

蚂蚁安全开源AI安全框架、阶跃星辰端侧模型、OpenAI Codex额度变化和具身智能新进展共同说明:AI Agent正在从能力演示走向真实执行,权限边界、审计机制和端云协同开始成为竞争核心。
svyun的头像-速维云svyun28天前
359