分类
类型
地域
产品
排序
DeepSeek Harness插件爆发,Agent入口转向开发者生态
DeepSeek Harness 的插件生态突然扩张,说明 Agent 产品的竞争已经不只发生在模型参数、上下文长度和单次回答质量上。GitHub 上带有 dsh-plugin 标签的仓库突破 700 个,开发者把多 Agent 团队...
Agent真实工作通过率偏低,模型路由和全上下文助手成了新焦点
RealReplicaBench 把一个刺眼的问题摆到了台面上:顶级模型已经能在不少考试型任务里拿高分,但一旦进入真实电商后台、软件界面和连续操作流程,Agent 的成功率仍然不稳。107 个真实工作任务中...
OpenAI暂停高风险训练后,AI竞争开始重算安全、开源和算力底座
OpenAI 暂停下一代旗舰模型的强化学习训练,这个动作比单纯的新模型传闻更值得盯。它说明前沿模型公司已经开始把能力上限、安全边界和算力调度放到同一张表里计算:模型越接近高风险能力区,继...
系统提示词泄露之后,AI模型安全开始进入可验证阶段
Fable 5.1系统提示词泄露、OpenAegis安全模型和iCoder工业Coding模型接连出现,AI竞争正从能力展示走向权限隔离、漏洞验证与可追溯交付。








