最新发布第139页
排序
Agent真实工作通过率偏低,模型路由和全上下文助手成了新焦点
RealReplicaBench 把一个刺眼的问题摆到了台面上:顶级模型已经能在不少考试型任务里拿高分,但一旦进入真实电商后台、软件界面和连续操作流程,Agent 的成功率仍然不稳。107 个真实工作任务中...
谷歌把 Gemma 4 推快 3 倍后,本地大模型开始拼执行效率
Gemma 4 通过 Multi-Token Prediction 将推理速度最高提到 3 倍,SubQ 也把超长上下文和低成本一起往前推,AI 产品竞争正在从会说转向会做。
万相Wan3.0模型上线、小米发布玄戒O3等AI芯片后,AI应用竞争开始回到真实入口
这一天的 AI 行业动态有一个共同指向:AI 大模型不再只围绕参数、榜单和演示视频竞争,而是在代码开发、内容生产、办公入口、终端设备、商业化结算和安全治理里寻找真实落点。万相Wan3.0视频生...
GPT-6 Astra能力首次公开:AI安全进入双向加速时代
OpenAI首次公开Astra(GPT-6)能力,在授权漏洞利用测试中达到100%成功率,网络安全能力约为前代模型四倍。文章分析强模型参与漏洞发现、代码修复与安全研发后,企业如何通过权限、沙箱和审计把...










