最新发布第158页
排序
Claude锁定5GW算力、OpenAI组建部署公司后,AI竞争从模型战转向交付战
Claude 与亚马逊签下十年期 AWS 算力协议,锁定约 5GW 训练与部署资源,这条消息把大模型竞争的底层账本摊到了台前。它不只是 Anthropic 多拿了一张云服务订单,也意味着头部模型公司正在用长期...
瓴羊260步Agent和GenOffice刷屏后,企业AI开始拼流程交付
瓴羊260步业务Agent、GenOffice办公成品、Today AI个人助手、DeepSeek Harness插件化框架和Gemini 3.7 Flash低成本模型共同说明,企业AI竞争正在从模型能力转向可交付工作流。
Claude拿下哈达玛矩阵,AI研究和组织重排同时发生
哈达玛矩阵 Claude与研究人员合作构造出668阶哈达玛矩阵后,AI在数学研究中的位置又往前挪了一步。哈达玛矩阵不是普通的计算题,它要求矩阵中的元素取值为加一或减一,并且任意两行都保持正交。...
CodeRabbit估值冲到15亿美元,AI代码审查开始争夺研发变更入口
CodeRabbit 完成 1.43 亿美元 C 轮融资、估值达到 15 亿美元之后,AI 代码审查不再只是开发者工具里的一个小功能。它正在从“帮工程师看几行代码”,走向更靠近研发流程核心的位置:理解一次变...
DeepSeek Harness插件爆发,Agent入口转向开发者生态
DeepSeek Harness 的插件生态突然扩张,说明 Agent 产品的竞争已经不只发生在模型参数、上下文长度和单次回答质量上。GitHub 上带有 dsh-plugin 标签的仓库突破 700 个,开发者把多 Agent 团队...
Agent真实工作通过率偏低,模型路由和全上下文助手成了新焦点
RealReplicaBench 把一个刺眼的问题摆到了台面上:顶级模型已经能在不少考试型任务里拿高分,但一旦进入真实电商后台、软件界面和连续操作流程,Agent 的成功率仍然不稳。107 个真实工作任务中...
















