排序
Gemma 4推测解码提速三倍:AI推理竞争开始转向工程效率
谷歌为Gemma 4开放Multi-Token Prediction推测解码,在不改变模型和输出质量的情况下最高提速三倍。推理优化正在重新计算本地部署、企业应用与AI基础设施的成本。
智谱GLM-5.2开源后,AI竞争开始拼长程任务闭环
智谱押注长程任务、Coding与开源生态,Claude Reflect、YC AI项目、Devin和MoleculeOS共同显示AI竞争正从模型回答转向任务协作、流程闭环与研发系统。
GPT-5.6灰度与GLM-5.2追赶后,模型竞争又回到开放、成本和可信度
GPT-5.6 Sol 灰度、GLM-5.2 追赶 Claude Mythos、DeepSeek 启动融资与开源模型继续提速,说明前沿模型竞争正在从单纯能力比拼,转向开放程度、调用成本、可信评测和工程落地的综合战。
华为开源openPangu-2.0-Pro后,国产大模型竞争开始拼软硬件生态
华为开源openPangu-2.0-Pro,叠加DeepSeek-V4-Flash、OpenCode、MiniMax H3与Gemini Robotics 2等重点资讯,AI竞争正在从模型跑分转向软硬件生态和真实任务落地。
OpenAI暂停高风险训练后,AI竞争开始重算安全、开源和算力底座
OpenAI 暂停下一代旗舰模型的强化学习训练,这个动作比单纯的新模型传闻更值得盯。它说明前沿模型公司已经开始把能力上限、安全边界和算力调度放到同一张表里计算:模型越接近高风险能力区,继...








