排序
GPU不再闲着,AI推理基础设施开始变成硬仗
vLLM 与 SGLang 商业化、RadixArk 分拆融资,把 GPU 利用率和推理调度推到 AI 竞争核心。模型越强、Agent 越长程,真正决定产品能否规模化的,正在变成算力调度、成本控制和系统稳定性。
4B参数的Arko-T拿下8项第一,AI 3D模型开始从生成图片走向可编辑设计
4B参数的Arko-T在12项指标中拿下8项第一,并把自然语言直接转换为可编辑的CAD设计程序。AI模型竞争正在从参数规模转向结构化输出、推理成本和真实工作流。
英伟达押注SSI、GPU调度公司成独角兽后,AI竞争开始重算算力效率
英伟达押注SSI、Spectro Cloud融资、Kimi K3开源与SearchOS发布同时出现,AI竞争正在从模型能力转向算力供给、资源调度、开放模型和系统效率。
算力不够只是表象:AI公司开始把战场搬到GPU利用率和端侧模型
DeepSeek DSpark推理加速、GPU利用率讨论、端侧多模态模型与本地小模型共同指向同一个变化:AI竞争正在从堆参数走向效率工程。
H200采购松动,AI竞争从模型榜单打到算力和企业入口
H200采购松动、Cerebras绑定OpenAI、国产GPU开源链路与Anthropic企业市占率变化同场出现,AI竞争正在从模型榜单转向算力、工程和企业入口。







