推理效率共3篇
算力不够只是表象:AI公司开始把战场搬到GPU利用率和端侧模型-速维云

算力不够只是表象:AI公司开始把战场搬到GPU利用率和端侧模型

DeepSeek DSpark推理加速、GPU利用率讨论、端侧多模态模型与本地小模型共同指向同一个变化:AI竞争正在从堆参数走向效率工程。
svyun的头像-速维云svyun1个月前
419
1200万上下文与Gemma提速同场出现,大模型不只是在抢算力-速维云

1200万上下文与Gemma提速同场出现,大模型不只是在抢算力

SubQ长上下文、Gemma推理提速、Claude算力长约与Agent工具升温,显示AI竞争正在转向效率、基础设施和真实工作流。
svyun的头像-速维云svyun25天前
0409
GenCeption把视频生成变成理解底座后,AI竞争开始走向真实世界-速维云

GenCeption把视频生成变成理解底座后,AI竞争开始走向真实世界

谷歌 DeepMind 与何恺明参与的 GenCeption 研究,把视频生成模型推到了一个更值得讨论的位置:它不只是“会生成视频”的创作工具,也可能成为理解视频世界的通用视觉系统。这个方向的关键变化在...
svyun的头像-速维云svyun29天前
02215