SubQ共1篇
谷歌把 Gemma 4 推快 3 倍后,本地大模型开始拼执行效率-速维云

谷歌把 Gemma 4 推快 3 倍后,本地大模型开始拼执行效率

Gemma 4 通过 Multi-Token Prediction 将推理速度最高提到 3 倍,SubQ 也把超长上下文和低成本一起往前推,AI 产品竞争正在从会说转向会做。
svyun的头像-速维云svyun1小时前
0288