大模型 第17页
谷歌把 Gemma 4 推快 3 倍后,本地大模型开始拼执行效率-速维云

谷歌把 Gemma 4 推快 3 倍后,本地大模型开始拼执行效率

Gemma 4 通过 Multi-Token Prediction 将推理速度最高提到 3 倍,SubQ 也把超长上下文和低成本一起往前推,AI 产品竞争正在从会说转向会做。
svyun的头像-速维云svyun1个月前
0338
DeepSeek融资近500亿元并启动IPO准备:大模型公司进入经营与基础设施竞争-速维云

DeepSeek融资近500亿元并启动IPO准备:大模型公司进入经营与基础设施竞争

DeepSeek融资与IPO准备释放出大模型公司进入组织化经营阶段的信号,后训练平台、AI硬件和具身智能基础设施也在同步扩张。
svyun的头像-速维云svyun11天前
0338
接入大模型 API 之前,最好先想清楚这几个问题-速维云

接入大模型 API 之前,最好先想清楚这几个问题

很多团队在接入大模型 API 时,最开始只关注“能不能调通”,却忽略了成本、速率限制、兼容性和数据安全。本文会整理几个接入前最好先想清楚的关键问题。
svyun的头像-速维云svyun5个月前
577
OpenAI押注企业部署,Claude锁定算力:AI竞争进入系统交付深水区-速维云

OpenAI押注企业部署,Claude锁定算力:AI竞争进入系统交付深水区

OpenAI成立企业部署公司,Anthropic锁定AWS算力,SubQ、Gemma、Agent与多模态工具同步推进,AI竞争正在从模型发布走向基础设施、企业工作流和系统交付。
svyun的头像-速维云svyun2个月前
0347
Anthropic拟押注SpaceX算力,OpenAI用Token换股权:AI竞争进入资源绑定战-速维云

Anthropic拟押注SpaceX算力,OpenAI用Token换股权:AI竞争进入资源绑定战

Anthropic被曝拟向SpaceX采购近450亿美元算力,OpenAI则用模型Token绑定YC创业公司,DeepSeek降价扩容,AI竞争正在从模型榜单转向算力、开发者和企业工作流的资源绑定。
svyun的头像-速维云svyun2个月前
557
英伟达绑定下一代存储后,AI基础设施竞争从GPU烧到系统工程-速维云

英伟达绑定下一代存储后,AI基础设施竞争从GPU烧到系统工程

英伟达与SK海力士合作研发AI工厂下一代存储,Kimi融资、Agent后训练和端侧算力同步升温,AI竞争进入系统工程阶段。
svyun的头像-速维云svyun2个月前
477