大模型 第16页
1200万上下文与Gemma提速同台出现,大模型开始拼效率和入口-速维云

1200万上下文与Gemma提速同台出现,大模型开始拼效率和入口

SubQ把上下文窗口拉到1200万token,谷歌让Gemma 4推理最高提速3倍,Luma、TRAE SOLO和多Agent工具也同步推进。大模型竞争正在从参数和榜单,转向效率、成本、入口和真实落地能力。
svyun的头像-速维云svyun33天前
02811
OpenAI押注企业部署,Claude锁定算力:AI竞争进入系统交付深水区-速维云

OpenAI押注企业部署,Claude锁定算力:AI竞争进入系统交付深水区

OpenAI成立企业部署公司,Anthropic锁定AWS算力,SubQ、Gemma、Agent与多模态工具同步推进,AI竞争正在从模型发布走向基础设施、企业工作流和系统交付。
svyun的头像-速维云svyun33天前
0287
OpenAI自进化降本后,AI基础设施竞争开始拼效率-速维云

OpenAI自进化降本后,AI基础设施竞争开始拼效率

GPT-5.6 Sol 自主优化生产 GPU 内核降低推理成本,叠加 Azure 增长、跨集群推理架构和企业多模型迁移,AI 竞争正从单纯模型能力转向基础设施效率与交付能力。
svyun的头像-速维云svyun22天前
02810
谷歌把 Gemma 4 推快 3 倍后,本地大模型开始拼执行效率-速维云

谷歌把 Gemma 4 推快 3 倍后,本地大模型开始拼执行效率

Gemma 4 通过 Multi-Token Prediction 将推理速度最高提到 3 倍,SubQ 也把超长上下文和低成本一起往前推,AI 产品竞争正在从会说转向会做。
svyun的头像-速维云svyun15小时前
0288
SubQ拉长上下文,Gemma提速三倍:大模型竞争转向工程化效率-速维云

SubQ拉长上下文,Gemma提速三倍:大模型竞争转向工程化效率

SubQ 将上下文推到 1200 万 token,Gemma 4 通过推测解码提升推理速度,Agent 协作层和 AI 应用继续升温,AI 竞争正在从模型榜单转向工程化效率。
svyun的头像-速维云svyun33天前
02713
OpenAI给Astra紧急补洞后,AI公司开始重写安全和算力账本-速维云

OpenAI给Astra紧急补洞后,AI公司开始重写安全和算力账本

OpenAI Astra 触及关键安全阈值、闭源模型送测、Anthropic 造芯和实时视频模型开源共同说明,AI竞争正在从能力展示走向安全、算力和工作流治理。
svyun的头像-速维云svyun14天前
2715