最新发布第72页
排序
1200万上下文模型亮相,大模型竞赛开始从参数转向效率
SubQ 的出现,把大模型竞争里一个长期被忽视的问题重新推到了台前:上下文窗口越做越长之后,真正决定可用性的,已经不只是“能塞多少 token”,而是长文本读写、推理速度和调用成本能不能一起...
谷歌让 Gemma 4 提速三倍,端侧大模型竞争转向推理效率
谷歌为 Gemma 4 推出推理提速方案,在不改变模型、不降低输出质量的前提下提升生成效率,本地部署和企业内网 AI 应用迎来更现实的落地空间。
OpenAI加码企业部署,Claude锁定算力:AI竞争正在从模型榜单转向系统交付
OpenAI加码企业部署,Anthropic锁定云算力并推进安全审计,谷歌与英伟达押注AI科研自动化,AI竞争正在从模型能力走向系统交付、基础设施和商业化入口。
Gemini 3.5 与 Qwen3.7 同场提速,AI 竞争从模型榜单打到系统交付
Gemini 3.5、Qwen3.7、Anthropic 自托管 Agent 与 H100 供应紧张同场出现,AI 竞争正在从模型榜单走向系统交付。







