排序
35M小模型与可验证代码模型开源后,AI竞争开始重算有效参数
BarunLM用35M参数挑战小模型效率,清华VeriLoop Coder-E1把验证反馈引入代码模型自我改进,AI竞争正在从单纯扩大规模转向有效参数、可验证流程和真实应用闭环。
Om AI端侧模型、Meta编程Agent和太空算力同台,AI竞争开始拼系统闭环
端侧模型开始讲效率 Om AI 联汇公布 VLX-Seek 1.5,把这波 AI 模型竞争的一个新方向摆到了台面上:模型不只是要在云端更强,也要在更小的设备上更能干活。它强调端侧原生、流式多模态和物理世界...
1200万上下文与Gemma提速同台出现,大模型开始拼效率和入口
SubQ把上下文窗口拉到1200万token,谷歌让Gemma 4推理最高提速3倍,Luma、TRAE SOLO和多Agent工具也同步推进。大模型竞争正在从参数和榜单,转向效率、成本、入口和真实落地能力。
SubQ拉长上下文,Gemma提速三倍:大模型竞争转向工程化效率
SubQ 将上下文推到 1200 万 token,Gemma 4 通过推测解码提升推理速度,Agent 协作层和 AI 应用继续升温,AI 竞争正在从模型榜单转向工程化效率。






