排序
1200万上下文模型亮相,大模型竞赛开始从参数转向效率
SubQ 的出现,把大模型竞争里一个长期被忽视的问题重新推到了台前:上下文窗口越做越长之后,真正决定可用性的,已经不只是“能塞多少 token”,而是长文本读写、推理速度和调用成本能不能一起...
Claude主动助手曝光,AI竞争转向工作流和云基础设施
Claude主动助手Orbit曝光,AWS算力长约、长上下文模型、推理提速和多Agent协作同步升温,AI竞争正从模型发布转向工作流入口与系统化交付。
国产GPU直通RDMA实测后,AI基础设施竞争开始重做数据通路
奇异摩尔和壁仞科技把国产GPU直通国产RDMA网卡的IBGDA方案拿出来实测时,AI算力竞争里一个长期被低估的问题被推到台前:模型能不能跑得快,不只取决于GPU本身,还取决于芯片之间、服务器之间、...
Qwen3.8-Max和千问办公一起上桌,AI入口争夺开始打进工作桌面
Qwen3.8-Max把总参数推到2.4万亿、激活参数做到950亿,这已经不是单纯“模型又大了一圈”的消息了。真正更值得盯住的是,阿里同时把千问办公、QoderWork、MuleRun、悟空这些产品线收拢到更统一...
亚马逊Trainium外售后,AI算力竞争开始从GPU走向云芯片生态
亚马逊计划对外出售自研AI芯片Trainium,叠加企业级AI部署、数据基础设施融资和多模型调度趋势,AI竞争正在从模型发布转向芯片、云平台和算力生态。







