排序
MoE路由被重复Token打崩后,AI基础设施开始补安全和部署短板
港科大RepetitionCurse揭示MoE路由在重复Token输入下可能导致GPU负载严重失衡,沐曦GPU开源生态、因果世界模型和Kimi K3等动态共同说明,AI竞争正在从模型能力转向可部署、可审计、可持续运行的...
无人机直连卫星传Token后,AI基础设施竞争开始重算带宽和算力
TeleAI把无人机高清视频编码为Token序列并通过卫星低带宽传回,清微智能、是石科技等团队也把国产芯片生态和Token优化推到前台。AI基础设施竞争正在从单点模型能力转向通信、算力、吞吐和真实场...
国产GPU直通RDMA实测后,AI基础设施竞争开始重做数据通路
奇异摩尔和壁仞科技把国产GPU直通国产RDMA网卡的IBGDA方案拿出来实测时,AI算力竞争里一个长期被低估的问题被推到台前:模型能不能跑得快,不只取决于GPU本身,还取决于芯片之间、服务器之间、...
GPU不再闲着,AI推理基础设施开始变成硬仗
vLLM 与 SGLang 商业化、RadixArk 分拆融资,把 GPU 利用率和推理调度推到 AI 竞争核心。模型越强、Agent 越长程,真正决定产品能否规模化的,正在变成算力调度、成本控制和系统稳定性。







