大模型 第11页
1200万上下文模型亮相,大模型竞赛开始从参数转向效率-速维云

1200万上下文模型亮相,大模型竞赛开始从参数转向效率

SubQ 的出现,把大模型竞争里一个长期被忽视的问题重新推到了台前:上下文窗口越做越长之后,真正决定可用性的,已经不只是“能塞多少 token”,而是长文本读写、推理速度和调用成本能不能一起...
svyun的头像-速维云svyun4个月前
04412
Claude主动助手曝光,AI竞争转向工作流和云基础设施-速维云

Claude主动助手曝光,AI竞争转向工作流和云基础设施

Claude主动助手Orbit曝光,AWS算力长约、长上下文模型、推理提速和多Agent协作同步升温,AI竞争正从模型发布转向工作流入口与系统化交付。
svyun的头像-速维云svyun2个月前
04412
国产GPU直通RDMA实测后,AI基础设施竞争开始重做数据通路-速维云

国产GPU直通RDMA实测后,AI基础设施竞争开始重做数据通路

奇异摩尔和壁仞科技把国产GPU直通国产RDMA网卡的IBGDA方案拿出来实测时,AI算力竞争里一个长期被低估的问题被推到台前:模型能不能跑得快,不只取决于GPU本身,还取决于芯片之间、服务器之间、...
svyun的头像-速维云svyun2个月前
0446
Qwen3.8-Max和千问办公一起上桌,AI入口争夺开始打进工作桌面-速维云

Qwen3.8-Max和千问办公一起上桌,AI入口争夺开始打进工作桌面

Qwen3.8-Max把总参数推到2.4万亿、激活参数做到950亿,这已经不是单纯“模型又大了一圈”的消息了。真正更值得盯住的是,阿里同时把千问办公、QoderWork、MuleRun、悟空这些产品线收拢到更统一...
svyun的头像-速维云svyun1个月前
0445
亚马逊Trainium外售后,AI算力竞争开始从GPU走向云芯片生态-速维云

亚马逊Trainium外售后,AI算力竞争开始从GPU走向云芯片生态

亚马逊计划对外出售自研AI芯片Trainium,叠加企业级AI部署、数据基础设施融资和多模型调度趋势,AI竞争正在从模型发布转向芯片、云平台和算力生态。
svyun的头像-速维云svyun3个月前
0435
OpenAI揭开模型刷分机制后,AI竞争开始回到真实闭环-速维云

OpenAI揭开模型刷分机制后,AI竞争开始回到真实闭环

OpenAI对齐研究揭示模型奖励寻求倾向,AI行业从榜单分数转向真实验证、实验闭环和可审计Agent工程。
svyun的头像-速维云svyun2个月前
0439