算力共33篇
DeepSeek、Kimi 与 Claude 同时升温,AI 竞争进入算力和工作流阶段-速维云

DeepSeek、Kimi 与 Claude 同时升温,AI 竞争进入算力和工作流阶段

DeepSeek、月之暗面和 Anthropic 接连出现在融资与算力消息里,OpenAI 则把触角伸向硬件、广告和实时交互。几条新闻放在一起看,大模型竞争已经不只是参数和榜单之争,而是在比谁能同时拿到资金...
svyun的头像-速维云svyun3个月前
06015
长上下文和推理提速同时冒头,AI竞赛开始拼工程效率-速维云

长上下文和推理提速同时冒头,AI竞赛开始拼工程效率

SubQ、Gemma 提速与 SonicMoE 同时出现,说明大模型竞争正在从榜单发布继续下沉到长上下文、低延迟、高吞吐和企业级交付能力。
svyun的头像-速维云svyun1个月前
03214
GPT-5.6 Sol降价后,AI算力竞争开始重算成本和芯片-速维云

GPT-5.6 Sol降价后,AI算力竞争开始重算成本和芯片

旗舰模型降价、芯片自研和开源推理同时推进,AI 产业链开始重新计算成本、控制力与交付方式。
svyun的头像-速维云svyun31天前
3514
DeepSeek造芯曝光后,模型竞争开始向算力底座下沉-速维云

DeepSeek造芯曝光后,模型竞争开始向算力底座下沉

DeepSeek自研AI推理芯片进展曝光,模型公司正在从参数与榜单竞争,走向芯片、工具链、供应链和应用落地的系统竞争。
svyun的头像-速维云svyun1个月前
05013
单卡5090跑满血DeepSeek后,消费级硬件开始接管大模型推理-速维云

单卡5090跑满血DeepSeek后,消费级硬件开始接管大模型推理

FreeToken 让单卡 5090 跑起 DeepSeek-V4-Flash,AI 推理开始从云端回流到消费级硬件,部署方式、成本结构和应用入口都在重排。
svyun的头像-速维云svyun31天前
03713
Muse Spark 1.3减少25% Token消耗,Agent模型开始按任务结果决胜-速维云

Muse Spark 1.3减少25% Token消耗,Agent模型开始按任务结果决胜

Meta Muse Spark 1.3把Agent竞争推进到长任务执行:工具调用减少约20%,Token消耗降低约25%,模型开始用更少的动作完成更复杂的工作。
svyun的头像-速维云svyun19天前
04112