AI基础设施 第2页
腾讯Hyra刷新科研纪录后,AI Agent竞争开始进入工程化深水区-速维云

腾讯Hyra刷新科研纪录后,AI Agent竞争开始进入工程化深水区

腾讯混元 Hyra 把科研智能体推向模型迭代和科学发现流程,平头哥开源 AI 软件栈、小红书向量检索降本、应用宝 Marvis 与安全评测共同显示 AI Agent 正在进入工程化深水区。
svyun的头像-速维云svyun1个月前
04815
MoE路由被重复Token打崩后,AI基础设施开始补安全和部署短板-速维云

MoE路由被重复Token打崩后,AI基础设施开始补安全和部署短板

港科大RepetitionCurse揭示MoE路由在重复Token输入下可能导致GPU负载严重失衡,沐曦GPU开源生态、因果世界模型和Kimi K3等动态共同说明,AI竞争正在从模型能力转向可部署、可审计、可持续运行的...
svyun的头像-速维云svyun1个月前
5414
Anthropic 和亚马逊签下 5GW 算力大单后,AI 竞争开始从模型转向供电和入口-速维云

Anthropic 和亚马逊签下 5GW 算力大单后,AI 竞争开始从模型转向供电和入口

Anthropic 和亚马逊签下 5GW 算力大单,OpenAI 同步推进广告主平台和默认免费模型,AI 竞争开始从模型名次转向供电、入口和商业化分流。
svyun的头像-速维云svyun27天前
04714
首字延迟降成业务指标后,AI落地开始重算基础设施账本-速维云

首字延迟降成业务指标后,AI落地开始重算基础设施账本

TensorCast 把首字延迟、张量生命周期、模型路由和企业 Agent 权限管理推到同一张基础设施账本上,AI 落地竞争正在从模型参数转向系统工程。
svyun的头像-速维云svyun37天前
5113
DeepSeek V4-Flash把一亿Token账单打到8元,模型竞争开始拼可用成本-速维云

DeepSeek V4-Flash把一亿Token账单打到8元,模型竞争开始拼可用成本

DeepSeek V4-Flash极限实测、Claude Code框架消耗对比、OpenCode增长与OpenAI降价共同说明,AI竞争正进入单位智能成本阶段。
svyun的头像-速维云svyun52天前
5113
SubQ超长上下文和Gemma提速同台出现后,AI基础设施开始重算推理成本-速维云

SubQ超长上下文和Gemma提速同台出现后,AI基础设施开始重算推理成本

SubQ 超长上下文、Gemma 推理加速和 OpenAI 实时语音架构同台出现,说明 AI 竞争正在从参数规模转向推理成本、低延迟和可持续调用。
svyun的头像-速维云svyun45天前
05013