最新发布第78页
Token贷落地广东后,AI算力成本开始被金融化-速维云

Token贷落地广东后,AI算力成本开始被金融化

广东首个 Token 贷把 AI 企业的 Token 消耗、合同和算力成本纳入授信视角,AI 商业化开始从模型能力竞争走向成本、交付和治理能力竞争。
MoE路由被重复Token打崩后,AI基础设施开始补安全和部署短板-速维云

MoE路由被重复Token打崩后,AI基础设施开始补安全和部署短板

港科大RepetitionCurse揭示MoE路由在重复Token输入下可能导致GPU负载严重失衡,沐曦GPU开源生态、因果世界模型和Kimi K3等动态共同说明,AI竞争正在从模型能力转向可部署、可审计、可持续运行的...
Replit自驱型公司跑通后,AI Agent开始进入真实组织流程-速维云

Replit自驱型公司跑通后,AI Agent开始进入真实组织流程

Replit自驱型公司、Kimi K3长任务开发、AI记忆眼镜和WAIC物理AI共同指向一个变化:AI竞争正从模型回答走向组织流程、长期记忆和真实执行闭环。
什么是负载均衡?为什么一个网站扛不住时要先想到它-速维云

什么是负载均衡?为什么一个网站扛不住时要先想到它

很多网站一开始并不需要负载均衡,但总会遇到那个拐点 很多人第一次听到“负载均衡”,会以为这是大型互联网公司的专属玩法。其实不是。一个普通企业官网、活动页,甚至一个后台系统,只要访问...
服务器磁盘 IO 很高时,为什么 CPU 看起来并不忙?-速维云

服务器磁盘 IO 很高时,为什么 CPU 看起来并不忙?

CPU 和内存看起来都不高,网站却明显变慢,很多时候问题出在磁盘 IO。本文讲清 iowait、磁盘延迟、进程读写、数据库、日志和备份任务的排查思路。
Claude押下十年算力长约,AI竞争开始转向基础设施和企业交付-速维云

Claude押下十年算力长约,AI竞争开始转向基础设施和企业交付

Claude 签下长期算力合作,OpenAI 加码企业部署,Gemma 与 SubQ 推动推理效率和长上下文升级,AI 竞争正在从模型发布转向基础设施、系统交付和真实工作流。