最新发布第75页
SubQ超长上下文和Gemma提速同台出现后,AI基础设施开始重算推理成本-速维云

SubQ超长上下文和Gemma提速同台出现后,AI基础设施开始重算推理成本

SubQ 超长上下文、Gemma 推理加速和 OpenAI 实时语音架构同台出现,说明 AI 竞争正在从参数规模转向推理成本、低延迟和可持续调用。
编码智能体进入标准化之后,企业安全边界如何重画-速维云

编码智能体进入标准化之后,企业安全边界如何重画

AGENTS.md推动跨厂商项目规范统一,AI辅助安全研究也展示了长任务攻防能力。企业需要重新设计智能体的权限、审计、供应链与人工接管边界。
Gemma 4 12B开源后,多模态Agent竞争开始拼本地部署和系统交付-速维云

Gemma 4 12B开源后,多模态Agent竞争开始拼本地部署和系统交付

谷歌开源可在 16GB 内存笔记本运行的 Gemma 4 12B,Kimi Work、Token Factory、Agent 记忆和具身智能同步升温,AI 竞争转向可部署系统能力。
智谱GLM-5.2开源后,AI竞争开始拼长程任务闭环-速维云

智谱GLM-5.2开源后,AI竞争开始拼长程任务闭环

智谱押注长程任务、Coding与开源生态,Claude Reflect、YC AI项目、Devin和MoleculeOS共同显示AI竞争正从模型回答转向任务协作、流程闭环与研发系统。
服务器连接数打满时,为什么 CPU 和内存看起来都不高?-速维云

服务器连接数打满时,为什么 CPU 和内存看起来都不高?

连接数打满时,CPU 和内存未必明显升高。本文从请求排队、长连接、连接池和异常流量几个角度,说明网站变慢或偶发 502 时应该先看哪些指标。
AlphaChip团队融资后,AI开始设计自己的算力底座-速维云

AlphaChip团队融资后,AI开始设计自己的算力底座

AlphaChip原班人马融资、自进化模型创业、OpenScience开源与Agent工程细节同步出现,AI竞争正在从模型能力转向芯片、科研和系统闭环。