最新发布第22页
OpenAI入股讨论升温,AI竞争从模型能力走向公共治理-速维云

OpenAI入股讨论升温,AI竞争从模型能力走向公共治理

OpenAI入股讨论、AI应用估值、Agent成本治理与医疗财税落地共同说明,AI竞争正在从模型能力走向公共治理和基础设施责任。
网站突发流量变大怎么办?从日志、缓存到限流的排查思路-速维云

网站突发流量变大怎么办?从日志、缓存到限流的排查思路

网站突然变慢时,不要只盯着 CPU 和内存。本文从访问日志、缓存命中、异常请求、限流和扩容几个角度,梳理突发流量的排查与处理思路。
1200万上下文模型亮相,大模型竞赛开始从参数转向效率-速维云

1200万上下文模型亮相,大模型竞赛开始从参数转向效率

SubQ 的出现,把大模型竞争里一个长期被忽视的问题重新推到了台前:上下文窗口越做越长之后,真正决定可用性的,已经不只是“能塞多少 token”,而是长文本读写、推理速度和调用成本能不能一起...
GPU不再闲着,AI推理基础设施开始变成硬仗-速维云

GPU不再闲着,AI推理基础设施开始变成硬仗

vLLM 与 SGLang 商业化、RadixArk 分拆融资,把 GPU 利用率和推理调度推到 AI 竞争核心。模型越强、Agent 越长程,真正决定产品能否规模化的,正在变成算力调度、成本控制和系统稳定性。
Nginx反向代理配置教程:proxy_pass、请求头与常见502问题-速维云

Nginx反向代理配置教程:proxy_pass、请求头与常见502问题

讲解 Nginx 反向代理配置,包括 proxy_pass 路径规则、Host 和真实 IP 请求头、WebSocket、超时设置、502 排查与 WordPress 反代注意事项。
单卡跑进18万原子世界,AI科研开始接受规模与可信度双重考验-速维云

单卡跑进18万原子世界,AI科研开始接受规模与可信度双重考验

一张141GB显存的H20,现在已经能够承载18万原子规模的机器学习分子模拟。至知创新研究院UBio团队发布并开源UBio-MolFM v1.5,在真实生理环境下以接近量子化学的精度处理生物大分子,同时把推理...