最新发布第22页
排序
1200万上下文模型亮相,大模型竞赛开始从参数转向效率
SubQ 的出现,把大模型竞争里一个长期被忽视的问题重新推到了台前:上下文窗口越做越长之后,真正决定可用性的,已经不只是“能塞多少 token”,而是长文本读写、推理速度和调用成本能不能一起...
GPU不再闲着,AI推理基础设施开始变成硬仗
vLLM 与 SGLang 商业化、RadixArk 分拆融资,把 GPU 利用率和推理调度推到 AI 竞争核心。模型越强、Agent 越长程,真正决定产品能否规模化的,正在变成算力调度、成本控制和系统稳定性。
Nginx反向代理配置教程:proxy_pass、请求头与常见502问题
讲解 Nginx 反向代理配置,包括 proxy_pass 路径规则、Host 和真实 IP 请求头、WebSocket、超时设置、502 排查与 WordPress 反代注意事项。
单卡跑进18万原子世界,AI科研开始接受规模与可信度双重考验
一张141GB显存的H20,现在已经能够承载18万原子规模的机器学习分子模拟。至知创新研究院UBio团队发布并开源UBio-MolFM v1.5,在真实生理环境下以接近量子化学的精度处理生物大分子,同时把推理...















