最新发布第181页
Gemma 4推测解码提速三倍:AI推理竞争开始转向工程效率-速维云

Gemma 4推测解码提速三倍:AI推理竞争开始转向工程效率

谷歌为Gemma 4开放Multi-Token Prediction推测解码,在不改变模型和输出质量的情况下最高提速三倍。推理优化正在重新计算本地部署、企业应用与AI基础设施的成本。
Jev把AI推理变成79毫秒判断:9B小模型为何开始抢走大模型的执行入口-速维云

Jev把AI推理变成79毫秒判断:9B小模型为何开始抢走大模型的执行入口

Jev与APUS团队的复现结果显示,低延迟判断模型正在把AI从会聊天推进到会拍板。本文分析9B模型、79毫秒响应、本地部署和企业执行层的变化。
Zyxel GS1900 交换机高危漏洞 CVE-2026-7273 被纳入 KEV:中小企业网络设备如何排查与修复-速维云

Zyxel GS1900 交换机高危漏洞 CVE-2026-7273 被纳入 KEV:中小企业网络设备如何排查与修复

CISA 将 Zyxel GS1900 系列交换机漏洞 CVE-2026-7273 纳入已知被利用漏洞目录。本文梳理在野利用信号、设备暴露面、日志排查和升级缓解建议。
全模态模型降本,边缘AI开始接管真实任务-速维云

全模态模型降本,边缘AI开始接管真实任务

Qwen3.8-Omni-Flash降低全模态调用成本,NCP预训练任务减少无效Token,TI则把NPU与MCU带入边缘设备。模型、芯片与真实应用正在共同重算AI的交付方式。
腾讯混元图像3.5来了、Grok4.7上线后,AI大模型开始拼场景落地-速维云

腾讯混元图像3.5来了、Grok4.7上线后,AI大模型开始拼场景落地

这一天的 AI 行业动态有一个共同指向:AI 大模型不再只围绕参数、榜单和演示视频竞争,而是在代码开发、内容生产、办公入口、终端设备、商业化结算和安全治理里寻找真实落点。SpaceXAI 最强 模...
小米MiMo-V2.6开源后,AI模型竞争开始比训练成本与执行效率-速维云

小米MiMo-V2.6开源后,AI模型竞争开始比训练成本与执行效率

小米开源MiMo-V2.6系列模型,公开训练成本、强化学习环境与高速版本。本文结合Agent资产平台、低延迟判断模型、具身智能和强化学习规模化进展,分析AI竞争如何从参数与榜单转向训练效率、执行速...