最新发布第22页
谷歌让 Gemma 4 提速三倍,端侧大模型竞争转向推理效率-速维云

谷歌让 Gemma 4 提速三倍,端侧大模型竞争转向推理效率

谷歌为 Gemma 4 推出推理提速方案,在不改变模型、不降低输出质量的前提下提升生成效率,本地部署和企业内网 AI 应用迎来更现实的落地空间。
过去几天开源与 AI 工具链更新了什么?值得关注的 4 个方向-速维云

过去几天开源与 AI 工具链更新了什么?值得关注的 4 个方向

基于最近几天 GitHub 官方发布记录,梳理本地推理、Agent 编排、统一模型接入等四个值得关注的开源 AI 工具链方向。
AnuNeko停运后,AI陪伴赛道开始从聊天框转向互动内容-速维云

AnuNeko停运后,AI陪伴赛道开始从聊天框转向互动内容

AnuNeko 宣布永久停运,把 AI 陪伴赛道最脆弱的一面暴露了出来。这个由蔡浩宇创立的 Anuttacon 推出的产品上线还不满一年,原本主打情感陪伴,却将在 7 月 29 日结束服务。官方给出的原因是团队...
OpenAI把AI报税推向实战,企业智能体开始接管后台流程-速维云

OpenAI把AI报税推向实战,企业智能体开始接管后台流程

OpenAI与Thrive推出Tax AI,把报税工作压缩到可交付流程;企业Agent、监测、记账和医疗模型同步升温,说明AI落地正在进入后台流程自动化阶段。
Claude把黎曼猜想推进到67.25%,数学研究进入发现、简化与机器验证闭环-速维云

Claude把黎曼猜想推进到67.25%,数学研究进入发现、简化与机器验证闭环

Claude参与的黎曼猜想研究把已知临界线零点比例推进到67.25%,人类数学家随后简化证明,形式化工具在数小时内完成机器核验。与此同时,三维世界生成、长视频记忆和Agent编程也在把AI推向可验证...
MoE路由被重复Token打崩后,AI基础设施开始补安全和部署短板-速维云

MoE路由被重复Token打崩后,AI基础设施开始补安全和部署短板

港科大RepetitionCurse揭示MoE路由在重复Token输入下可能导致GPU负载严重失衡,沐曦GPU开源生态、因果世界模型和Kimi K3等动态共同说明,AI竞争正在从模型能力转向可部署、可审计、可持续运行的...