分类
类型
地域
产品
排序
蜂群Agent测试冲上70%,真实网站却只过33%:高分与交付之间还缺什么
EvoX蜂群正确率超过70%,ClawBench真实网站完成率却最高只有33.3%。文章分析多智能体协作、真实网页执行、记忆交接、状态图和按结果收费之间的可靠性交付问题。
扩散语言模型让Agent提速五倍:端侧AI开始争夺并行执行能力
DiffuSpace与Acrab测试显示,扩散语言模型在端侧场景可将Agent运行速度提升约五倍。随着Meta语音模型和AI材料实验系统持续落地,AI竞争正从生成能力转向并行执行、设备响应与可验证交付。
GPT-6 Astra能力首次公开:AI安全进入双向加速时代
OpenAI首次公开Astra(GPT-6)能力,在授权漏洞利用测试中达到100%成功率,网络安全能力约为前代模型四倍。文章分析强模型参与漏洞发现、代码修复与安全研发后,企业如何通过权限、沙箱和审计把...
AI陪伴月流水破千万美元:应用竞争开始从模型能力转向持续关系与结果交付
AI陪伴产品Zeta在八月把月流水推过一千万美元,真正拉动付费的并不是多换一个聊天模型,而是把单角色对话改造成多角色共同推进的剧情体验。用户不再只是向虚拟角色提问,而是进入一段持续生长的...
两个00后把数据公司做到215亿:英伟达之外,AI产业正在重估“卖铲人”
AfterQuery以专家推理数据、强化学习环境和模型评测服务进入英伟达Nemotron训练流程,AI数据生意正在从基础标注升级为可验证的专家经验工程。
亚马逊禁令被撤销:当AI Agent替用户点击,平台边界该画在哪里
美国第九巡回上诉法院撤销亚马逊针对Perplexity的初步禁令,但案件仍将发回重审。Comet的本地执行、WorkBuddy的权限体系、Somni的感知闭环与Microduck的具身开源,共同揭示智能体走向现实世界后...








