分类
类型
地域
产品
排序
蜂群Agent测试冲上70%,真实网站却只过33%:高分与交付之间还缺什么
EvoX蜂群正确率超过70%,ClawBench真实网站完成率却最高只有33.3%。文章分析多智能体协作、真实网页执行、记忆交接、状态图和按结果收费之间的可靠性交付问题。
DeepSeek-V4多模态开源后,AI模型开始争夺真实执行现场
DeepSeek-V4-Flash-Vision-Exp突然开源,把这轮大模型竞争的焦点从“谁的文本回答更强”推向了一个更具体的问题:模型能不能同时看懂画面、理解任务,并在真实工作流里持续行动。作为DeepSeek-V...
成立一个月融资过亿:AI制药开始争夺研发“决策大脑”
艾斐智药成立仅一个多月即完成亿元级天使轮融资,PharmAgents等科研智能体正从分子生成走向证据组织、实验安排与研发决策。AI制药的竞争焦点,开始从模型能力转向可验证的科研闭环。
系统提示词泄露之后,AI模型安全开始进入可验证阶段
Fable 5.1系统提示词泄露、OpenAegis安全模型和iCoder工业Coding模型接连出现,AI竞争正从能力展示走向权限隔离、漏洞验证与可追溯交付。
李飞飞Atlas让世界模型走向真实空间:AI开始学习如何理解和行动
李飞飞团队发布多模态世界模型Atlas,支持三维重建、视频生成与机器人仿真。世界模型正在把AI从内容生成推进到可观察、可推演、可验证的真实环境。
什么是提示词工程?为什么同一个 AI,别人越用越顺手
提示词工程不是“咒语”,而是把话说明白 很多人第一次用 AI 时,都会有一种强烈的落差:明明别人晒出来的效果又稳又好,自己问同一个工具,得到的回答却很普通,甚至答非所问。于是就有人把问...







