DeepSeek-V4多模态开源后,AI模型开始争夺真实执行现场
DeepSeek-V4-Flash-Vision-Exp突然开源,把这轮大模型竞争的焦点从“谁的文本回答更强”推向了一个更具体的问题:模型能不能同时看懂画面、理解任务,并在真实工作流里持续行动。作为DeepSeek-V...
蜂群Agent测试冲上70%,真实网站却只过33%:高分与交付之间还缺什么
EvoX蜂群正确率超过70%,ClawBench真实网站完成率却最高只有33.3%。文章分析多智能体协作、真实网页执行、记忆交接、状态图和按结果收费之间的可靠性交付问题。
成立一个月融资过亿:AI制药开始争夺研发“决策大脑”
艾斐智药成立仅一个多月即完成亿元级天使轮融资,PharmAgents等科研智能体正从分子生成走向证据组织、实验安排与研发决策。AI制药的竞争焦点,开始从模型能力转向可验证的科研闭环。
千问上线 Qwen3.8-Omni-Flash、谷歌最强 Gemini 4 Pro 开测后,AI大模型开始拼场景落地
这一天的 AI 行业动态有一个共同指向:AI 大模型不再只围绕参数、榜单和演示视频竞争,而是在代码开发、内容生产、办公入口、终端设备、商业化结算和安全治理里寻找真实落点。千问上线 Qwen3.8-...
谷歌发布Gemini 3.8 Flash TTS、Kimi K3.1十月或压轴登场后,AI大模型开始拼场景落地
这一天的 AI 行业动态有一个共同指向:AI 大模型不再只围绕参数、榜单和演示视频竞争,而是在代码开发、内容生产、办公入口、终端设备、商业化结算和安全治理里寻找真实落点。谷歌发布 Gemini 3...









