排序
Mint-Agent把金融AI拉进审计链:模型竞争开始从答对走向可复核
Mint-Agent在金融智能体评测中同时取得更高准确率和更低推理成本,并将来源、计算与结论组织成可回放证据链。语音交互创业与公开训练535B模型的进展,也在改写AI从能回答到可验收的竞争标准。
Command A+真开源,英伟达提速:大模型竞争进入可部署和算账阶段
Cohere开源Command A+,英伟达提出三模式大语言模型,微软收缩Claude Code订阅,AI竞争正在从模型能力转向部署成本、推理效率和企业工作流。
多模型组队逼近Fable 5后,AI竞争开始转向路由和系统交付
OpenRouter Fusion与OrcaRouter让多模型路由成为新焦点,国产模型组合逼近Fable 5,AI竞争正在从单个模型能力转向路由、成本控制、算力调度和系统交付。
Kimi K3确认2.5万亿参数后,国产模型竞争开始重算规模、算力和应用入口
Kimi K3确认2.5万亿参数,叠加智算中心受阻、Agent应用试错和具身智能融资,国产AI竞争正在从模型规模延伸到算力效率、产品入口和真实场景交付。
Gemini 3.5提速撞上办公Agent评测,AI助手竞争转向真实交付
谷歌 Gemini 3.5 Flash 的实测数据把 AI Agent 的竞争重新拉回一个很现实的问题:模型不只是要更聪明,还要更快、更便宜、更容易被系统调用。报道中提到,Gemini 3.5 Flash 在 Agent 基准测试中...
OpenAI退役旧模型,Agent平台和AI账单战同时升温
OpenAI退役o3与GPT-4.5、GPT-5.6推进、AI服务价格重算,以及美团、阿里等平台加速Agent落地,说明AI竞争正在从单点模型能力转向生命周期、成本治理和系统交付。






