多模态模型共10篇
OpenAI让AI接管量子实验后,智能体竞争进入结果交付阶段-速维云

OpenAI让AI接管量子实验后,智能体竞争进入结果交付阶段

OpenAI与MIT让AI自主运行量子计算实验,Astra进入电脑操作,轻量多模态模型与办公Agent则把AI推向可验证执行与结果交付。
svyun的头像-速维云svyun24天前
0409
DeepSeek-V4多模态开源后,AI模型开始争夺真实执行现场-速维云

DeepSeek-V4多模态开源后,AI模型开始争夺真实执行现场

DeepSeek-V4-Flash-Vision-Exp突然开源,把这轮大模型竞争的焦点从“谁的文本回答更强”推向了一个更具体的问题:模型能不能同时看懂画面、理解任务,并在真实工作流里持续行动。作为DeepSeek-V...
svyun的头像-速维云svyun1个月前
466
GLM-5.3-Flash把前沿模型价格压到四十分之一,国产算力开始承接大规模推理-速维云

GLM-5.3-Flash把前沿模型价格压到四十分之一,国产算力开始承接大规模推理

智谱开源GLM-5.3-Flash,以混合注意力、低激活参数和国产芯片集群降低前沿多模态模型的推理成本,模型竞争开始转向单位任务经济性。
svyun的头像-速维云svyun1个月前
5413
DeepSeek补上视觉API后,AI竞争开始争夺真实现场-速维云

DeepSeek补上视觉API后,AI竞争开始争夺真实现场

DeepSeek上线视觉模型API,图片输入开始成为Agent和企业应用的基础能力。随着模型路由、执行框架、AI ERP和医疗筛选同步推进,AI竞争正在从单点回答转向可感知、可执行、可审计的系统工程。
svyun的头像-速维云svyun1个月前
366
Luma开放Uni-1.1 API后,AI图像生成开始拼文字和成本-速维云

Luma开放Uni-1.1 API后,AI图像生成开始拼文字和成本

Luma 开放 Uni-1.1 API 后,图像生成竞争从单张样图走向文字渲染、调用成本、接口稳定性和创意生产工具链。
svyun的头像-速维云svyun1个月前
555
Vidu S1把AI视频推向实时交互,内容生成开始变成可操控系统-速维云

Vidu S1把AI视频推向实时交互,内容生成开始变成可操控系统

Vidu S1、Vivix 实时交互模型与多模态工程进展叠加后,AI视频正在从离线生成工具转向可操控、可部署、可持续运行的应用系统。
svyun的头像-速维云svyun2个月前
04210