多模态AI共9篇
千问接入生活服务智能体后,AI应用开始从聊天走向办事入口-速维云

千问接入生活服务智能体后,AI应用开始从聊天走向办事入口

千问开放平台接入生活服务智能体后,AI应用正在从聊天问答走向真实办事流程。图像、声音、内容平台和检索验证能力共同推动智能体进入更具体的服务闭环。
svyun的头像-速维云svyun14小时前
2613
OpenAI硬件路线图曝光后,AI入口竞争从聊天窗口打到手机和无屏设备-速维云

OpenAI硬件路线图曝光后,AI入口竞争从聊天窗口打到手机和无屏设备

OpenAI硬件路线图曝光、GPT-5.6 Sol自优化、Grok语音模型和智元全模态模型同步出现,说明AI竞争正从聊天窗口走向手机、无屏设备、语音入口和真实应用场景。
svyun的头像-速维云svyun12天前
02911
GenCeption改造视频模型后,AI视频开始从生成走向可交互世界-速维云

GenCeption改造视频模型后,AI视频开始从生成走向可交互世界

GenCeption把文生视频模型改造成通用视频理解系统,Xmax、爱诗科技和抖音互动内容同步推进,AI视频正在从素材生成走向可交互世界。
svyun的头像-速维云svyun25天前
03211
Inkling开放9750亿参数权重后,AI竞争开始重算模型生态-速维云

Inkling开放9750亿参数权重后,AI竞争开始重算模型生态

Thinking Machines Lab首发开放权重大模型Inkling,开放权重、多模态能力、应用创建平台和世界模型评测共同推动AI竞争从模型发布走向生态落地。
svyun的头像-速维云svyun26天前
2113
OpenAI挖来Vision Pro硬件负责人后,AI入口战开始走向真实设备-速维云

OpenAI挖来Vision Pro硬件负责人后,AI入口战开始走向真实设备

苹果 Vision Pro 硬件工程负责人保罗·米德离开苹果、转投 OpenAI 主管硬件部门,这条消息把 AI 行业一个长期悬着的问题重新推到台前:下一代 AI 入口到底还会不会是手机、网页和聊天框。过去两...
svyun的头像-速维云svyun1个月前
305
DeepSeek识图翻车后,多模态AI开始接受安全与信任考验-速维云

DeepSeek识图翻车后,多模态AI开始接受安全与信任考验

DeepSeek识图全量上线后暴露多模态稳定性问题,OpenAI与Anthropic推进身份验证和安全测试,AI产品竞争正在从能力展示转向可信边界。
svyun的头像-速维云svyun23天前
04111