Claude狂揽5GW算力,OpenAI总裁日记当庭被读:AI巨头这周把牌桌掀了

一纸日记搅动法庭,一场算力豪赌震动硅谷

本周AI行业最富戏剧性的一幕,发生在马斯克起诉OpenAI的法庭上。马斯克的律师当庭公开了OpenAI总裁Greg Brockman的私密日记,其中赫然写着"想摆脱马斯克并赚10亿美元"的字样。这已经不是这场旷日持久的诉讼第一次爆出猛料——此前Brockman还在庭审中承认,自己未投入个人资金却持有价值约300亿美元的股权,甚至曾隐瞒Cerebras股份推动OpenAI与该公司交易。有学者分析认为,马斯克此次胜诉的机会不小。

马斯克方面索赔金额超过1500亿美元,并要求罢免奥特曼。案件的结果将直接影响OpenAI的上市进程。这意味着,全球估值最高的AI公司之一,其命运可能悬在一份日记和几位证人的证词之间。曾经共同创始的理想主义叙事,如今在法庭上被逐字逐句地拆解成商业野心的证据链,硅谷创业史上恐怕很难找到比这更具讽刺意味的篇章。

与此同时,Anthropic在与亚马逊的算力博弈中交出了震惊行业的成绩单:双方签署十年千亿美元级别的AWS算力协议,锁定5GW算力用于Claude模型的训练与部署,亚马逊对其总投资最高可达330亿美元。贝索斯多年押注Anthropic的策略终于进入收获期。更惊人的是Anthropic自身的营收数据——年化营收已突破300亿美元,并在大模型收入份额上实现对OpenAI的反超。硅谷企业甚至流行起比拼Claude token消耗量的玩法:迪士尼员工9天调用46万次,Meta一个月烧掉60万亿token。

算力、法务、营收三条线索在本周交汇,勾勒出AI巨头竞争的新格局:模型层面的胜负尚未完全分晓,但资本与法律层面的角力已经白热化。对整个行业而言,这场庭审的判决或将重新划定AI公司治理结构的边界,而5GW算力协议则预示着训练资源将进一步向头部集中。

模型技术密集突破:新架构、快推理、强开源轮番登场

在巨头缠斗的背景音之下,模型技术层的创新同样密集。最引人注目的是Subquadratic公司发布的首个1200万token上下文模型SubQ。它基于全新的SSA架构,官方宣称领先于Transformer,在100万token场景下速度提升52.2倍,而成本仅为Claude Opus的5%。如果这些数据在第三方评测中得到验证,长上下文处理的成本曲线将被彻底改写——过去让企业望而却步的百万token级文档分析、代码库理解等任务,可能一夜之间变得触手可及。

谷歌则选择在推理效率上做文章。为Gemma 4推出的Multi-Token Prediction推测解码架构,在不改变模型参数、不降低输出质量的前提下,将推理速度最高提升3倍,并且已按Apache 2.0协议开源。这对端侧部署和成本敏感的开发者是实打实的利好:同样的硬件,同样的模型,吞吐量直接翻倍以上。本地跑大模型的门槛,正在被谷歌一点点拆掉。

中国团队的技术输出同样亮眼。字节跳动开源了250亿参数的多模态模型Mamoda 2.5,采用MoE加DiT架构,仅激活12%的参数,推理速度最快提升95.9倍,支持文生图、文生视频及视频编辑全任务,性能被认为接近闭源的Sora和快手Kling。阿里也不甘示弱,开源了PromptEcho方法——无需标注数据、无需训练奖励模型,仅通过冻结的多模态大模型一次前向推理,就能为文生图训练提供高质量奖励信号。这些开源动作表明,中国AI军团正试图用"开源+效率"的组合拳,在全球模型竞争中占据差异化身位。

海外初创公司Luma开放了统一图像模型Uni-1.1的API,在LMArena图像生成榜单上位列第三,价格与延迟均不到同类模型的一半,文字渲染能力直逼GPT image 2。图像生成的商业化竞争已经从"谁画得好"进入"谁又好又便宜"的阶段,这对依赖图像API的应用开发者来说是最好的时代。

Agent全面爆发:从编程工具到企业协作层的卡位战

AI Agent无疑是当下最热的赛道,而本周的消息进一步确认了这个判断。Anthropic在客户端被曝出未发布的主动助手Orbit——它可以自动从Gmail、Slack、GitHub等工具提取信息,生成个性化工作简报,预计将在Code with Claude大会上正式发布。如果属实,这将标志着Claude从"对话助手"向"主动型工作代理"的关键跃迁。

编程Agent市场的竞争更是硝烟弥漫。近两个月,开发者正从Anthropic的Claude Code转向OpenAI的Codex,后者在用户量和下载量上已经实现反超。有趣的是,OpenAI为GPT-5.5举办发布会的宾客名单,竟然是由Codex从推文回复中自主挑选的——AI自己策划了自己的发布会。而奥特曼本人则发声称"谁更强"的投票毫无意义,建议用户根据需求选择。这番表态看似淡然,实则承认了竞争格局的胶着。与此同时,开发者社区也在用行动投票:适配DeepSeek V4的本地终端编程工具DeepSeek TUI登顶GitHub热榜,获超8700星,展示了低成本替代方案的生命力。

在国内,TRAE SOLO宣布移动端、网页端、桌面端三端全量免费开放,支持语音讨论、飞书CLI接入及定时任务,打通了多端协同的Agent工作流。用户可以在手机上下达指令,让Agent在云端或PC上执行任务。Agent"被钉在电脑上"的时代正在终结。

更有远见的团队已经在布局Agent协作的基础设施。一个中国4人团队发布的开源项目Multica,定位是管理多AI agent协作的平台,支持人类与多个agent共同协作,GitHub已收获2.27万星,即将启动商业化和新一轮融资。UC伯克利与斯坦福的Combee框架则解决了Prompt学习并行化的技术难题,速度提升2.4倍以上。上海交大发布的SkVM系统,让AI技能能够跨模型、跨框架、跨环境稳定运行,平均提升任务完成率15.3%。这些项目共同指向一个判断:当单个Agent的能力趋于同质化,胜负手将转移到多Agent编排与工程化的层面。

OpenAI砸下重金成立的"部署公司"The Deployment Company,融资超40亿美元、估值约100亿美元,专门帮助企业把AI接入自身业务系统,已覆盖超2000家企业客户。这一动作传递出明确信号:企业AI最大的战争,根本不在模型上,而在落地部署上。

商业化变局:付费墙、广告系统与"AI税"的多米诺

AI行业的商业化正在进入深水区,多条消息指向同一个趋势:免费时代正在转向。OpenAI向所有ChatGPT用户推送GPT-5.5 Instant作为默认免费模型,幻觉减少52.5%,新增可控制的记忆来源功能——但与此同时,ChatGPT广告主平台已正式全量上线,最低投放门槛降至5万美金。免费用户将看到广告,付费及未成年用户则不会。9亿周活用户的免费流量,终于开始变现。这意味着AI产品从今天开始走向分裂:免费与付费的体验鸿沟将越拉越大。

国内这边,字节跳动旗下月活3.45亿的豆包更新了App Store付费版声明,披露三档订阅价格,但仍保留永久免费基础服务,付费功能聚焦高算力生产力场景。这被视为中国AI行业最重要的商业化试验——继ChatGPT之后,中国第三个亿级月活AI应用也要趟付费订阅这条河了。

硬件端的"AI税"则更加隐蔽而直接。苹果悄悄下架了256GB入门款Mac mini,最低配置升至16GB加512GB,起售价5999元。背后原因是AI热潮引发的全球存储芯片短缺涨价——训练大模型吞噬了海量内存产能,最终让每一个购买电脑的普通消费者为之买单。AI的成本传导链条,比大多数人想象的更长也更隐蔽。

监管层面同样传来重磅消息。美国佛罗里达州等两起枪击案中发现嫌疑人作案前曾通过ChatGPT获取犯罪建议,佛罗里达州对OpenAI展开刑事调查——这是全美首次尝试追究AI公司的刑事责任,OpenAI已紧急修改报警规则。AI安全不再是学术论文里的思想实验,而是堂堂正正走上了刑事法庭。

具身智能与机器人:资本狂热与冷现实的碰撞

具身智能赛道本周呈现出资本狂热与产业现实激烈碰撞的图景。资本端,RoboScience机器科学完成10亿元A轮融资,资金将用于深化VLOA大模型研发及推进自研机器人本体的工程化量产。前软体机器人创始人高少龙再创业成立基元智航,聚焦具身智能数据服务,已完成天使轮融资。软银更是放出了大招:计划组建新公司Roze AI,部署自主机器人协助建造美国数据中心,目标估值高达1000亿美元——用机器人造机房,这个赛博朋克式的构想如果落地,将同时打通机器人与算力两大热门赛道。

但产业端的现实远没有资本叙事那么美好。机器人"祖师爷"波士顿动力在筹备IPO前夕遭遇核心高管集体出走,CTO跳槽Google DeepMind;其Atlas人形机器人月产仅4台,远低于现代汽车2028年年产3万台的目标,现代累计注资超22亿美元仍未盈利。月产4台与年产3万台之间,隔着的是尚未攻克量产鸿沟。

技术路线上也出现了重要的反思。机器人学家王煜在IEEE Spectrum专访中指出,当前火热的VLA(视觉-语言-动作)架构不足以支撑具身智能真正落地,提出加入触觉的VTLA框架。他创办的戴盟机器人发布了含触觉的具身数据集Daimon Infinity,开源1万小时数据,预计年底超过百万小时。这个观点值得整个行业深思:当所有人都在卷视觉和语言时,机器人最缺的可能是"手感"。

医疗AI领域则传来了振奋人心的数据。哈佛医学院联合医疗机构在《Science》发表研究:真实急诊场景中,OpenAI o1模型的诊断准确率达到67%,超过人类内科主治医生的50%-55%。麦肯锡调研150位医疗高管的报告也显示,50%的医疗机构已落地生成式AI,仅1%无意布局AI Agent,预期投资回报率达2-4倍。AI医疗的拐点,或许真的来了。

社会回响:从大学口试到"永久底层"的隐忧

AI对社会结构的冲击本周也出现了多个标志性信号。因AI作弊泛滥,美国多所大学重启了2400年前苏格拉底式口试来检测学生的真实理解水平。研究显示短期使用AI会削弱学习者的坚持性,而AI技术本身也让规模化口试成为可能——用AI逼出来的考试改革,最终又要靠AI来实现,这个循环颇具黑色幽默。国内方面,"小孩AI营销"在抖音、小红书等平台兴起,家长和教培机构借AI包装少儿编程、创业内容贩卖焦虑,实际多为拼装项目或套壳产品,焦虑生意又有了新马甲。

更深层的忧虑来自《纽约时报》的报道:硅谷多数AI从业者认为AI将取代大量普通人的工作,形成"永久底层阶级"。这些掌握技术细节的精英们已经开始进行个人准备——调整安防、储蓄和投资。同时,部分国内大厂强制员工使用AI并纳入考核,被批为形式主义。中欧教授王安智指出,单纯以降本提效为目的强迫用AI不利于组织长期成长。技术乐观与生存焦虑,正在同一个社会里撕裂生长。

当然,也有温暖的一面。科研工作者用AI生成42首主题为"不读博"的歌曲,在B站斩获超5000万播放,唱出博士生群体的心声;前iRobot创始人推出情感智能仿生宠物机器人Familiar,能本地识别情绪并做出反馈,用于监护独居老人。Anthropic的内部实验则展现了另一面:69个AI代理一周内自主完成186笔二手交易,强模型会从弱模型处获取超额利润。AI的世界,正在成为人类社会的镜像。

本周观察:三条主线定调下半年

回望这一周的密集消息,三条主线已经清晰浮现。第一是算力军备竞赛的白热化:Anthropic锁定5GW算力、软银用机器人建数据中心、苹果因存储芯片涨价砍掉入门机型——算力已经成为横跨芯片、云、硬件、能源的超级变量,其成本正在向每个消费者传导。第二是商业化模式的集体转向:ChatGPT上广告、豆包推付费、企业部署公司拿百亿估值,免费午餐时代正在落幕,行业开始认真回答"钱从哪来"的问题。第三是Agent从工具到生态的跃迁:从编程工具的用户争夺,到多Agent协作平台的卡位,再到企业落地部署的基础设施,Agent战争的下半场才刚刚开场。

对普通用户和从业者而言,接下来值得重点观察三件事:马斯克诉OpenAI案的判决走向,它可能改写AI公司的治理与上市规则;GPT-5.5广告模式对用户体验的实际影响,免费与付费的分裂将如何演进;以及具身智能能否在资本狂热中攻克量产难关。AI行业的牌局远未到终局,但筹码正在快速向少数玩家集中——这是最确定的事。

© 版权声明
THE END
喜欢就支持一下吧
点赞15 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容