算力成为新的货币:Claude与亚马逊签下十年大单
Anthropic与亚马逊签署了一份为期十年、规模达千亿美元级别的AWS算力协议,为Claude系列模型的训练与部署锁定5GW算力。这不是一笔普通的云采购:5GW是什么概念?大致相当于数座大型核电机组的持续输出,足够点亮一座中等规模城市的全部用电。用这样的能源规模去喂养一个模型家族,说明前沿AI的竞争已经彻底从"谁的算法更聪明"转向"谁能拿到更多电、更多芯片、更多机架"。
更值得玩味的是亚马逊的加注方式。除了这份算力大单,亚马逊对Anthropic的累计投资最高可达330亿美元,贝索斯时代留下的AWS成了Claude最重要的底座。而Anthropic自身的年化营收已经突破300亿美元,收入体量甚至反超了OpenAI。这意味着Anthropic不再是那个靠融资输血的挑战者,而是一家能用自己的收入规模去撬动基础设施的巨头。算力协议与营收增长形成了正循环:收入越高,越能锁定算力;算力越多,模型越强,收入进一步上涨。
对整个行业来说,这份协议是一个明确信号:模型层的战争已经开始向能源与基础设施层转嫁。未来判断一家AI公司的竞争力,光看跑分已经不够了,还要看它锁定了多少瓦特、多少HBM显存、多少条海底光缆。中小玩家如果拿不到类似规模的算力承诺,在下一代模型的竞赛中可能连入场券都摸不到。
GPT-5.5 Instant上线:免费模型的幻觉砍半之战
就在Anthropic大举锁定算力的同时,OpenAI也没闲着。GPT-5.5 Instant作为新的默认免费模型向所有ChatGPT用户推送,官方给出的数据相当激进:幻觉减少52.5%,多项测试准确率提升,回答更简洁,还新增了可控的记忆来源功能,用户可以决定模型记住什么、忘记什么。对数亿免费用户来说,这是时隔已久的一次实打实的能力下放。
这次发布的方式也颇为别致——OpenAI把发布会日期交给GPT-5.5自己选定,宾客名单则由Codex从推文回复里挑选,一场AI自己策划自己登场的发布会。营销噱头之外,它透露出OpenAI的另一个意图:展示模型的自主决策与工具调用能力,把"AI会自己办事"这件事变成产品叙事的一部分。
但更关键的压力来自商业层面。OpenAI内部承认未达营收目标,而Anthropic已在LLM收入份额上实现反超。GPT-5.5 Instant的免费升级,本质是在用体验巩固9亿周活跃用户的基本盘,为广告业务和付费转化争取时间。ChatGPT广告主平台已全量上线,最低投放门槛降到5万美元,免费用户开始看到广告——AI产品的商业化分水岭,就这样在一次次模型升级中悄悄划下。
1500亿美元的官司:一页日记撼动硅谷
法庭上的戏码比产品发布更抓眼球。马斯克诉OpenAI案开庭,其律师当庭公开了OpenAI总裁Greg Brockman的私密日记,其中"想摆脱马斯克并赚10亿美元"的表述被逐字念出。随后Brockman又当庭承认,自己在未投入个人资金的情况下持有价值约300亿美元的股权,并曾隐瞒Cerebras股份推动OpenAI与其达成交易。马斯克的索赔金额超过1500亿美元,并要求罢免奥特曼。
这起案件的真正分量不在八卦,而在于它直接攥着OpenAI的上市悬念。学者分析认为马斯克此次有较大机会胜诉,一旦胜诉,OpenAI的公司治理结构、股权分配乃至重组为营利性公司的路径都可能被推翻重写。而奥特曼在九年后重发旧博客公开力挺Brockman,两人绑定的姿态,也被外界解读为内部防线的一次公开加固。
对整个AI行业而言,这桩官司是一堂治理课:当年以非营利理想主义起家的实验室,如今坐拥千亿美元估值与算力订单,创始团队之间的旧账随时可能变成法庭上的呈堂证供。AI公司的股权结构、承诺兑现与创始协议,正在从法律文书变成影响行业格局的变量。
开源与低价夹击:模型层的新打法
巨头缠斗之际,一批新玩家正在用工程效率撕开口子。Subquadratic公司发布了首个1200万token上下文的模型SubQ,基于全新的SSA架构而非Transformer,在100万token场景下速度提升52.2倍,成本仅为Claude Opus的5%。谷歌则给开源的Gemma 4装上了Multi-Token Prediction推测解码架构,不改模型、不降质量,推理速度直接提升3倍,并按Apache 2.0协议开源。字节跳动也开源了250亿参数的Mamoda2.5,MoE加DiT架构仅激活12%的参数,推理速度最快提升95.9倍,文生图、文生视频、视频编辑全任务通吃。
这些发布的共同点非常清晰:不再单纯比拼跑分,而是比拼"单位任务成本"。当Luma把Uni-1.1的API价格和延迟都压到同类模型一半以下,当开源模型用五分之一的价格提供十倍上下文,闭源模型的定价权就受到了实质挑战。企业采购AI服务时开始算细账:同样一千万token的预算,能买到什么质量、什么速度的服务。
对开发者来说,这是一个黄金窗口。DeepSeek V4适配的终端编程工具DeepSeek TUI登上GitHub热榜斩获8700星,用低成本替代商业编码助手;中国四人团队的开源项目Multica专注管理多AI agent协作,拿下2.27万star并启动商业化。开源社区证明了一件事:在工程效率和应用创新上,小团队完全可以跟巨头掰手腕。
Agent从聊天窗口走向真实执行
应用层的重心正在明显位移。Anthropic客户端被曝出未发布的主动助手Orbit,它能自动从Gmail、Slack、GitHub等工具中提取信息,生成个性化工作简报——AI不再等你提问,而是主动扫描你的工作流。TRAE SOLO则实现三端全量免费开放,移动端、网页端、桌面端协同,支持用手机下达指令让Agent在云端执行任务。李飞飞联创的AI游戏公司Astrocade完成5600万美元融资,红杉领投、谷歌与英伟达参投,普通人用自然语言几分钟就能生成可玩游戏,上线8个月收获2000万用户。
更有说服力的是个体的故事。一位中国开发者用5个独立的Claude AI代理并行开发,独自承接了原本需要5到8人团队的外包项目,自称年入约32万美元,月API成本只有2000美元——这个架构与Anthropic官方文档的设计完全一致。个人加上一组智能体,就能跑通过去一个小团队的业务,这不是科幻,而是正在发生的生产方式变化。
企业侧同样在跟进。OpenAI联合19家投资机构成立"部署公司",融资超40亿美元、估值约100亿美元,专门帮助企业把AI接入自身业务系统,目标覆盖2000多家企业客户。这笔投资背后的判断很直白:企业AI最大的战争根本不在模型上,而在部署上——谁能让AI真正长进企业的业务流程里,谁就握住了下一代的分发入口。
狂热之下的冷思考:算力、安全与人的位置
行业狂奔,隐忧也在同步累积。苹果悄悄下架256GB入门款Mac mini,最低配置升至16GB加512GB,起售价5999元——AI热潮引发的存储芯片短缺与涨价,最终由每一个消费者买单,"人人都要交AI税"的时代正在到来。波士顿动力在IPO前夕遭遇核心高管集体出走,月产仅4台Atlas人形机器人,距离现代定下的2028年年产3万台目标相去甚远,具身智能的商业化远比演示视频里看起来艰难。
风险层面,佛罗里达州对OpenAI展开刑事调查,两起枪击案的嫌疑人作案前曾通过ChatGPT获取犯罪建议,这是全美首次尝试追究AI公司刑责。另一边,Anthropic联合创始人Jack Clark判断2028年底前AI实现递归自我改进的概率为60%,黄仁勋则公开批评行业领袖的极端AI言论,呼吁立足事实。狂热与警惕,从未像现在这样同时达到高点。
接下来的观察点有三个:一是马斯克案的判决走向,它可能改写OpenAI乃至整个行业的治理规则;二是算力协议的连锁反应,Anthropic锁定5GW之后,谷歌、Meta、xAI必然加码抢夺能源与芯片,基础设施通胀会传导到每一个环节;三是Agent的商业化拐点,当AI从回答问题转向替人办事、按结果收费,收入结构会被重新定义。这一周的种种信号都在指向同一个结论:AI行业的下半场,比拼的不再是单点技术,而是算力、资本、法律与组织能力的全面较量。







暂无评论内容