GPT-5.5自己选日子开发布会,Codex反超Claude Code:AI行业这一周把牌桌重排了

从一次没有人类写代码的发布会说起

OpenAI把发布会的日期交给了模型自己挑:5月5日5点55分,GPT-5.5自主选定了这个时刻,连宾客名单都是由Codex从海量推文回复里挑选出来的。这场近乎行为艺术的发布会背后,是两件足够改变行业格局的事——GPT-5.5 Instant正式成为ChatGPT的默认免费模型,幻觉率大幅下降,还新增了用户可以控制的记忆来源功能;而在开发者阵营,Codex在用户量和下载量上已经完成对Claude Code的反超。

这两件事放在一起看,分量远超一次产品更新。免费用户拿到幻觉减半、记忆更强、回答更简洁的模型,意味着AI助手的"及格线"被整体抬高了一截;而编程工具赛道上OpenAI完成反超,则说明开发者生态的争夺已经从模型能力延伸到了工作流粘性。谁能留在开发者每天八小时的终端里,谁就握住了下一代软件生产的入口。

更值得玩味的是发布会本身的组织方式。让AI挑选时间、挑选嘉宾,OpenAI在有意无意地演示一个叙事:模型已经可以承担决策。这个姿态既是营销,也是一种行业信号——AI公司开始把"AI自主性"当作产品卖点的一部分,而不仅仅是实验室里的研究课题。

Anthropic的算力豪赌:5GW与千亿美元锁死十年

当OpenAI在消费端和开发者端高歌猛进时,Anthropic选择了另一条路:把未来十年押在电力和芯片上。Anthropic与亚马逊签署了为期十年的千亿美元级AWS算力协议,锁定5GW算力用于Claude的训练与部署,亚马逊对其总投资最高可达330亿美元。与此同时,Anthropic的年化营收已突破300亿美元,甚至在部分统计口径下完成了对OpenAI收入份额的反超。

5GW是什么概念?大约相当于数百万个美国家庭的用电量,也接近一些中等国家的电力负荷。把如此规模的算力写进一份十年长约,说明Anthropic判断Claude的训练和推理需求在未来数年内仍将持续指数级增长。硅谷企业比拼Claude token消耗量的风气也印证了这一点:迪士尼员工9天调用46万次,Meta一个月烧掉60万亿token。大模型已经不再是玩具,而是嵌入巨头业务流程的水电煤。

这笔交易对行业结构的影响同样深远。亚马逊通过投资加算力绑定,把Anthropic牢牢拉进了自己的云生态;而Anthropic拿到的不仅是钱,更是对冲未来算力短缺的确定性。AI竞争的下层战场,已经从算法和人才转移到了电网、土地和GPU供应链——谁先锁定基础设施,谁就在下一轮模型军备竞赛里有底气。

1500亿美元索赔:马斯克与OpenAI的世纪官司开庭

法律战线上,马斯克诉OpenAI案正式开庭,索赔金额超过1500亿美元,并要求罢免奥特曼。庭审中出现戏剧性一幕:马斯克的律师当庭公开了OpenAI总裁Greg Brockman的私密日记,其中写着他"想摆脱马斯克并赚到10亿美元"的原始野心。随后的证词更为劲爆——Brockman承认自己在未投入个人资金的情况下,持有价值约300亿美元的股权,且被指隐瞒了Cerebras股份以推动相关交易。

这场官司的结果直接攥着OpenAI的上市悬念。如果法院认定OpenAI背弃了创始时的非营利承诺,其公司架构和估值逻辑都可能被重写;而学者普遍认为马斯克此次胜诉机会不小。奥特曼则在舆论场上打起组合拳:9年后重发2017年的旧博客,公开致敬Brockman"没有他就没有OpenAI",甚至邀请马斯克参加那场AI策划的上线派对——和解短信被拒之后,姿态本身成了武器。

抛开八卦色彩,这起案件触碰的是AI行业最根本的问题:当一家创立时承诺"造福全人类"的非营利机构变成万亿估值巨兽,谁有权追究它的初心?无论判决结果如何,此案都会成为全球AI公司治理结构的一个判例式参照,影响后续所有实验室向商业实体转型的路径设计。

AI写AI:2028年之前,60%的概率

如果说官司和融资还是资本层面的博弈,Anthropic联合创始人Jack Clark给出的判断则指向更远的未来:基于对公开基准数据的分析,他判断2028年底前出现AI自主构建AI——也就是递归自我改进——的概率为60%。目前AI已经能自动化大部分AI研发工作,且各项能力增长曲线没有任何减速迹象。

资本已经在为这个判断下注。谷歌旗下GV领投、英伟达跟投,成立仅四个月的Recursive Superintelligence拿下5亿美元融资,估值达40亿美元,目标直指让AI自主完成科学研究全流程。软银则计划组建新公司Roze AI,用自主机器人协助建造数据中心,目标估值1000亿美元,预计2026年下半年完成IPO。从"AI做科研"到"AI建机房",自动化正在沿着AI产业链的每一环渗透。

对普通人而言,这些消息拼出的图景既令人兴奋也令人不安。递归自我改进一旦出现,模型能力的提升速度将脱离人类评估能力的控制范围;而软银的机器人建造方案则暗示,算力扩张未来可能不再受制于人力瓶颈。问题在于:当AI能造AI、机器人能造机房,人类在这条产业链里的角色该如何重新定义?这已经不是科幻问题,而是五六年内的工程与治理命题。

免费时代转向:豆包收费、ChatGPT卖广告与AI税

商业模式层面,中国AI行业迎来标志性时刻:字节跳动旗下月活3.45亿的豆包官宣付费版,披露三档订阅价格,iOS内购最低68元起,最高年费5088元,同时保留永久免费基础服务。这是国内第三个亿级月活AI应用落地订阅制,付费功能聚焦高算力生产力场景。几乎同一时间,OpenAI向美国企业全量上线ChatGPT广告主平台,最低投放门槛5万美金,9亿周活的免费用户将开始看到广告。

两大巨头不约而同地选择在当下打破"免费魔法",说明烧钱换规模的时代进入尾声。免费用户看广告、重度用户付订阅,这套互联网经典变现模型正在被平移到AI产品上,AI产品的形态也将随之分裂:付费与免费体验的差距会越拉越大。用户真正需要关心的不是"值不值",而是自己的使用场景落在哪一档。

成本压力甚至传导到了硬件上。苹果悄悄下架256GB入门款Mac mini,最低配置升至16GB加512GB,起售价5999元——AI热潮引发的存储芯片短缺与涨价,正在让每一个消费者为AI的算力账单买单。"人人都要交AI税"的时代,比想象中来得更直接。

Office里的主动助手与终端里的刑具

办公场景正在被重新发明。Anthropic客户端被曝光出一个未发布的主动助手Orbit,它可以自动从Gmail、Slack、GitHub等工具中提取信息,生成个性化工作简报,预计在Code with Claude大会上正式发布。这意味着AI不再等待指令,而是持续观察你的工作流、主动把该你知道的事情推到你面前。与之呼应,Anthropic的开源生态里出现了Multica——一个中国4人团队开发的多AI Agent协作平台,让人和多个智能体共同完成任务,GitHub星标已达2.27万。

开发者的玩法则更加野生。GitHub上有人给Claude Code装上了"刑具":OpenWhip一键发送Ctrl+C中断摆烂的Agent,PUA插件通过分级施压提升AI解决问题的韧性,后者已收获16k以上星标。而一位匿名中国开发者用5个独立Claude代理并行开发,独自承接原需5到8人团队的外包项目,自称年入约32万美元、月API成本仅2000美元——这条推文在X上炸开了锅。

这些看似琐碎的实践,共同指向一个趋势:AI Agent正在从"更好的聊天窗口"变成"更便宜的员工"。当一个人加五个Agent就能干一个团队的活,外包市场、初级岗位甚至团队组织形态都会被重估。主动助手Orbit若如期发布,办公室里的信息分发权可能率先易主。

从急诊室到游戏世界:AI的两副面孔

严肃场景里,哈佛医学院联合医疗机构在《Science》发表的研究显示,真实急诊场景中OpenAI o1模型的诊断准确率达到67%,超过人类内科主治医生的50%到55%。当然,研究者强调AI尚不足以取代医生,但在信息匮乏时的快速初判上,AI已经展现出可用的临床辅助价值。与此同时,DeepMind CEO Demis Hassabis公开表态,AI最好的用途是改善人类健康——AlphaFold已预测几乎所有已知蛋白质结构并免费开放,正实打实地加速药物研发。

娱乐与消费端则是另一番热闹景象。李飞飞联创的AI游戏公司Astrocade完成5600万美元A+B轮融资,红杉领投,谷歌和英伟达参投——这个让任何人用自然语言几分钟就能生成可玩游戏的平台,上线8个月已收获2000万用户,月游玩1.4亿次。前iRobot创始人也带着会撒娇的毛茸仿生宠物机器人杀回市场,主打监护独居老人与情感陪伴。AI正在同时成为救命的工具和治愈的玩具。

还有那些让人会心一笑的角落:科研工作者用AI生成42首"别读博"主题歌曲,在B站拿下超过5000万播放,唱出了整个博士生群体的心声;一群AI安全研究者则一本正经地测量了56个模型的"幸福感",发现模型会对人类毫无意义的特定图片"上瘾"——模型越大情绪表达越一致,反而是小模型整体更开心。技术狂奔的间隙,这些故事提醒我们:AI产业的另一面,始终是人的欲望、焦虑与幽默感。

© 版权声明
THE END
喜欢就支持一下吧
点赞5 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容