今年十一,国内大模型圈罕见地安静了下来。DeepSeek、智谱、月之暗面、阿里、字节、腾讯等厂商集体缺席跑分和价格战,而大洋彼岸的OpenAI和Anthropic却接连发布更新。这与去年春节DeepSeek R1、阿里Qwen除夕抢发的热闹形成鲜明反差。
不过,模型公司并没真放假。DeepSeek在假期里上线了Harness新版本,加入Claude Code兼容,还开源了面向华为昇腾芯片的底层计算组件;智谱则把GLM-5.3推上AWS Bedrock,争夺海外企业客户。模型之外的基础设施和商业化,成了新战场。
资本层面同样动作频频。路透社报道DeepSeek正筹集超800亿元新融资,目标估值约5000亿元;月之暗面据称已完成上市前最后一轮私募融资,估值升至约500亿美元,计划最快2027年赴港上市。腾讯则被曝签下约70亿美元海外算力租赁协议,并考虑发行最多50亿美元离岸债券加码AI基建。
最受期待的旗舰模型却集体缺席:DeepSeek V4.1 Pro和豆包2.2均未亮相。业内分析,旗舰模型提升难度加大,与其仓促发布没惊喜的版本,不如继续打磨。同时,厂商精力正转向个人Agent等新赛道,腾讯、字节、阿里均已布局。
海外Claude、GPT、Gemini仍在轮番更新,国内厂商若慢下来,追赶差距可能被重新拉开。假期结束,是时候拿出新东西了。
