大模型长假静悄悄:不发模型,都在忙什么?

作者:36氪 发布时间:2026-10-11 04:25:55 浏览:2
关键字:
今年十一国内大模型厂商集体沉默,但DeepSeek、智谱、腾讯等并未闲着,转而在算力、融资、Agent和商业化上暗中加码。

今年十一,国内大模型圈罕见地安静了下来。DeepSeek、智谱、月之暗面、阿里、字节、腾讯等厂商集体缺席跑分和价格战,而大洋彼岸的OpenAI和Anthropic却接连发布更新。这与去年春节DeepSeek R1、阿里Qwen除夕抢发的热闹形成鲜明反差。

不过,模型公司并没真放假。DeepSeek在假期里上线了Harness新版本,加入Claude Code兼容,还开源了面向华为昇腾芯片的底层计算组件;智谱则把GLM-5.3推上AWS Bedrock,争夺海外企业客户。模型之外的基础设施和商业化,成了新战场。

资本层面同样动作频频。路透社报道DeepSeek正筹集超800亿元新融资,目标估值约5000亿元;月之暗面据称已完成上市前最后一轮私募融资,估值升至约500亿美元,计划最快2027年赴港上市。腾讯则被曝签下约70亿美元海外算力租赁协议,并考虑发行最多50亿美元离岸债券加码AI基建。

最受期待的旗舰模型却集体缺席:DeepSeek V4.1 Pro和豆包2.2均未亮相。业内分析,旗舰模型提升难度加大,与其仓促发布没惊喜的版本,不如继续打磨。同时,厂商精力正转向个人Agent等新赛道,腾讯、字节、阿里均已布局。

海外Claude、GPT、Gemini仍在轮番更新,国内厂商若慢下来,追赶差距可能被重新拉开。假期结束,是时候拿出新东西了。

阅读原文

本文由AI融业云采集并编辑,仅供学习使用!

本文来自m.toutiao.com,作者36氪

关于AI融业云:一站式AI应用服务平台,了解创始人 | 联系我们

有问题,请联系客服!http://www.rongyeyun.com/kefu/