2026年9月,苹果在Hugging Face上架视觉语言模型apple/LensVLM-9B,参数规模9B,模型卡Base Model一栏明确写着Built on Qwen3.5-9B。以封闭著称的苹果,把大模型权重放上全球开源广场,底座却选了中国阿里的开源权重,迅速在开发者社区刷屏。
该模型源自苹果5月发表的LensVLM论文,专攻长文档处理:先用低分辨率缩略图快速扫一遍,再只对关键页做高清提取。论文自报数据显示,Token消耗约降84%,KV Cache从约1.6GB压到约250MB,让同一块显卡能服务更多长文档任务。
苹果为何不用自家基座?从工程账看,从零训练9B级基座需海量数据和数千张卡连轴数月,周期以年计。而Qwen家族在中等尺寸上已被全球开发者反复实测微调,苹果把精力集中到长文档压缩这一真问题上,是更短更省的路径。
更具标志意义的是,苹果主动把模型放上Hugging Face接受公开检验。通义千问开源家族半年内全球下载量超30亿次、衍生模型超30万个,虽为单源数据待复核,但方向已明——开源圈的尺子不再按国别划分,工程质量才是唯一敲门砖。
从跟在别人后面调参,到被顶级厂商写进Base Model一栏,国产开源基座正杀入全球第一阵营。开源版图走向多极,分散选型本身,就是生态成熟的标志。
