云知声发布新一代主力模型U2-Flash,采用稀疏MoE架构,总参数约266B,激活参数仅10B,最快输出速度达300tokens/s,首字响应平均3秒以内。智东西实测显示,它不只在速度上占优,更在长链路Agent、编程与办公任务中做到“又快又好”。
实测中,U2-Flash仅用18分钟便读完Pi代码仓库、搭建出可调用工具的Agent并推送至GitHub,随后快速完成WebUI封装与美化。在Blender大型滑梯建模任务中,它自主规划结构、修复支撑柱穿透等问题,40分钟交付金属质感渲染图,全程无需人工干预。
办公场景同样表现亮眼:面对9篇DeepSeek技术论文,它约40分钟输出演进谱系报告并制成PPT;读取43页云知声半年报后,直接生成内嵌表格、图表可交互的财报分析网页,数据准确且不编造。
这些能力背后是云知声的后训练体系,包括自主闭环演进、多教师在线蒸馏、异步Agent RL等,并探索递归自我改进(RSI)。相比U2,其Coding Agent迭代步数减少约20%~30%,Agent任务完成时间缩短约35%。
U2-Flash定位企业日常任务的默认入口,支持国产芯片部署。不过它在复杂数学推理、前沿科研等任务上仍有边界,更现实的方式是让Flash模型承担高频任务,超出能力时再切换旗舰模型。
