谷歌连续三月更新Gemini Flash系列至3.8,单价未涨,但通过增加推理步骤提升任务完成度,导致Token消耗增加,平均成本从0.40美元升至0.58美元。
此次迭代重点提升Agent能力,Arena排名从32名升至14名,实测中3.8 Flash可在一分钟内完成四缸发动机互动模拟,但文本表述变得冗余,如解释电贝斯时要求“猛烈拨动最粗的4弦”而非“拨动4弦”。
速度仍是最大优势,高推理模式下每秒输出超300 Token,远超竞品。谷歌定位Flash为“worker agent”,侧重快速执行,采取“质量不够,速度来凑”策略,打造“旗舰级Flash”,但Pro模型迟迟未发,令人期待。
