📌 一句话摘要
Google 今日发布 Gemini 3.6 Flash、3.5 Flash Lite 和 3.5 Flash Cyber 三款新模型,其中 3.6 Flash 在价格、速度和 token 效率上均有显著提升。
📝 详细摘要
Google 今天一次性发布了三款 Gemini 新模型:Gemini 3.6 Flash、3.5 Flash Lite 和 3.5 Flash Cyber。3.6 Flash 的输出定价从每百万 token $9 降至 $7.50,输入价格保持 $1.50 不变;在 Artificial Analysis Index 上平均少用 17% 输出 token,在 DeepSWE 编码测试中 token 消耗最高降低 65%;实际测试显示相同基准下费用从 $1041 降至 $727,降幅约 30%。生成速度提升至 304 tokens/s,是 3.5 Flash 的约两倍。智能水平方面,3.6 Flash 在 Artificial Analysis Intelligence Index 得分 50(与 3.5 Flash 持平),但在知识工作基准 GDPval-AA 上得分提升至 1421(3.5 Flash 为 1349),Computer Use 能力在 OSWorld-Verified 上从 78.4% 提升至 83%,知识截止日期从 2025 年 1 月提前至 2026 年 3 月。与竞品对比显示,3.6 Flash 在 OSWorld 和两项长上下文测试中领先,但 GPT-5.6 Luna 在 DeepSWE 和 Terminal-bench 更强,Grok 4.5 在 SWE-Bench Pro 领先,Claude Sonnet 5 在 MLE-Bench 和 GDPVal-AA v2 上得分最高;四家模型在多数基准上差距不大,实际选择更多取决于具体任务和价格。3.5 Flash Lite 定价极低($0.30/$2.50 输入/输出),适用于高吞吐场景;3.5 Flash Cyber 专注网络安全,仅对政府和受信任合作伙伴开放。值得注意的是,Gemini 3.5 Pro 仍未公开发布,Bloomberg 报道其延期原因是内部编码基准表现不达预期,目前仅在少数合作伙伴和美国政府处测试。Google 同时宣布,下一代 Gemini 4 已启动迄今为止最大规模的预训练。3.6 Flash 已可在 GitHub Copilot、Gemini 应用、Google AI Studio 及 Google Antigravity(Google I/O 5 月推出的 Agent 开发桌面平台)中使用。