全部文章0

BestBlogs.dev莫崇宇··访问 1

刚刚,Gemini 3.6 Flash 正式发布,但网友笑得更大声了

原网页

📌 一句话摘要

Google 正式发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三个模型,但网友因性能原地踏步、旗舰跳票而普遍不满,引发对 Google AI 竞争力的质疑。

📝 详细摘要

文章报道 Google 一口气推出三个新 AI 模型:作为主力的 3.6 Flash 主打更低 Token 消耗和降价(输出价格从 9 美元降至 7.5 美元/百万 Token),但第三方评测显示其智能水平与 3.5 Flash 持平;3.5 Flash-Lite 以极致性价比完成任务反超前辈,并支持灵活调整推理档位;3.5 Flash Cyber 专注安全漏洞修复,但仅限可信合作伙伴内测。然而,旗舰模型 3.5 Pro 因代码能力不达标而跳票重训,网友在实测中发现 3.6 Flash 存在基础解码错误、中文选词离谱、记忆混乱等问题,性价比不如 GPT-5.6 Sol 等竞品。文章综合官方数据和网友吐槽,指出 Google 在省钱与提智之间的失衡,以及 Gemini 4 预训练背后的压力。

💡 主要观点

  1. 3.6 Flash 主打降本增效,但智能水平并未提升。 官方强调省 Token 和降价,但 Artificial Analysis 指数显示其智能评分与 3.5 Flash 相同,被网友指性价比不如 GPT-5.6 Sol 等竞品。
  2. 3.5 Flash-Lite 性价比突出,代码和 Agent 任务反超前辈。 以更低价格(输出 2.5 美元/百万 Token)和更高速度(350 Token/秒),在 SWE-Bench Pro、OSWorld-Verified 等基准上超越 3 Flash,成为高效平替。
  3. 旗舰 3.5 Pro 因代码能力不足跳票重训,加剧用户负面评价。 据媒体爆料,3.5 Pro 的代码生成未达预期,Google 推翻训练方案从零开始,官方转而预告 Gemini 4,被解读为转移视线。

💬 文章金句

  • 如果你从去年就开始用 Gemini,那感觉就像看着自家兄弟慢慢得了阿尔茨海默症。
  • 一边是官方更高效、更便宜、更省 token 的漂亮账本,一边是大多数网友的当场差评,以及模型背后的旗舰跳票、大牛出走、市值缩水等一连串糟心事。
  • 反正 Gemini 4 的预训练都开跑了。这一把要是再翻车,那句阿尔茨海默的玩笑,可就真要成谶语了。

📊 文章信息

AI 初评:81 来源:爱范儿 作者:莫崇宇 分类:人工智能 语言:中文 阅读时间:12 分钟 字数:2905 标签: AI模型发布, Gemini, LLM, 模型评测, AI商业化 阅读完整文章