📌 一句话摘要
与上一代 3.5 Flash 相比,新模型在多项任务上输出 Token 减少 17%,代码质量提升显著。
📝 详细摘要
作为 Thread 的后续推文,小互详细对比了新模型(上下文推测为 Gemini 3.6 Flash)与上一代的改进:输出 Token 减少 17%,价格下降;DeepSWE 得分从 37% 提升至 49%;OSWorld 测试达到 83%,在知识型工作上也有明显进步。配图显示具体数据。
与上一代 3.5 Flash 相比,新模型在多项任务上输出 Token 减少 17%,代码质量提升显著。
作为 Thread 的后续推文,小互详细对比了新模型(上下文推测为 Gemini 3.6 Flash)与上一代的改进:输出 Token 减少 17%,价格下降;DeepSWE 得分从 37% 提升至 49%;OSWorld 测试达到 83%,在知识型工作上也有明显进步。配图显示具体数据。
这里只读取已保存内容,不会调用 AI 或消耗 Token。
这里只读取已保存内容,不会调用 AI 或消耗 Token。