全部文章0

BestBlogs.dev小互··访问 1

新模型性能对比:更少 Token、更高代码质量和电脑操作能力

原网页

📌 一句话摘要

与上一代 3.5 Flash 相比,新模型在多项任务上输出 Token 减少 17%,代码质量提升显著。

📝 详细摘要

作为 Thread 的后续推文,小互详细对比了新模型(上下文推测为 Gemini 3.6 Flash)与上一代的改进:输出 Token 减少 17%,价格下降;DeepSWE 得分从 37% 提升至 49%;OSWorld 测试达到 83%,在知识型工作上也有明显进步。配图显示具体数据。

📊 文章信息

AI 初评:83 来源:小互(@imxiaohu) 作者:小互 分类:人工智能 语言:中文 阅读时间:1 分钟 字数:166 标签: Gemini 3.6 Flash, 模型对比, 性能提升, 代码质量, 电脑操作 阅读推文