登录
注册
据 Woofun AI 消息,谷歌发布 Gemini 3.6 Flash 模型,该版本在 Agent 任务执行上实现了速度与成本的双重优化。测试数据显示,其平均任务处理时间由 2.7 分钟缩短至 1.3 分钟,单次处理成本从 0.59 美元降至 0.50 美元。在模拟现实知识工作的 GDPval-AA v2 测试中,Elo 评分从 1349 提升至 1421。
尽管性能指标有所改善,该模型的‘人工分析通用智能指数’仍为 50 分,与上一代 Gemini 3.5 Flash 持平。由于榜单前十名的最低门槛为 51 分,Gemini 3.6 Flash 在综合排名中位列第 11 名,未能进入前列。