Gemini 3 系列中速度最快、最具成本效益 AI 模型:谷歌 Gemini 3.1 Flash-Lite 登场,首字响应提速 2.5 倍
谷歌发布Gemini 3.1 Flash-Lite AI模型:速度提升2.5倍,成本低至$0.25/百万Tokens,支持多模态推理,企业级应用首选。
3 月 4 日消息,谷歌昨日(3 月 3 日)发布博文,宣布推出轻量级 AI 模型 Gemini 3.1 Flash-Lite,声称是其速度最快、最具成本效益的 Gemini 3 系列模型。
开发者目前可通过 Google AI Studio 中的 Gemini API 获取预览版,企业级用户也能在 Vertex AI 平台上同步体验。
价格方面,为大幅降低 AI 应用门槛,谷歌为该模型制定了极具竞争力的价格:每百万输入 Tokens 收费 0.25 美元,每百万输出 Tokens 为 1.50 美元。
在低售价的同时,Gemini 3.1 Flash-Lite 在性能方面实现大幅跨越。权威评测平台 Artificial Analysis 的数据显示,与前代 2.5 Flash 相比,新模型的首字响应速度(TTFT)暴涨 2.5 倍,整体输出速度同步提升 45%。这种极低延迟特性,让其成为构建实时响应体验的理想之选。

在各项核心能力测试中,3.1 Flash-Lite 展现出越级挑战的实力。该模型不仅在 Arena.ai 排行榜上斩获了 1432 分的 Elo 得分,更在多模态理解与逻辑推理测试中全面领先同级竞品。
具体而言,它在 GPQA Diamond 测试中得分率高达 86.9%,在 MMMU Pro 测试中达到 76.8%,甚至在多项指标上超越了体积更大的上一代 Gemini 2.5 Flash 模型。附上相关数据如下:

除了硬核的性能指标,3.1 Flash-Lite 还在 AI Studio 和 Vertex AI 中标配了创新的“思考层级(thinking levels)”功能。
这一机制支持开发者灵活控制模型在执行任务时的“思考深度”:
在处理海量翻译或内容审核等对成本极度敏感的基础任务时,开发者可调低思考深度以追求极致效率;
而在面临生成用户界面、构建数据看板或复杂逻辑模拟等高难度任务时,则可调高思考层级,激发模型更深度的推理能力。
Latitude、Cartwheel 以及 Whering 等早期测试企业目前已率先将 3.1 Flash-Lite 部署于复杂的业务场景中。测试团队反馈称,该模型不仅具备卓越的处理效率和逻辑推理能力,还能以媲美大型模型的精准度处理复杂输入指令。

- 《大话西游2》元宵节任务灯谜与字谜答案整理!欢迎补充
- 经典MMORPG《冒险岛M》上线PC!盘点3月外服端游
- 一看吓一跳:雷死人不偿命的囧图集(1033)
- 一看吓一跳:雷死人不偿命的囧图集(1031)
- 一看吓一跳:雷死人不偿命的囧图集(1034)
- 正惊GIF:人神共愤!如此漂亮女教师被气到动手,学生竟一脸无所谓
- 颜值COS,玉足、白丝过膝袜,体操服双马尾,简直太迷人
- 一看吓一跳:雷死人不偿命的囧图集(1035)
- 「体操服の‘液态曲线’!橘望顶配身材|白丝厚D呼之欲出,腰臀比秒杀建模」
- 2月多款重磅新游测试:腾讯网易完美新作齐发、经典韩国MMO新作
- 《蔚蓝档案》「白丝透肤VS发光腹肌!砂狼白子体操服侧拍,腰线凹陷度堪比3D建模」
- 「体操服の‘液态曲线’!橘望顶配身材|白丝厚D呼之欲出,腰臀比秒杀建模」
- 《燕云十六声》掌中宝+特殊蹊跷位置大全,三寸之身任务合集,仅剩7天10连抽连袅袅之音!
- 经典MMORPG《冒险岛M》上线PC!盘点3月外服端游
- 「纯欲天花板」2B花嫁撕破次元!白丝过膝陷肉感,透粉脚底VS发光蛮腰の双重暴击
- 《传奇5》真的要来了?还有《绝地求生》衍生作上线!盘点2026年能够玩到的韩国游戏
- 《大话西游2》元宵节任务灯谜与字谜答案整理!欢迎补充
- 和平精英2025灵敏度分享码:最稳压枪灵敏度方案推荐
- AI大姐姐:胸猛美女,挑战你的视觉极限(221)
- 《魔兽世界》时光服:附魔1-450快速性价比冲级攻略

