谷歌发布Gemini 3.1 Flash-Lite：首字响应提速2.5倍

业界

2026

03/04

16:49

IT之家

3 月 4 日消息，谷歌昨日（3 月 3 日）发布博文，宣布推出轻量级 AI 模型 Gemini 3.1 Flash-Lite，声称是其速度最快、最具成本效益的 Gemini 3 系列模型。

开发者目前可通过 Google AI Studio 中的 Gemini API 获取预览版，企业级用户也能在 Vertex AI 平台上同步体验。

价格方面，为大幅降低 AI 应用门槛，谷歌为该模型制定了极具竞争力的价格：每百万输入 Tokens 收费 0.25 美元，每百万输出 Tokens 为 1.50 美元。

在低售价的同时，Gemini 3.1 Flash-Lite 在性能方面实现大幅跨越。权威评测平台 Artificial Analysis 的数据显示，与前代 2.5 Flash 相比，新模型的首字响应速度（TTFT）暴涨 2.5 倍，整体输出速度同步提升 45%。这种极低延迟特性，让其成为构建实时响应体验的理想之选。

在各项核心能力测试中，3.1 Flash-Lite 展现出越级挑战的实力。该模型不仅在 Arena.ai 排行榜上斩获了 1432 分的 Elo 得分，更在多模态理解与逻辑推理测试中全面领先同级竞品。

具体而言，它在 GPQA Diamond 测试中得分率高达 86.9%，在 MMMU Pro 测试中达到 76.8%，甚至在多项指标上超越了体积更大的上一代 Gemini 2.5 Flash 模型。IT之家附上相关数据如下：

除了硬核的性能指标，3.1 Flash-Lite 还在 AI Studio 和 Vertex AI 中标配了创新的“思考层级（thinking levels）”功能。

这一机制支持开发者灵活控制模型在执行任务时的“思考深度”：

在处理海量翻译或内容审核等对成本极度敏感的基础任务时，开发者可调低思考深度以追求极致效率；

而在面临生成用户界面、构建数据看板或复杂逻辑模拟等高难度任务时，则可调高思考层级，激发模型更深度的推理能力。

Latitude、Cartwheel 以及 Whering 等早期测试企业目前已率先将 3.1 Flash-Lite 部署于复杂的业务场景中。测试团队反馈称，该模型不仅具备卓越的处理效率和逻辑推理能力，还能以媲美大型模型的精准度处理复杂输入指令。

【来源：IT之家】

THE END

广告、内容合作请点击这里寻求合作

谷歌

免责声明：本文系转载，版权归原作者所有；旨在传递信息，不代表砍柴网的观点和立场。

相关热点

谷歌“查找”生态更新：用户可与航司共享追踪器信息

3 月 4 日消息，当地时间周二，谷歌宣布了一系列 Android 生态系统的新功能，并同步推出 Pixel 手机的三月软件更新“Pixel Drop”。

业界

谷歌明确：YouTube后台播放为Premium会员专属功能

1 月 30 日消息，谷歌方面今日对 Android Authority 确认，YouTube 已更新其服务规则，明确将后台播放功能限定为 YouTube Premium 会员专属。

业界

隐私组织EFF向苹果、谷歌“开炮”：RCS加密承诺何时

1 月 30 日消息，电子前哨基金会（EFF）今日正式启动“即刻加密”（Encrypt It Already）行动，向苹果、谷歌及 Meta 等科技巨头施压，要求其在全平台范围内落实或扩展端到端加密技术。

业界

“AI脱衣”App泛滥应用商店，苹果谷歌监管滞后引争

1 月 28 日消息，非营利组织“科技透明度项目”（Tech Transparency Project）发布研究报告，称苹果 App Store 和谷歌 Play 商店中出现了多款基于 AI 的“脱衣”类应用，可以利用他人的普通照片生成裸露图...

业界

1.49亿条96GB密码泄露，影响谷歌、苹果、Meta等公司

1 月 27 日消息，安全研究人员 Jeremiah Fowler 于 1 月 23 日发现一个未加密的公共数据库，泄露了约 1.49 亿条用户名和密码，受影响数据包含约 90 万个 iCloud 账户、4800 万个 Gmail 账户及 1700 万个 F...

业界

谷歌发布Gemini 3.1 Flash-Lite：首字响应提速2.5倍

相关热点

最新文章

相关推荐

“特斯拉又割了我 7 万块”

用 eSIM 取代手机卡，究竟难在哪里？

这就是 iPhone 13 的“杀手级新功能”？网友：炒华为冷饭！

谷歌Pixel 6真机曝光：最美安卓屏幕没跑了！

iPhone 13机模曝光：值得等！

苹果计划在美国生产 Apple Car 汽车电池

关注我们