数码之家

 找回密码
 立即注册
搜索
查看: 159|回复: 0

[业界] 谷歌 Gemini 2.5 Flash 混合推理 AI 模型上线:性能成本双优

[复制链接]
发表于 2025-4-19 01:39:10 | 显示全部楼层 |阅读模式

爱科技、爱创意、爱折腾、爱极致,我们都是技术控

您需要 登录 才可以下载或查看,没有账号?立即注册

x
谷歌公司(4 月 17 日)发布公告,宣布在 Google AI Studio 和 Vertex AI 中,以 Gemini API 的方式推出 Gemini 2.5 Flash Preview 预览 AI 模型。
用户还可通过 Gemini 应用内的模型选择器直接使用,并结合 Canvas 工具优化文档和代码编辑。
IT之家此前报道,Gemini 2.5 Flash 是一个混合推理模型,具备“动态且可控”的计算能力,开发者能够根据查询请求的复杂程度灵活调整处理时间。
谷歌指出,Gemini 2.5 Flash 非常适合用于“高容量”和“实时”的应用场景,例如客户服务和文档解析。谷歌在其博客文章中提到:“这款工作型模型专门针对低延迟和降低成本进行了优化,是响应式虚拟助手和实时总结工具的理想引擎”。
根据谷歌官方公布的定价,Gemini 2.5 Flash 模型每 100 万 tokens 输入为 0.15 美元,每 100 万 tokens 输出(不含推理)为 0.6 美元、每 100 万 tokens 输出(含推理)为 3.5 美元.
作为首款全混合推理模型,开发者可根据需求开关推理功能,灵活调整响应质量、成本和延迟,与 Anthropic 和 Grok 的前沿模型相比,Gemini 2.5 Flash 成本更低但表现不俗。

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

APP|手机版|小黑屋|关于我们|联系我们|法律条款|技术知识分享平台

闽公网安备35020502000485号

闽ICP备2021002735号-2

GMT+8, 2025-5-22 22:41 , Processed in 0.140400 second(s), 9 queries , Redis On.

Powered by Discuz!

© 2006-2025 MyDigit.Net

快速回复 返回顶部 返回列表