Gemini 3.6 Flash:智能体成本大幅优化

Gemini 3.6 Flash:智能体成本大幅优化

谷歌发布新一代高效AI模型

谷歌DeepMind今日宣布推出三款全新专有AI模型,称其为迄今为止最具token效率的模型之一:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及Gemini 3.5 Flash Cyber。

智能体性能与成本双重突破

这些新一代模型旨在提升AI智能体在规模化应用中的速度、智能程度和成本效益。谷歌通过其应用程序编程接口(API)为Gemini 3.6 Flash定价为每百万输入token 1.50美元,每百万输出token 7.50美元;而Gemini 3.5 Flash-Lite的价格更为亲民,输入和输出token分别仅需0.30美元和2.50美元。

价格对比与成本优势

与市场上其他模型相比,这些新模型展现出显著的成本优势。以Gemini 3.5 Flash为例,其价格为每百万token 1.50美元(输入)/9.00美元(输出);Gemini 3.1 Pro Preview则为2.00美元/12.00美元。虽然谷歌前代产品Gemini 3.1 Flash-Lite仍以0.25美元/1.50美元的价格保持”最具成本效益”的地位,但其速度仅为新款Gemini 3.5 Flash-Lite的一半,使那些更重视性能的企业能够获得更高的性价比。

行业主要AI模型定价比较

以下为当前市场上主要AI模型的API定价对比(2026年7月精选):

模型 输入($/1M) 输出($/1M) 总计($/1M) 来源
MiMo-V2.5 Flash $0.10 $0.30 $0.40 小米
deepseek-v4-flash $0.14 $0.28 $0.42 DeepSeek
deepseek-v4-pro $0.435 $0.87 $1.305 DeepSeek
MiniMax-M3 $0.30 $1.20 $1.50 MiniMax
LongCat-2.0 — 限时优惠 $0.30 $1.20 $1.50 LongCat
Gemini 3.1 Flash-Lite $0.25 $1.50 $1.75 谷歌
Qwen3.7-Plus $0.40 $1.60 $2.00 阿里云
MiMo-V2.5 $0.40 $2.00 $2.40 小米
Gemini 3.5 Flash-Lite $0.30 $2.50 $2.80 谷歌
LongCat-2.0 — 标准版 $0.75 $2.95 $3.70 LongCat
MiMo-V2.5 Pro (≤256K) $1.00 $3.00 $4.00 小米
GLM-5.2 $1.40 $4.40 $5.80 Z.ai
GPT-5.6 Luna $1.00 $6.00 $7.00 OpenAI
Grok 4.5 $2.00 $6.00 $8.00 xAI
MiMo-V2.5 Pro (>256K) $2.00 $6.00 $8.00 小米
Gemini 3.6 Flash $1.50 $7.50 $9.00 谷歌
Qwen3.7-Max $2.50 $7.50 $10.00 阿里云
Gemini 3.5 Flash $1.50 $9.00 $10.50 谷歌
Gemini 3.1 Pro Preview (≤200K) $2.00 $12.00 $14.00 谷歌
GPT-5.6 Terra $2.50 $15.00 $17.50 OpenAI
GPT-5.4 $2.50 $15.00 $17.50 OpenAI
Kimi K3 $3.00 $15.00 $18.00 月之暗面
Gemini 3.1 Pro Preview (>200K) $4.00 $18.00 $22.00 谷歌
Claude Opus 4.8 $5.00 $25.00 $30.00 Anthropic
GPT-5.5 $5.00 $30.00 $35.00 OpenAI
GPT-5.5 Instant (chat-latest) $5.00 $30.00 $35.00 OpenAI
Sakana Fugu Ultra (≤272K) $5.00 $30.00 $35.00 Sakana AI
GPT-5.6 Sol $5.00 $30.00 $35.00 OpenAI
Claude Fable 5 / Claude Mythos 5 $10.00 $50.00 $60.00 Anthropic

专业模型与长期任务优势

针对特定领域,Gemini 3.5 Flash Cyber专业模型尚未公布价格,但如其名称所示,该模型专为网络安全研究人员和红队专家设计,用于修补安全漏洞。在长期工程任务上,这些新模型可将智能体的token成本降低高达65%。

尽管这些模型的价格在全球主要AI产品中处于中低端水平,但谷歌在设计时特别优化了token使用效率,这意味着企业实际支付的总成本可能低于标价所示(因为无论何种情况,总体token使用量都会减少)。

立即可用与未来展望

Gemini 3.6 Flash和Gemini 3.5 Flash-Lite已可通过谷歌AI Studio和Android Studio的Gemini API立即使用。值得一提的是,Gemini 3.5 Pro也正在开发中,预计将为市场带来更多创新。


关注微信号:智享开源 ,及时了解更新信息。

原文链接:https://venturebeat.com/technology/googles-gemini-3-6-flash-model-cuts-ai-agent-token-costs-by-up-to-65-on-long-horizon-engineering-tasks-and-3-5-pro-is-on-the-way

评论列表
发表评论
😀 😂 😃 😄 😅 😆 😉 😊 😋 😎 😍 😘 🥰 😜 😝 🤗 🤔 😭 😤 👍

为你推荐
Ta的个人站点

Mark Do发布文章2081篇

如我距离死亡还有45年,我还活着,该怎么度过现在。


公众号:智享开源

分类