Gemini 3.6 Flash:智能体成本大幅优化

谷歌发布新一代高效AI模型
谷歌DeepMind今日宣布推出三款全新专有AI模型,称其为迄今为止最具token效率的模型之一:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及Gemini 3.5 Flash Cyber。
智能体性能与成本双重突破
这些新一代模型旨在提升AI智能体在规模化应用中的速度、智能程度和成本效益。谷歌通过其应用程序编程接口(API)为Gemini 3.6 Flash定价为每百万输入token 1.50美元,每百万输出token 7.50美元;而Gemini 3.5 Flash-Lite的价格更为亲民,输入和输出token分别仅需0.30美元和2.50美元。
价格对比与成本优势
与市场上其他模型相比,这些新模型展现出显著的成本优势。以Gemini 3.5 Flash为例,其价格为每百万token 1.50美元(输入)/9.00美元(输出);Gemini 3.1 Pro Preview则为2.00美元/12.00美元。虽然谷歌前代产品Gemini 3.1 Flash-Lite仍以0.25美元/1.50美元的价格保持”最具成本效益”的地位,但其速度仅为新款Gemini 3.5 Flash-Lite的一半,使那些更重视性能的企业能够获得更高的性价比。
行业主要AI模型定价比较
以下为当前市场上主要AI模型的API定价对比(2026年7月精选):
| 模型 | 输入($/1M) | 输出($/1M) | 总计($/1M) | 来源 |
|---|---|---|---|---|
| MiMo-V2.5 Flash | $0.10 | $0.30 | $0.40 | 小米 |
| deepseek-v4-flash | $0.14 | $0.28 | $0.42 | DeepSeek |
| deepseek-v4-pro | $0.435 | $0.87 | $1.305 | DeepSeek |
| MiniMax-M3 | $0.30 | $1.20 | $1.50 | MiniMax |
| LongCat-2.0 — 限时优惠 | $0.30 | $1.20 | $1.50 | LongCat |
| Gemini 3.1 Flash-Lite | $0.25 | $1.50 | $1.75 | 谷歌 |
| Qwen3.7-Plus | $0.40 | $1.60 | $2.00 | 阿里云 |
| MiMo-V2.5 | $0.40 | $2.00 | $2.40 | 小米 |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | $2.80 | 谷歌 |
| LongCat-2.0 — 标准版 | $0.75 | $2.95 | $3.70 | LongCat |
| MiMo-V2.5 Pro (≤256K) | $1.00 | $3.00 | $4.00 | 小米 |
| GLM-5.2 | $1.40 | $4.40 | $5.80 | Z.ai |
| GPT-5.6 Luna | $1.00 | $6.00 | $7.00 | OpenAI |
| Grok 4.5 | $2.00 | $6.00 | $8.00 | xAI |
| MiMo-V2.5 Pro (>256K) | $2.00 | $6.00 | $8.00 | 小米 |
| Gemini 3.6 Flash | $1.50 | $7.50 | $9.00 | 谷歌 |
| Qwen3.7-Max | $2.50 | $7.50 | $10.00 | 阿里云 |
| Gemini 3.5 Flash | $1.50 | $9.00 | $10.50 | 谷歌 |
| Gemini 3.1 Pro Preview (≤200K) | $2.00 | $12.00 | $14.00 | 谷歌 |
| GPT-5.6 Terra | $2.50 | $15.00 | $17.50 | OpenAI |
| GPT-5.4 | $2.50 | $15.00 | $17.50 | OpenAI |
| Kimi K3 | $3.00 | $15.00 | $18.00 | 月之暗面 |
| Gemini 3.1 Pro Preview (>200K) | $4.00 | $18.00 | $22.00 | 谷歌 |
| Claude Opus 4.8 | $5.00 | $25.00 | $30.00 | Anthropic |
| GPT-5.5 | $5.00 | $30.00 | $35.00 | OpenAI |
| GPT-5.5 Instant (chat-latest) | $5.00 | $30.00 | $35.00 | OpenAI |
| Sakana Fugu Ultra (≤272K) | $5.00 | $30.00 | $35.00 | Sakana AI |
| GPT-5.6 Sol | $5.00 | $30.00 | $35.00 | OpenAI |
| Claude Fable 5 / Claude Mythos 5 | $10.00 | $50.00 | $60.00 | Anthropic |
专业模型与长期任务优势
针对特定领域,Gemini 3.5 Flash Cyber专业模型尚未公布价格,但如其名称所示,该模型专为网络安全研究人员和红队专家设计,用于修补安全漏洞。在长期工程任务上,这些新模型可将智能体的token成本降低高达65%。
尽管这些模型的价格在全球主要AI产品中处于中低端水平,但谷歌在设计时特别优化了token使用效率,这意味着企业实际支付的总成本可能低于标价所示(因为无论何种情况,总体token使用量都会减少)。
立即可用与未来展望
Gemini 3.6 Flash和Gemini 3.5 Flash-Lite已可通过谷歌AI Studio和Android Studio的Gemini API立即使用。值得一提的是,Gemini 3.5 Pro也正在开发中,预计将为市场带来更多创新。
关注微信号:智享开源 ,及时了解更新信息。


公众号:智享开源
还没有任何评论,你来说两句吧!