AI万址
Gemini

Gemini

Gemini是Google DeepMind的大模型系列,最新3.6 Flash输入$1.50/M、输出$7.50/M,token效率提升17%,MCP Atlas多步骤工作流跑出83.6%领先行业。

Gemini
访问官网
基本信息详情
开发公司Google DeepMind
上线时间Gemini 1.0于2023年12月发布,当前最新为Gemini 3.6 Flash
官网https://deepmind.google/technologies/gemini
支持平台Web(gemini.google.com)/ Google AI Studio / API / Google全家桶集成
价格免费层有限额;API $1.50/M输入token起;订阅€4.99-€99.99/月
核心定位前沿智能与行动(Frontier intelligence with action)

Gemini是Google DeepMind的大模型系列,2023年12月发布1.0版本,到现在已经迭代到3.6 Flash。它的定位口号是"Frontier intelligence with action"--前沿智能与行动。关键词不是"智能",是"行动"。Google想说的是:这个模型不只会回答问题,还会动手干活。

这跟行业风向一致。2026年大模型竞赛的核心已经不是谁的benchmark分数更高,而是谁能真正执行任务。Gemini 3.5 Flash在MCP Atlas(多步骤工作流)跑出83.6%,在Toolathlon(真实工具使用)跑出56.5%,在Finance Agent v2(金融分析决策)跑出57.9%--这几项都领先GPT-5.5和Claude系列。它不是在聊天,是在调度工具、编排多Agent、跑长周期任务。

I/O 2026上Google重组了订阅体系:新增$100/月的AI Ultra档,顶配从$250降到$200,所有付费档都拿到了Gemini Omni和3.5 Flash。还推出了Gemini Spark--一个能24/7在Google产品间替你跑腿的AI agent。

核心功能

01

模型矩阵:按需选"大脑"

Gemini不是单一模型,是一个系列,按场景分层:

  • Gemini 3.6 Flash:最聪明的快速模型,专为速度打造,token效率最高。API定价$1.50/M输入、$7.50/M输出,比3.5 Flash的$9.00降了17%,且同等任务少用17%的输出token--实际输出花费降约31%。SWE-Bench Pro 58.7%,Terminal-bench 78.0%。
  • Gemini 3.5 Flash-Lite:高吞吐场景专用,$0.30/M输入、$2.50/M输出,约350 token/秒。适合量大、对延迟不敏感的任务。
  • Gemini 3.1 Pro:复杂任务和创意概念落地,$2.00/M输入、$12.00/M输出。SWE-Bench 54.2%,Humanity's Last Exam 44.4%。
  • Gemini 3.1 Deep Think:科学、研究和工程难题专用,深度推理模式。

选型逻辑很简单:日常coding和知识工作用3.6 Flash,量大求便宜用Flash-Lite,复杂创意用Pro,硬核科研用Deep Think。

02

Agentic Coding:复杂开发任务一把梭

Gemini 3.5 Flash能在60秒内生成6个支付UI方案,能读完AlphaGo论文并自主构建一个智能游戏。它的agentic coding不是"写一段代码给你",而是迭代循环--生成、测试、修改、再生成。Terminal-bench 2.1拿到76.2%,说明它在终端环境里能自主操作、调试、修复。

03

长周期任务执行

这是Gemini 3.5最拉开差距的地方。它能编排多Agent工作流,在较长时间跨度内执行复杂任务。比如协调一支专门的Agent小队设计和建造虚拟城市,或者自动重命名和整理混乱的数据集。Long horizon任务不是一次性对话,是一个持续运行的自动化流程。

04

多模态理解

文字、图片、视频、音频都能处理,能转化成富交互式UI。CharXiv(复杂图表推理)84.2%,MMMU-Pro(多模态理解推理)83.6%--这两项都领先GPT-5.5和Claude。它不只是在"看"图,是在理解图里的空间关系和数据含义。

05

Google生态集成

这是Gemini独有的护城河。它深度集成Gmail、Docs、Sheets、Search、Photos、YouTube。AI Inbox能从Gmail里提炼待办事项、草拟回复、关联文档。Daily Brief把Gmail、Calendar、Gemini聊天汇总成早晨简报。Gemini Spark能跨Google产品替你执行任务。

适合谁

开发者

需要agentic coding能力的程序员,尤其是长周期、多步骤的开发任务

知识工作者

需要深度研究和长报告的分析师、研究员

Google生态重度用户

Gmail、Docs、Drive、Calendar日常使用者,Gemini能把这些工具串起来

企业团队

需要企业级安全、合规和专属支持的规模化部署

创作者

需要多模态生成(文生图、文生视频、文生音乐)的内容生产者

同类竞品对比

维度Gemini 3.6 FlashGPT-5.6 LunaClaude Sonnet 5Grok 4.5
输入价格/M token$1.50$1.00$3.00(折扣$2.00)$2.00
输出价格/M token$7.50$6.00$15.00(折扣$10.00)$6.00
SWE-Bench Pro58.7%62.7%63.2%64.7%
MCP Atlas(多步骤工作流)83.6%75.3%--
Terminal-bench78.0%84.7%80.4%83.3%
多模态(MMMU-Pro)83.6%81.2%74.5%-
生态集成Google全家桶Microsoft/Apple第三方接入X(Twitter)

FAQ

A

Q:Gemini有免费层吗? 有。Google AI Studio提供免费层,对特定模型访问有限,免费输入输出token。但注意:免费层内容可能被用于改进Google产品,敏感数据请用付费层。

A

Q:Gemini 3.6 Flash比3.5 Flash便宜多少? 输入价格持平($1.50/M),输出价格从$9.00降到$7.50/M。加上token效率提升17%,实际每单位工作的输出花费降约31%。

A

Q:Gemini订阅和API付费有什么区别? 订阅(Google AI Pro/Ultra)是面向终端用户的月费,按档位给Gemini App使用额度和Google生态功能。API按token计费,面向开发者,用多少付多少,失败调用不收费。

A

Q:Gemini和ChatGPT哪个强? 看场景。Coding和terminal操作GPT-5.6 Luna略强(Terminal-bench 84.7% vs 78.0%),但多步骤工作流Gemini明显领先(MCP Atlas 83.6% vs 75.3%)。多模态理解Gemini占优。如果你重度使用Google生态,Gemini的集成优势不可替代。

A

Q:Gemini Spark是什么? Google在I/O 2026推出的24/7 AI agent,能在Google产品间替你执行任务。目前限Ultra订阅用户,美国区可用。

A

Q:企业怎么接入? Gemini Enterprise Agent Platform提供专属支持、高级安全合规、预配吞吐量和阶梯折扣。联系Google Cloud销售团队。

更新动态

客户评论

综合评分:4.4/5(基于开发者社区与公开评测汇总)

"3.6 Flash的token效率提升是真金白银的省。我们做RAG pipeline,每月API成本直接降了三成,缓存命中后还能再省。" -- 后端工程师

"agentic coding能力很强,60秒出6个UI方案,迭代循环比我自己写快多了。但复杂任务偶尔会跑偏,需要人工干预。" -- 全栈开发者

"Google生态集成是杀手锏。AI Inbox把我的Gmail待办提炼出来,Daily Brief每天早上给我一份简报,这是ChatGPT给不了的。" -- 知识工作者

"Flash-Lite $0.30/M输入是真的便宜,我们量大求吞吐的场景用得很爽,但对质量要求高的任务还是要切回3.6 Flash。" -- 数据工程师

参考来源