Gemini

♨1.4万 热度

Google Gemini 是 Google 推出的多模态 AI 助手,基于 Gemini 系列大模型,支持文本、图像、音频、视频原生理解。最新 Gemini 3 系列(3.6 Flash / 3.5 Flash / 3.1 Pro)覆盖从轻量到旗舰的全场景。本文基于 Google AI 官方文档与公开资料,全面解析 Gemini 功能、模型家族、API 定价、应用场景与常见问题。

直达网站
Gemini 工具界面或产品展示图
工具介绍

Google Gemini 是什么?

Google Gemini Logo
Google Gemini——Google DeepMind 出品

Google Gemini 是 Google(谷歌)推出的多模态 AI 产品,2023 年 12 月 6 日首次发布,原生支持文本、图像、音频、视频和代码处理。Gemini 由 Google DeepMind 团队研发,采用原生多模态架构,从预训练阶段即同步处理多种模态数据,无需 OCR 或语音转写中间件。

Gemini 的产品线包括:

  • Gemini 网页版/App(gemini.google.com):面向个人用户,免费 + Gemini Advanced 付费订阅

  • Gemini API(ai.google.dev):面向开发者,提供 Gemini 3 系列模型 API

  • Google AI Studio / Vertex AI:面向开发者和企业的模型开发平台

  • Gemini Advanced:Google One AI Premium 订阅($20/月),解锁最强模型

Gemini 的上线标志着 Google 正式进入 AI 对话助手赛道,与 ChatGPT 展开正面竞争。截至 2026 年,Gemini 已迭代至 Gemini 3 系列,在智能体、多模态和编程任务上持续领先。

Google Gemini 网页界面截图
Google Gemini 网页界面(图片来源:gemini.google.com)

Gemini 核心功能

功能

说明

智能对话

多轮对话、知识问答、深度推理(Flash-Lite 模式可选)

图像理解

原生多模态,识别图片、图表、手写文字

图像生成

Nano Banana 2 高效图片生成与编辑

视频理解

原生视频分析,支持帧级解析

视频生成

Veo 3.1 电影级视频生成,支持原生音频

音乐创作

Lyria 3 音乐生成,支持完整歌曲和短片段

实时语音

Gemini Live API 低延迟语音对话

实时翻译

Gemini 3.5 实时翻译,支持 70+ 语言

深度研究

Deep Research Agent 自主规划多步研究

计算机使用

屏幕可见、点击、输入、导航(Computer Use)

Google 生态

Google Search、Google Maps、代码执行、文件搜索

MCP 支持

模型上下文协议,第三方工具接入

Gemini 模型家族(2026 年 8 月)

最新:Gemini 3 系列 最新

模型

状态

定位

输入价格

输出价格

Gemini 3.6 Flash

稳定

最新,速度与智能平衡,智能体/多模态

$0~$1.50/MTok

$0~$7.50/MTok

Gemini 3.5 Flash

稳定

最智能,智能体/编程前沿性能

$0~$1.50/MTok

$0~$7.50/MTok

Gemini 3.5 Flash-Lite

稳定

最快、最具成本效益

$0~$1.50/MTok

$0~$2.50/MTok

Gemini 3.1 Flash-Lite

稳定

高性价比,可与 Frontier 级模型媲美

$0~$1.50/MTok

$0~$1.50/MTok

Gemini 3.1 Pro

预览

高级智能、复杂问题解决、Agent/编程

按 Gemini 3.1 Pro 价格

Gemini 3 Flash

预览

低成本 Frontier 级性能

$0~$1.50/MTok

$0~$3.00/MTok

Gemini 3 系列模型均有免费层(低于一定用量免费),超出后按上述价格计费。

Gemini 2.5 系列

  • Gemini 2.5 Pro:最先进模型,深度推理和编码(gemini-2.5-pro)

  • Gemini 2.5 Flash:性价比出色,低延迟推理任务(gemini-2.5-flash)

  • Gemini 2.5 Flash-Lite:最快、最具预算友好型多模态(gemini-2.5-flash-lite)

专业模型

  • Nano Banana 2:高效图片生成和编辑(gemini-3.1-flash-image)

  • Nano Banana 2 Lite:超低延迟经济型图片生成

  • Nano Banana Pro:前沿 4K 图片生成,精准文字渲染

  • Veo 3.1:电影级视频生成,支持原生同步音频($0.40/视频)

  • Gemini Omni Flash:对话式视频生成和编辑

  • Lyria 3 Pro / Clip / RealTime:音乐创作模型

  • Gemini 3.5 实时翻译:低延迟翻译,支持 70+ 语言

  • Gemini Deep Research / Deep Research Max:自主多步研究

  • Antigravity Agent:通用托管式智能体

Gemini API 定价(2026 年 8 月)

Gemini API 提供慷慨的免费层,超出后按量计费(每百万 tokens):

模型

输入(免费层后)

输出(免费层后)

Gemini 3.6 Flash

$1.50

$7.50

Gemini 3.5 Flash

$1.50

$7.50

Gemini 3.5 Flash-Lite

$1.50

$2.50

Gemini 3.1 Flash-Lite

$1.50

$1.50

Gemini 3 Flash

$1.50

$3.00

Gemini 2.5 Flash-Lite

$0.075

$0.30

Gemini 2.0 Flash-Lite

$0.075

$0.30

其他服务

服务

价格

Google Search 接地

免费 5,000 条/月,超出 $14/千次

Imagen 4(Fast / Standard / Ultra)

$0.02 / $0.04 / $0.06 每张

Veo 3 Standard 视频(含音频)

$0.40/视频

计算机使用

按对应模型 token 价格计费

Gemini 的核心优势

  1. 原生多模态:从预训练阶段即原生处理文本、图像、音频、视频,无需中间件

  2. Gemini 3 系列:最新 3.6 Flash 在智能体和多模态任务上表现出色

  3. Google 生态整合:深度集成 Google Search、Maps、Gmail、YouTube 等

  4. 慷慨免费层:Gemini 3 系列模型提供免费配额,降低使用门槛

  5. 全模态覆盖:文本、图像、视频、音乐、语音、翻译全覆盖

  6. Agent 生态:Computer Use、Deep Research、Antigravity Agent 等前沿能力

Gemini 的应用场景

  • 智能助手:日常对话、知识问答、日程管理(Gemini 网页版/App)

  • 编程开发:代码生成、调试、Agent 开发(Gemini 3.5 Flash)

  • 内容创作:图像生成(Nano Banana 2)、视频生成(Veo 3.1)、音乐创作(Lyria 3)

  • 多模态分析:视频理解、图表分析、文档处理(Gemini 3.6 Flash)

  • 实时翻译:70+ 语言实时语音翻译(Gemini 3.5 实时翻译)

  • 深度研究:Deep Research 自动生成研究报告

  • 企业应用:Vertex AI 企业级部署、智能客服、数据分析

Gemini 常见问题(FAQ)

Q1:Gemini 收费吗?

Gemini 网页版和 App 提供免费版,基础功能免费。Gemini Advanced(Google One AI Premium)为 $20/月,解锁最强模型和更多功能。API 有免费层,超出后按量计费。

Q2:Gemini 3 和 Gemini 2.5 有什么区别?

Gemini 3 是最新一代,3.6 Flash 在速度和智能性之间平衡,智能体和多模态任务表现出色;2.5 Pro 是前代最先进模型,深度推理和编码能力强。

Q3:Gemini 支持中文吗?

支持。Gemini 支持多种语言,包括中文对话、写作和翻译。

Q4:Gemini 可以生成图片和视频吗?

可以。Nano Banana 2 系列支持图片生成和编辑,Veo 3.1 支持电影级视频生成,Gemini Omni Flash 支持对话式视频操作。

Q5:如何调用 Gemini API?

通过 Google AI Studio(ai.google.dev)或 Vertex AI 获取 API Key,使用 Gemini API 调用 Gemini 3 系列模型。

Q6:Gemini 和 ChatGPT 有什么区别?

Gemini 由 Google 开发,原生多模态架构,深度整合 Google 生态(Search、Maps、Gmail 等),在视频理解和多模态任务上更具优势;ChatGPT 由 OpenAI 开发,在推理和编程上同样强大。

如何开始使用 Gemini

  1. 网页版:打开 gemini.google.com,登录 Google 账号即可免费使用

  2. 移动 App:在 App Store / Google Play 搜索"Google Gemini"下载

  3. Gemini Advanced:订阅 Google One AI Premium($20/月)解锁最强模型

  4. 开发者:通过 Google AI Studio 获取 API Key,调用 Gemini API

  5. 企业:通过 Vertex AI 使用 Gemini 企业级服务

结语

从 2023 年 12 月发布到 2026 年的 Gemini 3 系列,Google Gemini 凭借原生多模态架构、Google 生态整合和慷慨的免费策略,已经成为全球最具竞争力的 AI 产品之一。无论你是普通用户、开发者还是企业,Gemini 都值得一试。