
Gemini 是 Google 旗下的 AI 智能助理,前身为 Bard,由 DeepMind 开发的 Gemini 系列原生多模态模型驱动。它覆盖写作、规划、头脑风暴、编程、深度研究等场景,支持文本、图像、音频与视频的多模态输入,并深度整合 Google 搜索、Gmail、Docs 等全家桶生态;网页版免费可用,亦有 Android/iOS 应用。
功能速览
多模态对话
文字、图片、音频、视频都能输入,实时理解视频画面并回答问题。
深度研究
Deep Research 自动爬取数百个来源,生成带引用的论文级研究报告。
Deep Think
高难度推理模式,逐步思考复杂问题,订阅用户可用更高额度。
图像视频生成
内置图像生成,配合 Veo 系列模型与 Flow 工具生成视频。
Google 生态整合
打通搜索 AI 模式、Gmail、Docs、地图、YouTube,一处提问全生态作答。
开发者 API
Gemini API 与 AI Studio 开放,Vertex AI 面向企业级部署。
模型阵容
Gemini 应用内的模型选项对应不同场景,免费用户也能切换使用基础档:
| 模型 | 定位 | 特点 |
|---|---|---|
| Gemini 3.1 Pro | 旗舰 | 原生多模态推理,订阅解锁,复杂任务与 Agent 场景首选 |
| Gemini 3 Flash | 高性价比 | 低成本提供媲美大模型的快速性能,视觉与代理式编码能力升级 |
| Flash-Lite | 极速轻量 | 网页版默认选项之一,日常问答响应最快 |
| Deep Think | 推理模式 | 3 Pro 时代的深度思考模式,逐步推理 hardest 问题 |
Gemini 3 Pro 发布时以 1501 Elo 登顶 LMArena 榜首,每一项主要基准都显著超越上代 2.5 Pro;订阅用户还可获得最高 100 万 token 上下文窗口,整本书、大代码库一次分析。
特色功能
输入一个研究问题,Gemini 自动拆解、爬取数百个网页来源,交叉比对后生成结构完整、带引用来源的研究报告;订阅用户每天最多可生成约 20 份报告,做行业调研、文献综述的效率远超手动搜索。
Google 生态整合
Gemini 最大的差异化在于"长在 Google 里":搜索的 AI 模式直接由 Gemini 驱动;Workspace 用户可在 Gmail 里让 AI 总结邮件、在 Docs 里续写润色;对话中能调用地图、航班、YouTube 信息;手机端 Gemini 可取代 Google 助理成为系统级助手,跨 App 执行"把这张图发给某某"之类的指令。对学生与研究者,NotebookLM 也由 Gemini 驱动,上传资料即可获得带引用的问答与播客式解读。
价格
网页与 App 有免费档,订阅按用量分层(美区价格,其他地区略有差异):
| 方案 | 价格 | 核心权益 |
|---|---|---|
| 免费版 | $0 | 基础模型对话、限额图像生成、基础功能 |
| Google AI Plus | $4.99/月 | 免费版约 2 倍用量 |
| Google AI Pro | $19.99/月 | 约 4 倍用量,Gemini 3.1 Pro、Deep Research、Flow 视频点数 |
| Google AI Ultra | $249.99/月(前 3 月半价) | 最高用量、Deep Think、Veo 高阶生成、30TB 存储 |
订阅体系正向"AI 点数"制过渡,Pro/Ultra 会员可额外购买点数扩充算力。
适用场景
| 人群/场景 | 典型用法 |
|---|---|
| 学生、研究者 | Deep Research 出带引用的调研报告,NotebookLM 精读资料 |
| 内容创作者 | 图像生成做配图,Veo/Flow 出短视频 |
| 写作者、职场人 | 写作润色、会议规划、Gmail/Docs 内直接召唤 |
| 开发者 | AI Studio 试模型,Gemini API 集成到自己的应用 |
| Android 用户 | 系统级助手,跨 App 执行操作指令 |
常见问题
网页版和 App 都有免费档,可用基础模型对话与限额生成;解锁 Gemini 3.1 Pro、更高额度的 Deep Research 与视频生成需订阅 Google AI Pro($19.99/月)等方案。