一、Gemini 是什么:Google 的原生多模态 AI 助手

Google Gemini 是 Google 推出的对话式 AI 助手,访问地址为 gemini.google.com,同时提供 iOS/Android App。它最核心的两个特点是:

  • 原生多模态:Gemini 从底层就支持文字、图片、文件、音频甚至视频的混合理解与生成,你可以一次性上传截图、PDF 和一段问题,让它综合作答。
  • 深度融入 Google 生态:它与 Google 搜索、Gmail、Docs、Drive、YouTube、NotebookLM 等打通,能直接调用你的邮件、云端文档作为上下文,这是它相比其他 AI 的最大差异化优势。

2026 年的 Gemini 免费版即可使用图片生成/编辑、Deep Research(深度研究)、Gemini Live 语音对话、Canvas 协作画布和 Gems 自定义助手等能力。

二、如何访问:免费版与付费订阅

登录方式很简单:用 Google 账号在 gemini.google.com 或手机 App 中登录即可开始。以下为官方订阅体系(价格与额度以 官方订阅页 为准,可能随时调整):

  1. 免费版($0/月):基于 Gemini Flash 系列模型,可用于日常问答、写作、总结、图片生成、Deep Research(有月度次数上限)等,附带 15 GB Google 账号存储。有使用频率限制。
  2. Google AI Plus(约 $4.99/月):用量约为免费版 2 倍,含视频生成、每日简报(Daily Brief)、NotebookLM 访问权,存储升级到 400 GB。
  3. Google AI Pro(约 $19.99/月):用量约为免费版 4 倍,可完整使用最新 Gemini Pro 模型、Deep Research 与智能体(agentic)能力,含约 5 TB Google One 存储、更高的 NotebookLM 额度,并附赠 YouTube Premium 等权益。
  4. Google AI Ultra(约 $99.99 起 / $199.99):面向重度创作者与开发者,用量最高可达 Pro 的 20 倍,率先体验 Deep Think 等尖端功能,存储从 20 TB 起。

提示:新用户常有免费试用;学生和特定地区也可能有优惠,订阅前建议在官方页确认当前价格与本地货币。

三、核心功能分步操作

1. 基础对话

  1. 打开 gemini.google.com 并登录。
  2. 在底部输入框输入问题,回车或点击发送。
  3. 若对回答不满意,可点击回答下方的「重新生成」查看其他草稿,或直接追问「说得再详细些」「用表格总结」。
  4. 左上角可选择模型(如 Flash 快速版或 Pro 高质量版)。

2. 上传图片与文件

  1. 点击输入框左侧的「+」(添加文件)图标。
  2. 选择从设备上传、或从 Google Drive 选取图片、PDF、Word、表格等。
  3. 输入你的指令,例如「总结这份 PDF 的三个要点」或「这张图里的路牌写了什么?」。
  4. 发送后 Gemini 会结合文件内容作答。

3. 生成与编辑图片

  1. 直接用自然语言描述,例如「生成一张水彩风格的江南水乡黄昏图」。
  2. 生成后可继续对话式编辑:「把天空换成星空」「加一只小船」——Gemini 的图片模型支持在原图基础上迭代修改。
  3. 点击图片可下载或分享。

4. Deep Research 深度研究

这是 Gemini 最强大的功能之一,会自动检索并综合几十上百个来源,产出一份带引用的研究报告。

  1. 点击输入框的「+」/工具菜单,选择 Deep Research(深度研究)。
  2. (可选)上传参考文件,并选择检索来源:默认包含 Google 搜索,还可加入你的 Gmail、Google Drive、NotebookLM 笔记。
  3. 输入研究主题后点击提交,Gemini 会先给出一份研究计划。
  4. 点击「编辑计划(Edit plan)」可增删调研方向,确认后点击「开始研究(Start research)」。
  5. 报告通常需要 5–10 分钟,期间可离开页面,完成后会收到通知。
  6. 报告生成在 Canvas 中,可一键导出到 Google Docs、生成音频概览收听、创建可视化图表或分享。

5. Gems 自定义 AI 助手

Gems 是你可复用的专属助手,预先设定好角色和知识,免去每次重复交代背景。

  1. 打开左侧边栏,点击 Gems,再点击 新建 Gem(New Gem)。
  2. 填写名称与「指令(Instructions)」,说明它的角色、语气、输出格式和限制。官方建议指令控制在 500–2000 字符;也可点「用 Gemini 改写指令」让 AI 帮你完善。
  3. 在「Knowledge(知识)」下点击「添加文件」,上传本地文件或从 Drive、NotebookLM 关联文档,让 Gem 基于你的资料回答。
  4. 右侧可输入提示词预览效果,满意后点击保存。之后在侧边栏随时调用。

6. 与 Workspace(Gmail / Docs)集成

在符合条件的 Workspace 或个人订阅下,Gemini 会作为侧边栏出现在 Google 应用中:

  1. 在 Gmail、Docs 右上角点击 「Ask Gemini」 图标打开侧边栏。
  2. Gmail 写邮件:在撰写窗口点击「帮我写(Help me write)」,输入需求(如「用礼貌语气回复这封邮件并确认周五开会」)即可生成草稿。可用「@」标注并引用某个 Drive 文件。
  3. Docs 写作:在侧边栏输入指令让它起草、改写、总结长文,或直接把内容插入文档。

四、进阶技巧

  1. 给足上下文与角色:与其问「写个方案」,不如说「你是资深市场经理,为一款面向大学生的咖啡新品写一份 300 字上市方案,含目标人群和一句 slogan」。
  2. 让它反问你:在提示词结尾加「在动手前,先问我 3 个能提升结果质量的问题」,能显著提高产出契合度。
  3. 善用文件 + Deep Research 组合:先上传自己的资料,再让 Deep Research 结合外部搜索交叉验证,得到既贴合你数据又有外部佐证的报告。
  4. 用 Gems 固化重复工作流:把「周报生成器」「英文润色器」「SQL 助手」做成 Gem,长期节省重复交代的时间。
  5. 切换模型省额度:日常轻量任务用 Flash 快速版,复杂推理和长文档再切到 Pro 模型,兼顾速度与质量。
  6. 指定输出格式:明确要求「用 Markdown 表格」「分点列出」「控制在 200 字内」,减少来回修改。

五、常见问题 FAQ

Q1:免费版够用吗?需要升级吗? 日常问答、写作、看图看文件、少量 Deep Research 完全够用。若你频繁做深度研究、要用最新 Pro 模型、需要大量视频生成或更大存储,再考虑 AI Pro/Ultra。

Q2:Gemini 会用我的数据训练模型吗?隐私如何? 可在设置的「Gemini 应用活动」中关闭活动记录以减少数据留存。企业版 Workspace 有独立的数据保护承诺,你的公司数据不会被用于训练面向大众的模型。上传敏感信息前请查阅当前官方隐私政策。

Q3:Deep Research 有次数限制吗? 有。免费版有较低的月度上限,付费版额度大幅提高(Pro/Ultra 上限更高)。具体次数以官方页面为准。

Q4:中文支持怎么样? Gemini 对中文的理解与生成能力很强,可直接用中文对话、生成中文报告;但部分尖端功能(如某些实验特性)可能先在英文/美国地区上线。

六、实用示例

示例 1:市场调研报告(Deep Research)

提示词:「用 Deep Research 调研『2026 年中国现制茶饮市场趋势』,重点覆盖:头部品牌份额、下沉市场增长、健康化产品趋势、以及消费者价格敏感度。输出中文报告,每个结论标注来源,并在结尾给出对新入局品牌的 3 条建议。」

完成后导出到 Google Docs,并生成音频概览在通勤时收听。

示例 2:把截图变成可执行清单

操作:上传一张会议白板照片 + 提示词:「把这张白板照片里的待办事项整理成 Markdown 表格,列出:任务、负责人、截止日期;无法识别的字段标注『待确认』。」

再追问「基于以上清单,帮我起草一封发给团队的中文跟进邮件」,即可无缝衔接到 Gmail 使用。


掌握「对话 → 上传资料 → Deep Research → 用 Gems 固化流程 → 在 Workspace 落地」这条主线,你就能把 Gemini 从聊天玩具变成真正的生产力工具。