快速入门入门

Gemini 怎么用:网页与手机端完整入门

Gemini 应用在 gemini.google.com 以及 Android / iOS 应用上使用,用个人 Google 账号登录即可开始,不需要另外注册。它接受文字、图片与文件输入,能直接生成 Docs、Sheets、PDF 等文件。要注意的是:免费与付费方案下都可能有人工审阅参与,官方明确建议不要输入你不希望被审阅者看到的机密信息。

Gemini 应用的入口、账号、多模态输入、文件生成、隐私边界与常见限制。

AI机场约 5 分钟更新于

开始之前

  • 一个可用的 Google 账号(个人账号最省事)
  • 能正常访问 gemini.google.com 的网络环境

快速步骤

  1. 从官方入口进入

    打开 gemini.google.com,或安装 Android / iOS 上的 Gemini 应用,用 Google 账号登录。

  2. 先检查活动记录设置

    在设置里确认活动记录是开还是关,明白这决定了对话会被保存多久、是否用于改进产品。

  3. 用一个真实任务开场

    描述目标、材料与想要的输出形式,而不是丢一个关键词试探。

  4. 加入图片或文件

    上传截图、表格或文档,围绕具体内容提问,而不是让它凭空生成。

  5. 需要成品时让它出文件

    要求导出为 Docs、Sheets 或 PDF 等格式,再在对应工具里继续修改。

面向普通用户的 Gemini 使用教程:从哪里进入、用什么账号登录、图片与文件怎么用、生成的文件怎么导出、免费和付费差在哪,以及你的对话会被谁看到。

先分清三个「Gemini」

搜索 Gemini 会同时搜到三样东西,把它们的教程混着看是新手最容易走的弯路:

名字是什么怎么进入谁该用
Gemini 应用面向使用者的助手gemini.google.com 或手机应用,Google 账号登录所有人
Google AI Studio网页版工作台aistudio.google.com,Google 账号登录要调提示词、拿 API Key 的开发者
Gemini API程序调用的接口代码里用 API Key 调用要把模型接进自己产品的人

背后是同一批模型,区别在于你站在哪个位置使用它。 这篇讲的是第一行。要调参数和导出代码看 Google AI Studio 入门,要写代码调用看 Gemini API 使用教程

入口与账号

网页端是 gemini.google.com,另外有 Android 与 iOS 应用,也可以从 Chrome 与 Google Messages 里直接唤起。浏览器方面,Chrome、Safari、Firefox、Opera、Edge 都在官方支持列表里。

账号有三种情况:

  • 个人 Google 账号:直接登录,最省事。
  • 工作账号(Workspace):需要满 18 岁,并且要看所在组织开没开这项服务。
  • 学校账号:由管理员决定是否开放。

Family Link 管理的 13 岁以下账号无法使用。登录后提示「当前账号不可用」时,先确认自己用的是哪一类账号,而不是去排查网络。

先看一眼活动记录设置

大多数教程会把这一段放到最后,但它决定了你之后能往里面贴什么内容,所以放在开头。

官方隐私说明写得很直接:有人工审阅参与,并且建议不要输入你不希望被审阅者看到的机密信息。 具体机制是这样的:

  • 活动记录开启时,对话会被保存,并可能用于改进 Google 的服务(包含模型训练),其中有人工审阅环节。默认保留 18 个月,可以改成 3 个月或 36 个月。
  • 活动记录关闭时,新的对话不再进入训练链路,但官方说明仍会保留约 72 小时,用于提供服务与安全目的。
  • 已经被人工审阅过的内容会与账号断开后单独保留最长三年,即使你删除了自己的活动记录,这部分也不会一并消失。

结论很清楚:关掉活动记录能减少数据被用于改进产品,但它不是「阅后即焚」。客户资料、未公开材料、任何密钥都不该出现在对话框里。

第一次提问该怎么写

新手最常见的用法是打一个词试探它的反应,这恰恰是最难得到好结果的方式。有效的提问通常包含四件事:

  1. 要做什么:写一封回复、整理一份表、找出问题所在。
  2. 给它材料:粘贴原文、上传截图,而不是让它猜。
  3. 约束输出:多少字、什么格式、要不要分点、给不给来源。
  4. 说明读者:给同事看还是给客户看,语气差别很大。

举个对比。「帮我写个方案」得到的一定是空泛模板;「根据下面这份会议记录,写一份给客户的两页方案,只用记录里出现过的数字,结尾列出三个待确认事项」得到的才是能用的初稿。

图片与文件:它真正擅长的部分

上传能力是它和纯文本助手最实际的差别。几种确实好用的场景:

  • 截图排错:把报错界面截下来问「这一步为什么失败」,比自己复述准确得多。
  • 表格理解:上传表格让它找异常值、汇总口径不一致的地方。
  • 文档摘要与提问:针对长文档提具体问题,比让它「总结一下」有用。
  • 图文材料整理:把散落的图片和说明整理成一份结构化清单。

有一点要留意:回答里如果引用了文件中的具体内容,说明它确实读到了;如果通篇泛泛而谈,多半没有正确解析。 遇到后者不要继续追问,先换个格式重新上传。

让它直接产出文件

它可以把结果直接生成为文件——Docs、Sheets、PDF、DOCX、XLSX、CSV、LaTeX 等格式都在官方列出的能力范围内。这一步的实际价值是省掉复制粘贴时的格式丢失。

合理的用法是:让它出初稿文件,在对应工具里做最终修改,而不是指望一次生成就能直接交付。

模型档位怎么选

界面上的模型选择器通常按「快」到「强」分档:轻量档反应最快、适合简单问答;中间档是日常默认;高档位用于复杂推理与写代码。具体档位名称与可用范围官方一直在调整,以你界面里的选择器为准,不要照抄任何文章里写死的模型名,也不要直接问它「你是哪个模型」——模型对自身版本的描述并不可靠。

需要多次输出保持一致时,固定用同一档,不要中途换。

和 Google 办公产品配合

当你要处理的内容本来就在 Gmail、Docs、Drive 里时,联动省掉的是搬运成本。它也能按当前位置给出与地点相关的回答,并支持连接部分其他应用。

这类联动的价值高度依赖你的工作是否真的在 Google 生态里。如果材料都在本地或别家网盘,先把文件传上来提问反而更直接。

免费和付费的差别

免费方案足够完成日常任务。付费方案买到的主要是更高的用量上限、更强的模型档位与一部分额外功能。

具体条目和价格变化频繁,这里不写死,以官方定价页面为准。判断要不要付费的实际方法是:先用免费方案跑两周真实任务,看你撞到的是用量墙还是能力墙——撞用量墙才值得升级,撞能力墙要先改提问方式。

什么时候不该用应用版

三种情况应该换工具:

  • 要反复调提示词和参数:应用版没有参数面板,去 Google AI Studio
  • 要把能力接进自己的产品:需要的是接口而不是聊天框,看 Gemini API 使用教程
  • 要处理受保密约束的材料:消费级应用不合适,理由见上面的隐私一节。

连不上的时候

打不开或者对话中断,先按 AI 工具提示网络错误的原因与排查 的顺序排查——它不一定是网络问题,账号类型、地区限制、浏览器扩展都会表现成同一个提示。

相关内容

参考资料

常见故障与解决方法

登录后提示当前账号不可用

可能原因使用的是工作或学校账号,管理员未开启该服务;或账号受 Family Link 年龄限制。

解决方法换成个人 Google 账号登录,或联系所在组织的管理员确认是否开放。工作账号还有 18 岁以上的要求。

上传文件后没有得到基于文件的回答

可能原因文件格式不被支持、体积过大,或提问没有把注意力指向文件内容。

解决方法先确认文件确实被识别(回答里应能引用其中的具体内容),再把问题改成针对文件的具体提问,例如「这份表格第三列的异常值有哪些」。

同一个问题两次回答差别很大

可能原因生成结果本身带随机性,而且不同模型档位的行为不同。

解决方法把约束写进提问本身——输出格式、字数、必须依据哪份材料;需要稳定输出时固定使用同一个模型档位。

回答里引用了不存在的资料

可能原因模型在缺乏依据时仍然会给出流畅表述。

解决方法凡是要用到的事实都要求它给出来源并自己点开核对;重要结论不要只依赖单次回答。

担心贴进去的内容被人看到

可能原因官方说明中存在人工审阅环节,被审阅的内容还会单独保留一段时间。

解决方法不要输入客户资料、密钥、未公开材料这类内容。需要处理敏感数据时,改用有数据处理条款的付费接口,而不是消费级应用。

常见问题

Gemini、Google AI Studio、Gemini API 有什么区别?

面向的人不同。Gemini 应用是给使用者的助手,登录就能用;Google AI Studio 是给开发者调提示词和参数的网页工作台;Gemini API 是程序调用的接口,用 API Key 认证。三者背后是同一批模型,学的时候不要混在一起。

需要付费吗?

有免费方案可以直接用。付费方案主要买的是更高用量、更强的模型档位和一些额外功能,具体包含什么、多少钱以官方定价页面为准,这部分变动比较频繁。

我的对话会被用来训练模型吗?

取决于活动记录设置。开启时,对话会被保存并可能用于改进 Google 的服务,其中包含人工审阅。关闭后新的对话不再进入这条链路,但官方说明仍会短暂保留一段时间用于提供服务与安全目的。

关掉活动记录就完全不留痕迹了吗?

不是。官方说明是关闭后仍会保留一段很短的时间用于服务与安全用途。另外,已经被人工审阅过的内容会与账号断开后单独保留较长时间,删除自己的活动记录也不会一并删掉它。

支持哪些文件类型?

常见的图片和文档类型都可以,并且能反过来生成 Docs、Sheets、PDF 等格式的文件。具体清单官方会调整,以应用内的上传界面提示为准。

可以不登录使用吗?

官方提供了有限的未登录体验,但功能受限。要用到上传文件、保存对话、跨设备同步这些能力,还是需要登录。

用它处理公司文档安全吗?

消费级应用不适合处理受保密约束的材料,理由见上面关于人工审阅的说明。企业场景应该走 Workspace 的对应版本或有数据处理条款的付费接口,由所在组织确认合规口径。

回答说自己是某个具体模型版本,可信吗?

模型对自身版本的描述不可靠,它没有稳定的自我认知。要确认当前用的是哪一档,看界面上的模型选择器,不要问它本人。