Gemini

Gemini

谷歌生态原生的多模态AI助手,会搜索、懂你的应用

核心功能

Google出品的个人AI助手,深度融入Google账号与搜索生态。可打字、语音、传图或拍照提问,Android用「Hey Google」唤起;速览Gmail与Drive资料、基于搜索实时作答;Gemini Live实时语音、Deep Research生成报告,付费档解锁更高用量与百万上下文。

功能亮点

屏幕问答

Android上喊「Hey Google」,直接询问当前屏幕内容并执行操作

多应用串联

一条指令跨Gmail、日历、地图取数,办完事不用切App

实时语音

Gemini Live边听边答,适合采访练习、头脑风暴与出行导览

百万上下文

Pro档1M token,一次读完整本长书或整段代码仓库

逻辑图谱

    flowchart LR
    A[多模态输入] --> B[原生多模态理解]
    B --> C[超长上下文推理]
    C --> D[跨 Google 生态整合]
    D --> E[生成输出]

适用 / 不适用场景

✓ 适用
  • 图文音视频多模态理解
  • 超长文档与代码库分析
  • 与 Google Workspace 协作
  • 移动端实时 AI 助手
  • 科研与数据分析
✗ 不适用
  • 中国大陆直接访问(需梯子)
  • 完全离线运行
  • 对 Google 生态外的隐私敏感场景
  • 需要强本地化中文服务

自定义模型 / 模型接入

锁定(官方模型)

仅提供Google自家Gemini模型,默认按问题自动路由Flash/Pro,订阅档位决定模型访问级别与上下文上限。

接入方式
  • 官方Web/App直接使用
  • 订阅Google AI Plus/Pro/Ultra提升模型权限
  • API经Google AI Studio/Vertex AI调用
支持模型
Gemini系列(Flash/Pro自动路由)Imagen图像生成Veo/Omni视频生成

适用场景

• Gmail/Drive资料速览与总结
• 拍照识物与屏幕问答
• 实时语音对话与练习
• 深度调研生成报告
• 行程规划与地图串联

安装配置

浏览器访问 https://gemini.google.com 用Google账号登录;Android/iOS应用商店下载Gemini App;订阅Google AI Plus/Pro/Ultra提升用量

使用方法

bash
1) 打开gemini.google.com或手机App,用Google账号登录
2) 直接打字、说话或拍照提问,如「这张图里的植物是什么」
3) 让Gemini速览Gmail邮件或Drive文档,快速定位关键信息
4) 问「做份关于XX的调研报告」,用Deep Research自动检索数百网页出报告
5) 在Android上把Gemini设为默认助手,喊「Hey Google」询问屏幕内容
6) 用Gems保存常用指令与文件,打造专属AI专家

关键指标

尚未核验对标产品,此处只列本工具自身指标,不做对比结论。

指标Gemini
价格免费增值
开源
上手难度入门
Token 消耗

相关工具

同类工具

优点

  • 与Google搜索、全家桶深度打通
  • 多模态输入方式丰富
  • 免费档功能完整
  • 语音与屏幕交互自然

缺点

  • 部分功能按地区/语言分批开放
  • 高级模型与高用量需订阅
  • 依赖Google账号生态